{"as_of":"2026-08-19T03:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:00aa6ad1d771eebc8bc4decd78976d039caaea77ba1ae33c9a2fb471c359c8bb","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:52:25.360875Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":4,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-12T13:33:38.400526Z","title":"W ¨urstchen: An efficient architecture for large-scale text-to- image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16164","last_updated":"2024-11-25T07:40:32Z","snapshot_observed_at":"2026-08-17T23:16:51.618908Z","submitted_at":"2024-11-25T07:40:32Z","title":"Text-to-Image Synthesis: A Decade Survey","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-08-12T13:33:38.400526Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2411.16164"},"observation_digest":"sha256:0d22ad87f0d01d89c046eefeb890e682fe8375c25fd94e0224ac1c333819f58b","observation_id":"11fe9d6c-a463-4dd4-bd54-1f2fbcc4fe1a","resolution":{"observed_at":"2026-08-12T13:33:38.400526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-12T14:24:43.634874Z","title":"W ¨urstchen: An efficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16720","last_updated":"2025-04-24T21:37:00Z","snapshot_observed_at":"2026-08-19T00:15:02.547227Z","submitted_at":"2024-11-23T02:01:49Z","title":"Importance-Based Token Merging for Efficient Image and Video Generation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T14:24:43.634874Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2411.16720"},"observation_digest":"sha256:62fece52fcce960a4aa4dccdcb6fa86d072f5496d7af6b79b78b4431b5ea2573","observation_id":"3ade7ec4-3a0e-4d5a-8155-7d9119047efa","resolution":{"observed_at":"2026-08-12T14:24:43.634874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-11T13:28:09.416801Z","title":"W ¨urstchen: An efficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.13155","last_updated":"2025-09-10T13:21:10Z","snapshot_observed_at":"2026-08-17T10:02:56.866170Z","submitted_at":"2024-12-17T18:28:48Z","title":"F-Bench: Rethinking Human Preference Evaluation Metrics for Benchmarking Face Generation, Customization, and Restoration","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T13:28:09.416801Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2412.13155"},"observation_digest":"sha256:167f9ab9ffcb9897b0b2bcb43f19d912e2a81a8808f3d506da31efe6ac7aeb00","observation_id":"5dc5d659-b074-4d50-b477-a71a5578b50e","resolution":{"observed_at":"2026-08-11T13:28:09.416801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-11T12:28:54.837981Z","title":"W ¨urstchen: An efficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14170","last_updated":"2024-12-19T02:42:46Z","snapshot_observed_at":"2026-08-18T18:12:36.062970Z","submitted_at":"2024-12-18T18:59:53Z","title":"E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T12:28:54.837981Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2412.14170"},"observation_digest":"sha256:ee0344bf60ece527f42695d8f4b02050ace477340035bca37b8a51c2f9eb6ba0","observation_id":"d1b1ea72-e1da-414e-a8ea-8600c38163f9","resolution":{"observed_at":"2026-08-11T12:28:54.837981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-10T21:39:36.325604Z","title":"Würstchen: An efficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.04284","last_updated":"2025-01-09T01:58:41Z","snapshot_observed_at":"2026-08-18T00:11:51.921697Z","submitted_at":"2025-01-08T05:15:43Z","title":"ContextMRI: Enhancing Compressed Sensing MRI through Metadata Conditioning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T21:39:36.325604Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2501.04284"},"observation_digest":"sha256:e68a1644c8eeff0ef26de827ce8e5d0511c1c698540cd5ebd3ac4b971e58f376","observation_id":"b0010d81-d028-4f94-9c3f-fc1feb403255","resolution":{"observed_at":"2026-08-10T21:39:36.325604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-16T11:52:25.360875Z","title":"W ¨urstchen: An efficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14470","last_updated":"2025-04-20T03:30:59Z","snapshot_observed_at":"2026-08-16T16:37:23.812696Z","submitted_at":"2025-04-20T03:30:59Z","title":"Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:52:25.360875Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2504.14470"},"observation_digest":"sha256:6aa12a84bb831c4da2d8744dddcc30455ca8249c3d1213de7a223b90f2f24e40","observation_id":"18f93a58-db4d-4094-bac1-17e8287198d4","resolution":{"observed_at":"2026-08-16T11:52:25.360875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-16T11:37:23.829011Z","title":"W ¨urstchen: An efficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15145","last_updated":"2025-04-21T14:49:15Z","snapshot_observed_at":"2026-08-16T15:59:28.736071Z","submitted_at":"2025-04-21T14:49:15Z","title":"\"I Know It When I See It\": Mood Spaces for Connecting and Expressing Visual Concepts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:37:23.829011Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2504.15145"},"observation_digest":"sha256:5d61c7f834e55f4a1ee1857841a76f40a119ef240eedcae12ce7e928937ec1cf","observation_id":"70739241-f4bf-4cbd-a59e-c2efb3754414","resolution":{"observed_at":"2026-08-16T11:37:23.829011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-16T00:53:12.480055Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.02527","last_updated":"2025-05-05T10:08:31Z","snapshot_observed_at":"2026-08-17T14:16:15.956014Z","submitted_at":"2025-05-05T10:08:31Z","title":"Text to Image Generation and Editing: A Survey","version":1},"reference_index":193,"source":"pdf_text","source_observed_at":"2026-08-16T00:53:12.480055Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2505.02527"},"observation_digest":"sha256:9dddb1c50102522860c86fde5034bc9e53659b7ad95eef61c89cdfc5ad59a4b6","observation_id":"d8ba6d4f-37bb-4b71-baca-99ed4835ce38","resolution":{"observed_at":"2026-08-16T00:53:12.480055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-07T12:43:36.347507Z","title":"Würstchen: An efficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24023","last_updated":"2025-05-29T21:48:28Z","snapshot_observed_at":"2026-08-17T21:07:28.604581Z","submitted_at":"2025-05-29T21:48:28Z","title":"Multi-Group Proportional Representation for Text-to-Image Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:43:36.347507Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2505.24023"},"observation_digest":"sha256:69e93b204b33a3bac0d2649d0fe196d582c5bc45a41654ddfee9b91573358ea3","observation_id":"aaa03dd1-fccb-4583-85a5-d1ed050a5cd9","resolution":{"observed_at":"2026-08-07T12:43:36.347507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-07T12:40:41.897086Z","title":"Richter, Christopher J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24086","last_updated":"2025-05-30T00:13:36Z","snapshot_observed_at":"2026-08-13T23:12:12.846413Z","submitted_at":"2025-05-30T00:13:36Z","title":"ComposeAnything: Composite Object Priors for Text-to-Image Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:41.897086Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2505.24086"},"observation_digest":"sha256:0019646931f7ea0ccee0aee2514c666228df670d163a6242c728753174b5deca","observation_id":"7694aea0-5f20-4b06-8e30-35e8c34c01b1","resolution":{"observed_at":"2026-08-07T12:40:41.897086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-15T18:59:14.707804Z","title":"Pernias, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18290","last_updated":"2025-06-23T04:59:49Z","snapshot_observed_at":"2026-08-15T19:07:23.571186Z","submitted_at":"2025-06-23T04:59:49Z","title":"Instability in Diffusion ODEs: An Explanation for Inaccurate Image Reconstruction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:59:14.707804Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2506.18290"},"observation_digest":"sha256:0891152008787a2cc3771612acb66d4933148769ff6c8008021ad55a63f078ee","observation_id":"38432713-94a2-491d-8eff-057445b6bd45","resolution":{"observed_at":"2026-08-15T18:59:14.707804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-06T14:53:42.829160Z","title":"L., Pal, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17416","last_updated":"2025-07-23T11:18:44Z","snapshot_observed_at":"2026-08-18T23:07:10.668985Z","submitted_at":"2025-07-23T11:18:44Z","title":"Efficient and Robust Semantic Image Communication via Stable Cascade","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T14:53:42.829160Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2507.17416"},"observation_digest":"sha256:4fc64bf9247c44ded30e781fe8ab31f3173a1f5c4bce075e4420e93a37a09734","observation_id":"1f19ec50-389e-47ac-95cd-db9ff3635880","resolution":{"observed_at":"2026-08-06T14:53:42.829160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-06T12:56:59.880375Z","title":"Richter, Christo- pher J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21367","last_updated":"2025-07-28T22:27:58Z","snapshot_observed_at":"2026-08-16T09:05:48.027918Z","submitted_at":"2025-07-28T22:27:58Z","title":"Exploring Probabilistic Modeling Beyond Domain Generalization for Semantic Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T12:56:59.880375Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2507.21367"},"observation_digest":"sha256:33bf2d6bbf34fefaba60bba1a9064772e76fc412b1a83244a604631a1651c527","observation_id":"22079b12-2811-4406-88b9-c9cb05e76bd7","resolution":{"observed_at":"2026-08-06T12:56:59.880375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-06T05:32:12.130886Z","title":"Pernias, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01605","last_updated":"2025-08-03T05:42:20Z","snapshot_observed_at":"2026-08-14T01:12:46.928596Z","submitted_at":"2025-08-03T05:42:20Z","title":"Practical, Generalizable and Robust Backdoor Attacks on Text-to-Image Diffusion Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T05:32:12.130886Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2508.01605"},"observation_digest":"sha256:d5256326646ef11289bd1218468a7cd93acb0070382073918ea83a6d2df1b415","observation_id":"386213fd-5a87-40b0-8cca-0cb1cd43deb3","resolution":{"observed_at":"2026-08-06T05:32:12.130886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-05T16:51:04.736238Z","title":"L.; Pal, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.17718","last_updated":"2025-08-25T06:51:15Z","snapshot_observed_at":"2026-08-10T14:17:17.888963Z","submitted_at":"2025-08-25T06:51:15Z","title":"Instant Preference Alignment for Text-to-Image Diffusion Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T16:51:04.736238Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2508.17718"},"observation_digest":"sha256:50c3d8b4a7cd86623cdce2e37399dafa2b28d3f44bb155f9e9aeb19af4629ae8","observation_id":"8fe91b09-ad32-484d-8576-85cfa1065a84","resolution":{"observed_at":"2026-08-05T16:51:04.736238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-03T20:30:34.111709Z","title":"W ¨urstchen: An efficient architecture for large-scale text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19778","last_updated":"2026-06-30T01:28:09Z","snapshot_observed_at":"2026-08-15T16:22:05.631288Z","submitted_at":"2025-11-24T23:10:15Z","title":"Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T20:30:34.111709Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2511.19778"},"observation_digest":"sha256:9e41cc9dab7de58fb572520afc76bc31b56fb88078a4cc1aac011d4a43f62e52","observation_id":"4381c461-4fd7-47eb-bc14-b5188c581c79","resolution":{"observed_at":"2026-08-03T20:30:34.111709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":"2306.00637","doi":"10.48550/arxiv.2306.00637","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W¨urstchen: An efficient architecture for large-scale text-to-image diffusion models.arXiv preprint arXiv:2306.00637","venue":"arXiv (Cornell University)","work_id":"912235f7-a05e-4790-b99e-a7571f030e4f","year":2023},"citing_paper":{"arxiv_id":"2604.24952","last_updated":"2026-04-27T19:49:04Z","snapshot_observed_at":"2026-08-13T13:39:58.503395Z","submitted_at":"2026-04-27T19:49:04Z","title":"Learning from Noisy Preferences: A Semi-Supervised Learning Approach to Direct Preference Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T04:18:59.884884Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2604.24952"},"observation_digest":"sha256:d96105a20a9bfd18f539bf06b73329c04360a02f96db99dbef0ff3b9eb5e9e0c","observation_id":"590b6738-e573-4a9c-b22a-0fb993535a86","resolution":{"observed_at":"2026-05-11T21:46:44.787342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":"2306.00637","doi":"10.48550/arxiv.2306.00637","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W¨urstchen: An efficient architecture for large-scale text-to-image diffusion models.arXiv preprint arXiv:2306.00637","venue":"arXiv (Cornell University)","work_id":"912235f7-a05e-4790-b99e-a7571f030e4f","year":2023},"citing_paper":{"arxiv_id":"2606.20764","last_updated":"2026-06-18T11:56:04Z","snapshot_observed_at":"2026-08-17T01:58:43.107966Z","submitted_at":"2026-06-18T11:56:04Z","title":"One Image is All You Need: Agentic One-Shot Image Generation via Text-Based World Models for Long-Tail Spatial Perception","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T18:22:41.189820Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2606.20764"},"observation_digest":"sha256:0cab0d7d01efd2e194b1e96dac24e8dd1aae5874c43dc5d6c14adc5d24487b00","observation_id":"20a27811-3f08-4254-a2c8-0816551f5c93","resolution":{"observed_at":"2026-07-04T03:09:30.089338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":"2306.00637","doi":"10.48550/arxiv.2306.00637","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"W¨urstchen: An efficient architecture for large-scale text-to-image diffusion models.arXiv preprint arXiv:2306.00637","venue":"arXiv (Cornell University)","work_id":"912235f7-a05e-4790-b99e-a7571f030e4f","year":2023},"citing_paper":{"arxiv_id":"2606.31288","last_updated":"2026-06-30T08:04:17Z","snapshot_observed_at":"2026-08-13T08:51:11.579231Z","submitted_at":"2026-06-30T08:04:17Z","title":"Probabilistic Inversion with Flow Matching","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-01T06:21:38.834426Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2606.31288"},"observation_digest":"sha256:0fcdd000529b14118c0fcb22b685773e9793ba61a1d4ee520fd578aec703fd42","observation_id":"f90586e7-418e-4ad2-a7d1-40c20431b9a5","resolution":{"observed_at":"2026-07-01T06:25:26.855556Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00637","snapshot_observed_at":"2026-08-01T10:59:54.278964Z","title":"Würstchen: An efficient architecture for large-scale text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20048","last_updated":"2026-07-22T11:42:42Z","snapshot_observed_at":"2026-08-05T09:15:47.648858Z","submitted_at":"2026-07-22T11:42:42Z","title":"Importance-Aware OBS Pruning for Diffusion Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T10:59:54.278964Z"},"links":{"cited_paper":"/paper/2306.00637","citing_paper":"/paper/2607.20048"},"observation_digest":"sha256:b587aec634ca53ee3dd91034932a0a6819369351378aa8fa703151d589c32e9e","observation_id":"abcb58e5-c601-4e08-8250-8b92ba79a367","resolution":{"observed_at":"2026-08-01T10:59:54.278964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.00637/citation-record","integrity":"/paper/2306.00637/integrity","json":"/paper/2306.00637/citation-record.json","paper":"/paper/2306.00637"},"outbound":[],"paper":{"arxiv_id":"2306.00637","last_updated":"2023-09-29T05:32:46Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T15:27:32.220354Z","submitted_at":"2023-06-01T13:00:53Z","title":"Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2306.00637."}