{"as_of":"2026-08-19T10:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e4982697c02f55fe71017703493dcea0c470a9356c35268354ce4aa79a5f88a3","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:27:38.452369Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T01:52:22.693057Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T01:53:51.049313Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2505.04718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.04718","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Srivastava et al","venue":null,"work_id":"2488ce30-7dea-496d-9541-fa6d77ff6224","year":2025},"citing_paper":{"arxiv_id":"2512.04832","last_updated":"2026-08-04T18:23:59Z","snapshot_observed_at":"2026-08-11T09:25:29.901843Z","submitted_at":"2025-12-04T14:16:09Z","title":"BIM-Native Tokenization for Constraint-Aware Room Layout Synthesis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T01:52:22.693057Z"},"links":{"cited_paper":"/paper/2505.04718","citing_paper":"/paper/2512.04832"},"observation_digest":"sha256:78efb22ed9525bafc90d9439160235d918152bef43873210c3314fa1748eea70","observation_id":"6bfd060f-ce54-46e8-9bb3-59890602e04d","resolution":{"observed_at":"2026-05-17T01:53:51.051161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.04718/citation-record","integrity":"/paper/2505.04718/integrity","json":"/paper/2505.04718/citation-record.json","paper":"/paper/2505.04718"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.201066Z","title":"Variational transformer networks for layout generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.201066Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:d57d54580444de52360be8b1c03aa5ed91c8fdb20bf313ea6ca3cfbd6d553340","observation_id":"ab05bc77-ef47-4b93-b816-2ef143fd8013","resolution":{"observed_at":"2026-08-15T23:27:38.201066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-08-16T13:42:52.013374Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-08-15T23:27:38.208964Z","title":"Make it count: Text-to-image gen- eration with an accurate number of objects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.208964Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:11576c602b48f2b1b7e8b0d24d84eab2a4b76572eb50543ec0497372cbabba4d","observation_id":"01f025d5-9ee2-4cf9-b875-8d030059614e","resolution":{"observed_at":"2026-08-15T23:27:38.208964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.262109Z","title":"Video generation models as world sim- ulators","venue":null,"work_id":"80bec387-1544-421a-bc7c-75aef33f810b","year":2024},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.213591Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:9a3c80d14c4dffd30dbd67a5a5fd5ac5cac207de00aaa255a35828c62db61034","observation_id":"dfd990db-fc53-47e2-b21e-0aa89b8fae5c","resolution":{"observed_at":"2026-08-15T23:27:39.266995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.218473Z","title":"Lay- outdm: Transformer-based diffusion model for layout gener- ation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.218473Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:9e0030777241971f925179922d0cd4a62650feeaa07f8ebe8791aa97e3dd2f7d","observation_id":"ee4a9a46-accb-4812-8043-5deb43fafb1f","resolution":{"observed_at":"2026-08-15T23:27:38.218473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-15T23:27:38.230739Z","title":"Pixart- α: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.230739Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:b2cb04d18bfb411dfe9de1bc11c68b4c2e976fa5cd3dc4c72235c07c70b2e5a1","observation_id":"437da4cd-0d24-49c0-90bd-9c6a4c73ff74","resolution":{"observed_at":"2026-08-15T23:27:38.230739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.236553Z","title":"Diffu- siondet: Diffusion model for object detection, 2023","venue":null,"work_id":"ecbb1ddc-1511-43ef-a0f8-22bd8e10e3ff","year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.236917Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:08469a62f90e544da09697a3b58db77fc9d160a90e701a2b7c2c75933e507fd3","observation_id":"3b256f73-4775-4424-bdaa-6b7cf37349fd","resolution":{"observed_at":"2026-08-15T23:27:39.241541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.220222Z","title":"On the importance of noise scheduling for diffu- sion models, 2023","venue":null,"work_id":"7d0f0f2d-3497-4e87-82b8-5e27375e898f","year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.242131Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:9a27edf8a09200a55e1548a6f57ffa53d8d80ea7194c8a2228c5b26b77cc3c11","observation_id":"08ce8479-1981-48db-91d4-d17ad2307024","resolution":{"observed_at":"2026-08-15T23:27:39.225370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.204397Z","title":null,"venue":null,"work_id":"b2616ff5-726d-4bd1-b43a-3f0ce12edda8","year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.247028Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:3c5b3be7dc7333642511040cf768b451b493371adf87e203df392aadb90712fc","observation_id":"35f37455-52c7-446d-a94b-5a81b5cafecb","resolution":{"observed_at":"2026-08-15T23:27:39.209037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11427","last_updated":"2022-10-20T17:16:37Z","snapshot_observed_at":"2026-08-16T16:22:28.831035Z","submitted_at":"2022-10-20T17:16:37Z","title":"DiffEdit: Diffusion-based semantic image editing with mask guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11427","snapshot_observed_at":"2026-08-15T23:27:38.252469Z","title":"Diffedit: Diffusion-based seman- tic image editing with mask guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.252469Z"},"links":{"cited_paper":"/paper/2210.11427","citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:21bfbb2a815f787e488323e1859acfabcfec26384e32707675f87f8d6d14bb11","observation_id":"b8aeecdd-d1c5-4fbf-a6fa-a23b381416f3","resolution":{"observed_at":"2026-08-15T23:27:38.252469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.258143Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.258143Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:50af1ed11351982d7fa47fb2c004bf61a887cc587b76a957a8cd49b71225fd60","observation_id":"87cf59a4-c901-4836-ac0d-cf0e197d65c3","resolution":{"observed_at":"2026-08-15T23:27:38.258143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.179142Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":"637b7481-fc40-441c-83ff-d085f9557adf","year":2024},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.263139Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:c17dbf1fa33e380b276be364a9d8b3d774517319c6e274dcadb125c97603235f","observation_id":"959cd3db-7e64-4f4a-9227-09087c1508eb","resolution":{"observed_at":"2026-08-15T23:27:39.183863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15393","last_updated":"2023-10-28T06:56:32Z","snapshot_observed_at":"2026-08-16T15:30:02.167307Z","submitted_at":"2023-05-24T17:56:16Z","title":"LayoutGPT: Compositional Visual Planning and Generation with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15393","snapshot_observed_at":"2026-08-15T23:27:38.267762Z","title":"Layoutgpt: Compositional visual plan- ning and generation with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.267762Z"},"links":{"cited_paper":"/paper/2305.15393","citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:d57c527adad916d821418a823d7c90e0e714f925567c5a1f439e7c3f66bdf09a","observation_id":"6cb7c742-edfe-4324-8c28-61984f90fa25","resolution":{"observed_at":"2026-08-15T23:27:38.267762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17002","last_updated":"2024-04-09T07:46:43Z","snapshot_observed_at":"2026-08-19T09:38:48.227958Z","submitted_at":"2023-11-28T17:57:44Z","title":"Ranni: Taming Text-to-Image Diffusion for Accurate Instruction Following","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17002","snapshot_observed_at":"2026-08-15T23:27:38.272517Z","title":"Ranni: Taming text-to-image diffu- sion for accurate instruction following","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.272517Z"},"links":{"cited_paper":"/paper/2311.17002","citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:e180b44d3299f03b8e90ce3f368e149ebff64313c3d163e52be47447b4515dd1","observation_id":"025b527c-4732-4851-b3c5-73f53e14cecd","resolution":{"observed_at":"2026-08-15T23:27:38.272517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.163361Z","title":"Llm blueprint: Enabling text-to-image generation with complex and detailed prompts","venue":null,"work_id":"504d079c-34c8-4e2b-bdc8-613445686742","year":2024},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.277541Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:8716086bda9cadb51a600c65af8150f5bc00012facf72b0d0c257b1f53ee04dd","observation_id":"68eda13f-a5c8-4dc8-8849-f1176a38124f","resolution":{"observed_at":"2026-08-15T23:27:39.168838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.148431Z","title":"Layout- transformer: Layout generation and completion with self- attention","venue":null,"work_id":"d107eb3c-4da0-4521-b7a8-2efc66a90b39","year":2021},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.282613Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:04b7ea04f9602736984b53fd388924d54b79be8a3a9154da7e38cb15d2164e88","observation_id":"3f1e16b8-4846-4d23-9a5a-2629b5e599ca","resolution":{"observed_at":"2026-08-15T23:27:39.153178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.287376Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.287376Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:52799a0e26e3591d7a837040f43b0213cff7d4d3f5cf993fbe2dbbd446834424","observation_id":"8bbad877-46c0-489a-bf38-139611b41df5","resolution":{"observed_at":"2026-08-15T23:27:38.287376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-15T23:27:38.291769Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.291769Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:5c928b2306bd40e138041c12c132ee4dd91ffaa73fa4a30c3ddb00eae9a86060","observation_id":"85be1090-a2f4-4092-9b0e-73900d40e359","resolution":{"observed_at":"2026-08-15T23:27:38.291769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.296146Z","title":"Denoising diffu- sion probabilistic models, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.296146Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:2e72922fed0d7856409461ef92f975d2320506c6fbdd517aabb141901c2340e8","observation_id":"4c71b36a-fe7b-4442-846b-b3668789956f","resolution":{"observed_at":"2026-08-15T23:27:38.296146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.300789Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.300789Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:c5f438b4e5c9b4e8e4c51cb38e9a62ec0d152746339207bdb31c1d39c92d1b29","observation_id":"8c1ad611-902a-4646-8d00-a5012fb604db","resolution":{"observed_at":"2026-08-15T23:27:38.300789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.102054Z","title":"Layoutdm: Discrete diffusion model for controllable layout generation","venue":null,"work_id":"ea8d0f90-701e-4ac9-8763-aa9cc3859c7c","year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.305540Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:57d7e34fedc4bd5375df33a49a6596d3550a543bf0ea907e1a8779c8adaa465a","observation_id":"7b2cf666-4e64-4cb6-bb28-ea9c5d109dea","resolution":{"observed_at":"2026-08-15T23:27:39.107132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.086743Z","title":"Layoutformer++: Con- ditional graphic layout generation via constraint serializa- tion and decoding space restriction","venue":null,"work_id":"72260464-7d36-4750-ac85-1cb034f641f4","year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.309992Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:c6f6834ae26942bdc6dad9265321f2a4724435363900121b29076b900da4602a","observation_id":"6254e84b-9faf-43fe-aec9-fc57534d5ef6","resolution":{"observed_at":"2026-08-15T23:27:39.091815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.072331Z","title":"Layoutvae: Stochastic scene layout generation from a description set","venue":null,"work_id":"447de59f-e058-46ce-8088-76c7e3f37d55","year":2019},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.314738Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:c8b9c78507dcfd08e0b74f8680eaca524da8e4cc0c963db44c24a3360747ebcf","observation_id":"99a83cbd-cf54-46bd-a5ea-ab56a6ed6bf9","resolution":{"observed_at":"2026-08-15T23:27:39.076809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.319783Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.319783Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:2e1dc9bc3cec1f9729f14a09f54535aec434fc3de20491df431eed456c2061ad","observation_id":"87c963f0-3ea1-433b-8a61-b871b0878a6f","resolution":{"observed_at":"2026-08-15T23:27:38.319783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.047879Z","title":"Blt: Bidirectional layout transformer for controllable layout generation","venue":null,"work_id":"1eacc5bd-0d28-4a60-a42a-7ac60fad584d","year":null},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.324864Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:a3b8ff910755738983d3906ba21e5cad54eea80da2f859f8fc2865e27819c579","observation_id":"cf962fdd-7ca0-40f2-8988-28cc530fabfd","resolution":{"observed_at":"2026-08-15T23:27:39.052643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.06767","last_updated":"2019-01-21T02:14:14Z","snapshot_observed_at":"2026-08-14T17:28:23.981389Z","submitted_at":"2019-01-21T02:14:14Z","title":"LayoutGAN: Generating Graphic Layouts with Wireframe Discriminators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.06767","snapshot_observed_at":"2026-08-15T23:27:38.329576Z","title":"Layoutgan: Generating graphic layouts with wireframe discriminators","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.329576Z"},"links":{"cited_paper":"/paper/1901.06767","citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:865b482c32318ff57dd0ac7257c754b165dc373ac53aac0af5b1dd42d1086079","observation_id":"39a5645f-caf5-4157-97dc-eb20f6198c10","resolution":{"observed_at":"2026-08-15T23:27:38.329576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.032696Z","title":"Gligen: Open-set grounded text-to-image generation, 2023","venue":null,"work_id":"6e46839a-3941-46e4-b4a5-3181110763e6","year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.334259Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:03e3f4a8fd83eb4fd156f88ae81ffe3a41ef68022744eb20e8be7bbd4c48e3b7","observation_id":"86711fb7-c079-42bb-8b58-e4a876177631","resolution":{"observed_at":"2026-08-15T23:27:39.037712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13655","last_updated":"2024-03-04T18:43:49Z","snapshot_observed_at":"2026-08-16T15:30:49.729694Z","submitted_at":"2023-05-23T03:59:06Z","title":"LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13655","snapshot_observed_at":"2026-08-15T23:27:38.338762Z","title":"Llm- grounded diffusion: Enhancing prompt understanding of text-to-image diffusion models with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.338762Z"},"links":{"cited_paper":"/paper/2305.13655","citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:c348ba3a2fd0fc7e943db67658748b908b32d151d590a6531869ca58f2571daf","observation_id":"3d184ad4-73be-4520-97db-52a2d9d91c9a","resolution":{"observed_at":"2026-08-15T23:27:38.338762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.343491Z","title":"Lawrence Zitnick, and Piotr Doll ´ar","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.343491Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:515efc019ebeeca744dcd8c76eae53efafcc4be2a3fa8f445e915eef0dad5f8d","observation_id":"b51936e1-3142-426f-96ed-1dec26c1a4a9","resolution":{"observed_at":"2026-08-15T23:27:38.343491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-15T23:27:38.347707Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.347707Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:a95eb34b4f2ad182de908d400e71c3f4dbedbf215c7762d9aba3cc2fe4dec776","observation_id":"c33c1017-5e2d-4d1b-b778-184a3636e032","resolution":{"observed_at":"2026-08-15T23:27:38.347707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:39.006842Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models, 2022","venue":null,"work_id":"91b26700-be4a-42cf-9591-7c1f445cea87","year":2022},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.352766Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:060fd5275362885ea773ae0e1d3fd4e91900bc2fddd500855b0e823fc6c08887","observation_id":"c568586f-4e03-4164-a19c-636f61a5f14a","resolution":{"observed_at":"2026-08-15T23:27:39.011940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.357698Z","title":"Dit-3d: Exploring plain diffusion transformers for 3d shape generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.357698Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:001c00356c0e9500e376ec4831af2649de69bd4a24b53a04ce0198c6e8419a5a","observation_id":"011bbae8-45ff-4fd6-825e-6de4ecc1cbd4","resolution":{"observed_at":"2026-08-15T23:27:38.357698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.981482Z","title":"Hall, Daniel Cer, and Yinfei Yang","venue":null,"work_id":"7ebc005f-f875-4a64-af52-4d5b8f9dedac","year":2021},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.362362Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:e9bd0e1e908151bc22b738a24cb10f34496049f84aace21228da0b8de8b9f611","observation_id":"e1f24a40-68fe-47ae-a623-2dc4a2fea878","resolution":{"observed_at":"2026-08-15T23:27:38.986131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-15T23:27:38.367139Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.367139Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:89ad3d73a54cd01ac25c2aadeee1d9135e9412a9f07a4effb95cbe25ece316b0","observation_id":"62f398a6-d6af-48bc-9b02-d5c568038c3f","resolution":{"observed_at":"2026-08-15T23:27:38.367139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.372030Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.372030Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:340a441f6f71f5135e3e505a4935701a6ce83b8256930cc6cfddcaad9b9c76be","observation_id":"ca741df8-eb04-4b3c-885a-89f00b78a9de","resolution":{"observed_at":"2026-08-15T23:27:38.372030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.377008Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.377008Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:74a8c8dcded973af59b57b4bcc1feca668f11c0c82c392ad7c59754f163963db","observation_id":"f28995c5-02ff-467f-ac7c-3c258c4827ed","resolution":{"observed_at":"2026-08-15T23:27:38.377008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.381606Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.381606Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:e1e29d6aa9a30241f86a62a5c09e6fb8b4a02520b62d91b057f873bde726fb7a","observation_id":"9f43a72e-7153-4a1a-968e-2bc912f4ef52","resolution":{"observed_at":"2026-08-15T23:27:38.381606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.936753Z","title":"Kosmos-2: Grounding multimodal large language models to the world, 2023","venue":null,"work_id":"35d6320f-3d5a-4149-9ebb-87318d65cf95","year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.387702Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:2ea11597fd5f19098322e108eac1362b1cc8cb39f82f687020eb0d54490f3296","observation_id":"d14ce3cc-974d-4034-9eda-e58d026a0b2b","resolution":{"observed_at":"2026-08-15T23:27:38.941736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.392691Z","title":"Film: Visual reasoning with a general conditioning layer, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.392691Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:3181a4d0672c9e4154ad773ca069b8e2dba7403e39e04c6ead68c974c3063603","observation_id":"987167ec-b7f2-4967-9345-d9e9278b1705","resolution":{"observed_at":"2026-08-15T23:27:38.392691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.396970Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.396970Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:47edf39093f27e264efab010548be2b3782e410e5303bdcdc5321acbf0736560","observation_id":"0eeffd79-51d9-4ade-8cba-d6c9685f0d6b","resolution":{"observed_at":"2026-08-15T23:27:38.396970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.902103Z","title":null,"venue":null,"work_id":"69cc6570-0353-4d87-8c1c-d32258572c78","year":2020},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.401491Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:4627543a7d9f922ac52ae72d8b03448cb9db7a736c4b94daf60fe7ce72696ac9","observation_id":"30107227-0150-47a6-9621-f654c44b7861","resolution":{"observed_at":"2026-08-15T23:27:38.907078Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.406157Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.406157Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:341c0202cdfb4de541814ccbb2efc5ad23d5808d1fb2ef3fda7ccf635c9d6b48","observation_id":"e2bf764d-0a03-4618-b7f7-a27f33812f68","resolution":{"observed_at":"2026-08-15T23:27:38.406157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.410611Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.410611Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:80305db19b4bdc35413b2063b2cb6e0834fca2270484029ec357b292c752b2f7","observation_id":"3f49e8b3-315f-40f4-ac82-1e5ea86e9325","resolution":{"observed_at":"2026-08-15T23:27:38.410611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.867427Z","title":"Instancediffusion: Instance- level control for image generation","venue":null,"work_id":"3aa4aabb-2328-4815-b697-0bbb1e21fde1","year":2024},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.415294Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:510ff3cca2a1d1cdbca29ba2f55c8b75e7cab07ca0ce848aa05af2cee9af09b0","observation_id":"befaa72b-17e0-4b16-b82d-6d5ba50b13f4","resolution":{"observed_at":"2026-08-15T23:27:38.872034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.419958Z","title":"Instancediffusion: Instance-level control for image generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.419958Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:264f2959ff496309959aa4cce227c023df06a210e166e57a3479954e7278a4b2","observation_id":"3ba31165-87af-4e78-bdaf-e4291fdac01f","resolution":{"observed_at":"2026-08-15T23:27:38.419958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.842334Z","title":"Dolfin: Diffusion layout transformers without autoencoder","venue":null,"work_id":"34cea784-d375-41c3-8430-a0af1e5b3926","year":2024},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.424443Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:e156bd0722feab20c31fadd3f3c774a99773ccce3e539c368bd840e71e72515f","observation_id":"193bd8e5-991c-4991-8756-f86a6d9336f5","resolution":{"observed_at":"2026-08-15T23:27:38.846990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.826615Z","title":"Boxdiff: Text-to-image synthesis with training-free box-constrained diffusion","venue":null,"work_id":"50610a60-f9af-4216-a837-c4cfc30f50e0","year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.429367Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:239c151055df37d4fb97a06a7b3825f5340acb11fb8b2542a398045f6eb08a23","observation_id":"d1135d29-28ce-4ac6-97ef-1da844ca2e79","resolution":{"observed_at":"2026-08-15T23:27:38.831495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.811436Z","title":"Bayesian diffusion models for 3d shape reconstruction","venue":null,"work_id":"0c14f015-8191-44f1-a3ab-d0cfdb7453ef","year":2024},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.434048Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:4eb4dd8c0627b98f56d0edc3b8b586b3fc24700b1e6327cde71c8a09c58df8b3","observation_id":"08dc7cc5-18ab-4555-9ffb-37f2c2dbb920","resolution":{"observed_at":"2026-08-15T23:27:38.816276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.438757Z","title":"Raphael: Text-to-image generation via large mixture of diffusion paths","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.438757Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:7e806a0813fe6abebf3ec04b4428bc7a10d9dafe4e477cc565f204f7e490671d","observation_id":"6c14d652-b138-47c1-afb5-6005c71b14a8","resolution":{"observed_at":"2026-08-15T23:27:38.438757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.443423Z","title":"Reco: Region-controlled text-to-image genera- tion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.443423Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:6932173c6765f3df80bd7647102b8c5c9cca07f9069b6c8ad0a754bb52009ccf","observation_id":"c92ebf6b-7c71-43ca-9fc8-2bbb7809d745","resolution":{"observed_at":"2026-08-15T23:27:38.443423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.774513Z","title":"Layoutdiffusion: Improving graphic lay- out generation by discrete diffusion probabilistic models","venue":null,"work_id":"ca8a356e-f2b5-495f-bd2b-bd43db927373","year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.447914Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:2ccd9f7c744b798ced381f95db7771a46e54aaa1faf41d66f918a94ae6085af8","observation_id":"c49af53e-9070-489e-8196-ef4a2cdaabbb","resolution":{"observed_at":"2026-08-15T23:27:38.780435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:27:38.758878Z","title":"phrase1\": count1,","venue":null,"work_id":"5a262a5d-876a-45ce-b44f-a0bcd86382a1","year":2023},"citing_paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T23:27:38.452369Z"},"links":{"citing_paper":"/paper/2505.04718"},"observation_digest":"sha256:1a8e283faf7fecdae28e51474d265bf1935f6bdd6dc90ba75114efa710d123e8","observation_id":"2c261cf9-aad9-4ea7-b042-d19100ea16f7","resolution":{"observed_at":"2026-08-15T23:27:38.764360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.04718","last_updated":"2025-05-07T18:07:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T05:25:30.718008Z","submitted_at":"2025-05-07T18:07:57Z","title":"Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2505.04718."}