{"as_of":"2026-08-23T03:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa9797fd87f6c98c171bf360f718a2cfb777c3461a6f183113d3817c78b41ee2","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:39:33.114969Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.15563/citation-record","integrity":"/paper/2506.15563/integrity","json":"/paper/2506.15563/citation-record.json","paper":"/paper/2506.15563"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.587096Z","title":"Dreamstyler: Paint by style inversion with text-to-image diffusion models","venue":null,"work_id":"50544a80-0e53-4c21-9571-49c4f92b24b9","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.758922Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:192a38181cb4f38787f6ad40ade3b9d160ec90f11d0979e4ebe45e81093d5a35","observation_id":"9964cf79-1324-411e-88c9-09b2ce98d650","resolution":{"observed_at":"2026-08-15T19:39:34.595471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.566334Z","title":"Multidiffusion: Fusing diffusion paths for controlled image generation","venue":null,"work_id":"69c4ee22-462f-4fff-a899-f1ab40afae8c","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.764413Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:5c958addde33a36d2cf2d90789832f0690558b145846e748c8ee75054dd3214c","observation_id":"4599e3e6-5e86-4cf6-9e7d-4913b2dbdb40","resolution":{"observed_at":"2026-08-15T19:39:34.575065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.536013Z","title":null,"venue":null,"work_id":"887c9f52-6f2f-4943-b16b-484c1a58fb2e","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.769315Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:ed8de236f0b7eb3d3149b950e243d2663c723974cb2ec7bf1d92279d445683ec","observation_id":"39a28c7a-dcec-455b-b6e3-cbcf24a6dfbc","resolution":{"observed_at":"2026-08-15T19:39:34.547568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.517392Z","title":"Artadapter: Text-to-image style transfer using multi-level style encoder and explicit adaptation","venue":null,"work_id":"1f973474-a7e9-45cc-8bc0-ef50900d244a","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.774126Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:6dbc4f8fdc2904af9b7c93d217ddef5b6bc161c6ed6d3172b3b58695b9e22dc5","observation_id":"583bd8dc-48d7-4610-b87a-dcdf4558737f","resolution":{"observed_at":"2026-08-15T19:39:34.523856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.10495","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.268852Z","title":"Boundary attention constrained zero-shot layout-to-image generation","venue":null,"work_id":"45c5cbee-17ab-4eb7-b511-1fa124ee2bfe","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.778673Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:b0c493e692339ce37a22f1a07f684a31197a9315e97333a13187593476584cff","observation_id":"709064ba-ed8f-4040-a81b-1e9dce09491e","resolution":{"observed_at":"2026-08-15T19:39:33.281778Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.493993Z","title":"Pixart-alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":"93403cb8-33d1-4379-8659-9389e1245b49","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.784874Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:0f30b3deccdde61fd5599fa734fa18611e7c8acc96b98709569ebf3ce7fec324","observation_id":"c3b23d48-f0ea-4268-bb0e-30656c47b3ec","resolution":{"observed_at":"2026-08-15T19:39:34.504934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.471103Z","title":"Training-free layout control with cross-attention guidance","venue":null,"work_id":"8cc06016-e3a6-405a-bf6f-6300841b81d4","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.790046Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:9b52a91fa6dcf5e22feae91384a02fde9b0b752e1fdac9f99df76c243c32594b","observation_id":"dd7de1fb-91f8-457a-ad21-c97b69eb5f91","resolution":{"observed_at":"2026-08-15T19:39:34.477236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.450154Z","title":"Vp3d: Unleashing 2d visual prompt for text-to-3d generation","venue":null,"work_id":"e46066a6-2fb7-4d0e-807f-e4a7f4396296","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.796447Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:7a24e7d727ef662c7efcef2a3fb30214a5330cbd207095eed12571ae432ddd12","observation_id":"2ba8cb0c-a23e-4c76-8f13-00563b3e2bdc","resolution":{"observed_at":"2026-08-15T19:39:34.456850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.425189Z","title":"Zero-shot spatial layout conditioning for text-to-image diffusion models","venue":null,"work_id":"10a1e3cf-a832-40eb-9306-9508d6c15001","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.801465Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:30e8ed475d742dadc33002dbe02f33c49d2a60e4c7dfba6206352e65b32d34e7","observation_id":"a691c3f3-4a49-453a-b05c-99e610291666","resolution":{"observed_at":"2026-08-15T19:39:34.433390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.402625Z","title":"and Nichol, A","venue":null,"work_id":"84060625-7c83-4283-b33e-bd767d1aa2cb","year":2021},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.806910Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:887c36f60b7be4b93fd374ff906ca18cef7361290f27f486457016e87dc279a0","observation_id":"0da3a683-4da3-46ae-bfe7-ce4a3d796ec3","resolution":{"observed_at":"2026-08-15T19:39:34.409927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.377156Z","title":"J., Pouget-Abadie, J., Mirza, M., Xu, B., Warde-Farley, D., Ozair, S., Courville, A","venue":null,"work_id":"e34deae9-c9ac-4f6d-a4bd-18092f6a22f2","year":2014},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.812701Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:5138e882b2c89331e74ebae0a651abc507b9c8d0cde328d5db5eea115a5ec686","observation_id":"ba09fbb3-c620-46ab-9282-a238d37d2354","resolution":{"observed_at":"2026-08-15T19:39:34.388514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.352506Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"fc3814da-c9d5-4df3-9ef7-af5884ee2410","year":2020},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.817868Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:99370678660ff06eeeeedb24770a5d952ff67e568e6c98a8314ea78b86d0e6cb","observation_id":"742dc1df-8d03-4aef-89dd-fda53e3e0d2f","resolution":{"observed_at":"2026-08-15T19:39:34.360205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:32.824800Z","title":"J., Norouzi, M., and Salimans, T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.824800Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:0deda3db2f2263183c512c894da31972bdde6b85a323fa4404bc069d47eaa80d","observation_id":"0f13fe51-31fe-4f97-bb14-fe0a9f5fb8a2","resolution":{"observed_at":"2026-08-15T19:39:32.824800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.309940Z","title":"Ssmg: Spatial-semantic map guided diffusion model for free-form layout-to-image generation","venue":null,"work_id":"54d2fe0e-f81f-49f4-be3b-acf94e5d9933","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.830229Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:4b781caa19c43951c05308acfd2e30dbc96f98803d0cfed9385c880162978ba5","observation_id":"19de3453-4595-4711-b4af-5c7bd193dfd0","resolution":{"observed_at":"2026-08-15T19:39:34.318045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.293168Z","title":"C., and Liu, Z","venue":null,"work_id":"b2950248-61e5-47ce-973d-32879dd207e8","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.838535Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:42544d79e30b7dd649e31756ec5d6b2eb7d28374e868cb9fb51192a18db224c3","observation_id":"f2f6b5d2-5df9-494b-ba88-a1ed5968af42","resolution":{"observed_at":"2026-08-15T19:39:34.298042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.265206Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":"7f1da62f-63a4-45a8-94ab-37a4a2c651c0","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.843602Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:7d16c9743e9493366120e363377f5e1bb227b25954a455c9b6d926be1a99798c","observation_id":"d1a29da9-37ee-4fa6-9e10-4a512a557891","resolution":{"observed_at":"2026-08-15T19:39:34.273840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.246674Z","title":"Dense text-to-image generation with attention modulation","venue":null,"work_id":"1b5341b8-a854-487b-9ab1-5fe786092087","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.848829Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:3e32bb207044be3680c3ec40399f34da25617de8094ca37ab0c2b4e8f01f579c","observation_id":"6d0765c7-3246-47b1-8d88-5282f958155c","resolution":{"observed_at":"2026-08-15T19:39:34.252969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.225351Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":"677ee290-fd48-4d15-8273-08a066cdb2ac","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.853259Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:0f5dfa885df4d3ecc0b33a3bd988e7ac5da9554ad4085fe2bacd4574fb1f2586","observation_id":"8282940d-9fe9-4ad0-9746-841448a7928c","resolution":{"observed_at":"2026-08-15T19:39:34.230462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.203557Z","title":"W., Zhou, Y., Liu, D., Lee, J.-Y., Cai, H., Liu, B., Liu, F., and Uh, Y","venue":null,"work_id":"10562558-e4a3-4ceb-abbd-bce8c75f4f6d","year":2025},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.857931Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:4e168628b7e34c9eb63fccc4b2b2933c2d23ea2a323c051b4285f30189b43c26","observation_id":"9eea1795-8b9e-44b6-a7b8-3f97c5246401","resolution":{"observed_at":"2026-08-15T19:39:34.211206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.179030Z","title":"The role of imagenet classes in fr \\'e chet inception distance","venue":null,"work_id":"04f9f8d3-5bfb-4398-8a01-abe18c1ac60c","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.862467Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:600c4aa23cc0fdb4f980a05aeeb5381a2bee1432d6a6ec3ab4af2627f74a94bf","observation_id":"47da847f-4bbb-42b8-9a02-91e91b7f80d6","resolution":{"observed_at":"2026-08-15T19:39:34.184928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.156543Z","title":"Instant3d: Instant text-to-3d generation","venue":null,"work_id":"d4414adf-1f6c-4e42-90e5-ca05d7e558de","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.867028Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:3173088eb0f06845d56d00511b7c09b010b016b2b926b6bdd7c1fa12a5b806c5","observation_id":"0b1de4c6-08a0-4fbc-942f-64ec6cef9fa7","resolution":{"observed_at":"2026-08-15T19:39:34.161247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.135792Z","title":null,"venue":null,"work_id":"39082cdb-d58b-4299-93f6-c461f8dfb2d6","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.871302Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:94a4ba531f002c6ce52e76a6340ee66a323f69917433106a771a539d3346ba20","observation_id":"b6a7a721-b7ed-4a06-baa0-0e40d345f945","resolution":{"observed_at":"2026-08-15T19:39:34.144275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.106102Z","title":"Image synthesis from layout with locality-aware mask adaption","venue":null,"work_id":"21e78112-6d4b-48c6-9e71-b53e53efd6b7","year":2021},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.875415Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:18410dd9a6fc7035ff688a09a89e6f5dcc9e41b181762038360a5ad90378595e","observation_id":"f776caa9-6247-40b6-b73c-3a4e61184b9b","resolution":{"observed_at":"2026-08-15T19:39:34.115681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.071356Z","title":null,"venue":null,"work_id":"ca622d08-4e52-4059-aeef-c413f87c8ea7","year":2014},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.880067Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:9a1a7e3eb0b9a3f9052c25351fc6f349278e9f9139262cd7e5f76c636b4afeb2","observation_id":"09b92f7e-8082-49ed-bc82-1c3487f72c6e","resolution":{"observed_at":"2026-08-15T19:39:34.080273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.039322Z","title":"Training-free composite scene generation for layout-to-image synthesis","venue":null,"work_id":"122288f3-4c5e-4a4f-acb6-eb40036aa383","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.889072Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:7b8c5c3ceb71445ddc1c2526f42a9c7fd72ba41b8dc98f2b41d54956967d42b3","observation_id":"506ba1ac-3b0e-42ca-ba1f-4daff2098c99","resolution":{"observed_at":"2026-08-15T19:39:34.049123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:34.014940Z","title":"Hico: Hierarchical controllable diffusion model for layout-to-image generation","venue":null,"work_id":"3ce46f89-e1ba-45cc-9aac-6e9154ac415b","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.895304Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:d5fbe60cef51719847a00be4bd5b6c5c26cf69b826885e2c9d3dc9086fbaaf95","observation_id":"f356b745-0ea3-40ae-a3b1-a8cbe02dcf27","resolution":{"observed_at":"2026-08-15T19:39:34.025510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.992459Z","title":"Null-text inversion for editing real images using guided diffusion models","venue":null,"work_id":"aaaf54c0-7369-48cb-8f65-dc833c51b0e9","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.899921Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:5e29749ef14f3a4ce38e752548339d21dd7b9e368396126e79dc898349da7f8d","observation_id":"363bfdfa-3e93-4907-a185-15b0d70f7d3e","resolution":{"observed_at":"2026-08-15T19:39:34.000059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.01017","last_updated":"2022-07-08T12:00:51Z","snapshot_observed_at":"2026-08-17T08:29:38.851089Z","submitted_at":"2022-02-02T13:21:53Z","title":"Multi-Task Learning as a Bargaining Game","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.01017","snapshot_observed_at":"2026-08-15T19:39:32.905572Z","title":"Multi-task learning as a bargaining game","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.905572Z"},"links":{"cited_paper":"/paper/2202.01017","citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:fc997857ac9dcce9ff37014875335c1d2f837adc5eb9bfbb75bc24c532582939","observation_id":"8cd3df7d-aa35-4f24-bdaa-c5837a359043","resolution":{"observed_at":"2026-08-15T19:39:32.905572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.954234Z","title":"Zero-shot image-to-image translation","venue":null,"work_id":"a2551416-0e1a-46be-86e6-5a377138dd46","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.911525Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:6c3670ec49ad79bce0ebf91d57871bd8c823c11b54ee3043c9dfb2ddd2db926b","observation_id":"f452c7cc-bed6-4f1f-8265-ff86a379950f","resolution":{"observed_at":"2026-08-15T19:39:33.958726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:32.919553Z","title":"and Xie, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.919553Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:f85eb6bb49aa59b78c7901fbed1e31021d73751d73c52e946ff258bfbcb0b3b7","observation_id":"d08d67a9-aa44-44e0-bff8-62a158f043f7","resolution":{"observed_at":"2026-08-15T19:39:32.919553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.919327Z","title":"Grounded text-to-image synthesis with attention refocusing","venue":null,"work_id":"85a759d9-1bb1-4a29-88e1-888fcdddbe83","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.925459Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:d358cf21016a728cb5ea0acface080232bc98eee98df06c734d3f6f042fa57aa","observation_id":"2dd468d8-c2c7-49c1-81b8-f0e427795e3a","resolution":{"observed_at":"2026-08-15T19:39:33.927054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.892078Z","title":"A., Wang, L., Cervantes, C","venue":null,"work_id":"4d28db38-cff4-4c8e-9b06-6c8225788d8a","year":2015},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.931276Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:ffc2d3b6142955cee6657e244ffe83426f74a3a26f7c64cfdb45d5879f298e5b","observation_id":"ba6f1867-8db0-41d2-b909-816aa3cdba4d","resolution":{"observed_at":"2026-08-15T19:39:33.899579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-15T19:39:32.943305Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.943305Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:3c271646b7fe01fbc99151c4628d7dbf205707871e591870a830d4f83a8dc648","observation_id":"c205fd3e-f196-4ef5-8a97-26358e2ce691","resolution":{"observed_at":"2026-08-15T19:39:32.943305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.857431Z","title":"Hierarchical spatio-temporal decoupling for text-to-video generation","venue":null,"work_id":"70f322ac-d739-4f0a-9b71-14612316838b","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.950249Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:b2c0bc7785d5149467df56cef820f1840b8c1f78fa372e5be09bca12c280eb09","observation_id":"60bfd674-10e2-4fb3-b81f-158efe77b3ab","resolution":{"observed_at":"2026-08-15T19:39:33.872648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:32.956795Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.956795Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:1e3d974d1d09ba72e0b67d189f0dc244c657d91ba1dac0c91f79e6b51ee984d4","observation_id":"e39618b1-b766-429e-84d5-ce6ac49b52d1","resolution":{"observed_at":"2026-08-15T19:39:32.956795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:32.961678Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.961678Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:ba76cddbcd242e4b046ab16d65bb971ff51807242e8200822b4d10f38b9f17da","observation_id":"8157c530-605e-4caf-8d6e-c8c1efaabcaa","resolution":{"observed_at":"2026-08-15T19:39:32.961678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:32.966909Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.966909Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:eda27f169eb54e057197b6d66f23acb02bdce505e1f21aa07240e2a11ed41d5d","observation_id":"b4b32b84-0992-49ea-85f7-91cced8dd8d6","resolution":{"observed_at":"2026-08-15T19:39:32.966909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.780030Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"3238f51f-a35d-4e02-acb9-c05f42b15a98","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.971523Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:2c45e5873ed3b5d7729355b5d681ffb470a2dfab02f63f5802e2e481d815128a","observation_id":"4f887243-9669-4e31-aeac-0cd40e0da428","resolution":{"observed_at":"2026-08-15T19:39:33.787466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.761321Z","title":"L., Ghasemipour, K., Gontijo Lopes, R., Karagol Ayan, B., Salimans, T., et al","venue":null,"work_id":"7fc04b3b-f34f-4002-81bf-610765877c98","year":2022},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.976557Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:c0d7314b154b926f87ef58b6322a96a56aa7b8d946e14258cce2d780e79c37c2","observation_id":"0ce2bdee-b3ea-4a9f-82d2-d05e6e6009bb","resolution":{"observed_at":"2026-08-15T19:39:33.767525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.08402","last_updated":"2022-10-16T00:08:18Z","snapshot_observed_at":"2026-08-13T17:36:16.794649Z","submitted_at":"2022-10-16T00:08:18Z","title":"LAION-5B: An open large-scale dataset for training next generation image-text models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.08402","snapshot_observed_at":"2026-08-15T19:39:32.982045Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.982045Z"},"links":{"cited_paper":"/paper/2210.08402","citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:a2b066c05d3cf0033575aa01795d01bdad7546e45e3514799e7e134f3666b676","observation_id":"10d30582-dd04-47e4-ae55-d186736975db","resolution":{"observed_at":"2026-08-15T19:39:32.982045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.739861Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"e6681877-6798-471e-870e-1904ae791c1a","year":2022},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.987429Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:ae508150ebae657ecd7668829667c5f3aadc06f9c364f6f7b5ce590040d5e91e","observation_id":"3bfb80a7-55f7-42d6-91bc-ff7f3bd4ce54","resolution":{"observed_at":"2026-08-15T19:39:33.745037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.721535Z","title":null,"venue":null,"work_id":"6d03cf90-0aab-4a72-b4d3-5032df8bea0b","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.992787Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:002dfb428d5850892728fe1e7f96c3a53163311c254a2b81ca877b3d9aeb3e80","observation_id":"7ab556a0-960d-48ec-8586-dcfe7ad7d250","resolution":{"observed_at":"2026-08-15T19:39:33.727001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.686561Z","title":"High-fidelity guided image synthesis with latent diffusion models","venue":null,"work_id":"437da301-faab-400f-88bc-7a3368e8b9be","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:32.999536Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:84a2e62ce598af99a05536f5cb691806b29200f18338698e4dd8a07c706e5700","observation_id":"55928e86-8014-43fe-ae75-4e6d396e66d6","resolution":{"observed_at":"2026-08-15T19:39:33.694975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.660681Z","title":"Styledrop: Text-to-image synthesis of any style","venue":null,"work_id":"5f500954-fde5-4663-9832-e1e80b5ae7e0","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.005728Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:c5f0027533380a868737e36b12831b0c65ce55d3fcee87183b104ad3a060d0f6","observation_id":"55d0a7ff-f0aa-4b58-9028-cafc8be26cea","resolution":{"observed_at":"2026-08-15T19:39:33.670575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.010133Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.010133Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:1f8a0c9d59176531303a743697974d9424b66d0b1eb306c84ef325a2e7ff9f5b","observation_id":"8b390fff-bb87-421a-9df5-e37a25c078ae","resolution":{"observed_at":"2026-08-15T19:39:33.010133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.016572Z","title":"and Ermon, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.016572Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:d46a09e243b0837c1ad6860b2a892fea40b4af2d9ff3cd18f56bec9a9c186ae6","observation_id":"e8a1b145-0a96-4900-810a-ec7f06e4de46","resolution":{"observed_at":"2026-08-15T19:39:33.016572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.021573Z","title":"P., Kumar, A., Ermon, S., and Poole, B","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.021573Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:e60f51fc4c3f4d230beee31b975a43b898ef9de71eda9cc1517f801ef74c78c7","observation_id":"7a82103d-cb35-4cb7-ae6b-bea554cbd578","resolution":{"observed_at":"2026-08-15T19:39:33.021573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.595687Z","title":"Z., and Poggi, M","venue":null,"work_id":"bff67c56-dbab-452d-8b71-4ba1f62d7315","year":2025},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.026679Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:bb15f938ac6902ed8d1f05259e61da919ee009d7b0d28c8955e464b07fd7ad0d","observation_id":"d43fa42f-f361-4661-8334-5552b07ef95e","resolution":{"observed_at":"2026-08-15T19:39:33.600871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.579173Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"e5a0ad85-fcf7-47f1-816e-8f32d1b31b75","year":1921},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.032813Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:0c8f453f221bb8c15a4409967f7fffbc26942bd4fc31de8c611a1ab3792b32b2","observation_id":"2d198d4c-5446-4bfb-b4bf-b36476e2e859","resolution":{"observed_at":"2026-08-15T19:39:33.584668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.560663Z","title":null,"venue":null,"work_id":"0bf29af2-44b9-4a2e-8b57-eea7a492a378","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.036882Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:a92e2b87f3cd20e111a582aaa156f6dedf6661345781e9598ecbc9846d336da5","observation_id":"dcd19ba3-2c48-4bd4-8ad8-3875aa318116","resolution":{"observed_at":"2026-08-15T19:39:33.567308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.543306Z","title":"S., Girdhar, R., and Misra, I","venue":null,"work_id":"c44c02ba-1763-4141-8148-bb417c5718ac","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.042630Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:d885c85f8cf135c43c037ce4c8a2ac2ad49f720f3ff3a2ccbd8cf7fa47d1b75d","observation_id":"5ab45eec-f0d4-4b2a-92db-08729bf4ee3e","resolution":{"observed_at":"2026-08-15T19:39:33.548715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.516873Z","title":"Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score distillation","venue":null,"work_id":"f29fb836-2acd-4f3c-afcc-316babb56a89","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.048053Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:4272316ad079d11731bdc2ea213041cb86eeef4e563db533e0a5ccedcaac0dc3","observation_id":"0ab26e7d-c41b-468a-9679-4fd34a0c7670","resolution":{"observed_at":"2026-08-15T19:39:33.521946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.496902Z","title":"Z., Ge, Y., Wang, X., Lei, S","venue":null,"work_id":"bf1d5b35-fbc2-4696-be94-b177db7d5004","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.053717Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:5e25a231d733d2fd16dd47fa44765c18b41ce6baf4839fd427b7632283916e5c","observation_id":"5757c3e6-7608-4f68-8e3a-c2dd8bc05091","resolution":{"observed_at":"2026-08-15T19:39:33.503173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08240","last_updated":"2024-11-06T13:03:20Z","snapshot_observed_at":"2026-08-16T13:19:03.280787Z","submitted_at":"2024-09-12T17:39:23Z","title":"IFAdapter: Instance Feature Control for Grounded Text-to-Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08240","snapshot_observed_at":"2026-08-15T19:39:33.057727Z","title":"Ifadapter: Instance feature control for grounded text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.057727Z"},"links":{"cited_paper":"/paper/2409.08240","citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:b443c6fb20af328edd261bb3fddeca977f2ef570fb51c825d15591dc3af5c14f","observation_id":"cd394c21-902f-4ad4-a3ec-a53980f3cd6a","resolution":{"observed_at":"2026-08-15T19:39:33.057727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.467566Z","title":"R&b: Region and boundary aware zero-shot grounded text-to-image generation","venue":null,"work_id":"9d5c2adc-b77b-46ed-ad05-5cb2b78cca42","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.063722Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:04b74a3dac4908f5a59ace0d465d8fd1d85dfd54a327cc39c874df2370461bd8","observation_id":"3c992d49-261c-4f31-929e-525c3ce3b79b","resolution":{"observed_at":"2026-08-15T19:39:33.477217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.447673Z","title":null,"venue":null,"work_id":"51f917af-e8dd-419a-8c8c-7571e18e64a9","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.071425Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:1a8e63f86c58877b2c78c35f3db72e84a3882afb106e20f505cd03ce05e8d4bf","observation_id":"81872ef9-8658-4f69-bbef-84e6d2891668","resolution":{"observed_at":"2026-08-15T19:39:33.453791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.431095Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":"fd1253b7-9e79-4683-acc7-9a087eac9aaf","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.078541Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:92c62ced1bb83fca9a2acb941da1236fd837132ad5ef65f43f1c9d27645c8a82","observation_id":"74bb8536-e27a-442f-aeb0-a80abb8d13a1","resolution":{"observed_at":"2026-08-15T19:39:33.437589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.406621Z","title":"Inversion-free image editing with language-guided diffusion models","venue":null,"work_id":"8d742ca6-74b3-4b8b-aad5-d9a625ecd036","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.084248Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:3cc6bb092ac13906ef94f3cc406bb2a2a940655081677b9797f1bc59c98b4a22","observation_id":"fb12e919-e639-491a-b341-6d4522128fe6","resolution":{"observed_at":"2026-08-15T19:39:33.413121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.389303Z","title":"Freestyle layout-to-image synthesis","venue":null,"work_id":"2f7d3f2e-66fb-42a0-969f-290bd8d40565","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.089038Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:8639274fd79d387d05e6602dc5ebfebaac3fa89ab96b8a7b8a0d8f0b665dd13d","observation_id":"fbdfc0e2-b3eb-4b04-b5d4-8ded009edbc8","resolution":{"observed_at":"2026-08-15T19:39:33.394558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.366613Z","title":"Reco: Region-controlled text-to-image generation","venue":null,"work_id":"087d673e-26d1-45ed-90f3-403d3c46cdc9","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.094550Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:9b4f5bf97137284ca76f24566ac87f772587f59cf46f697d2add09fbf3a8f790","observation_id":"cdaa147f-3269-4b1c-843f-acb4f41395c3","resolution":{"observed_at":"2026-08-15T19:39:33.374615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.348519Z","title":"Towards consistent video editing with text-to-image diffusion models","venue":null,"work_id":"8f089ed8-e88b-4385-a251-6dc38c9c6462","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.101265Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:0652fed70082585af6b20d27f0c8f084286b702099a7df8e73dd9c0ed8ae7259","observation_id":"81279142-8d1f-4fb8-ab91-994fbe7aa14f","resolution":{"observed_at":"2026-08-15T19:39:33.354759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.331146Z","title":"Layoutdiffusion: Controllable diffusion model for layout-to-image generation","venue":null,"work_id":"a64ea8ed-a158-4569-9e3f-b9b390cd9e4d","year":2023},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.105923Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:3fd9acf6584afd5dc878c1c5f6c564bdaa4c7a39dac3180fc1a75809b2a5a8bb","observation_id":"4d8e3ad9-f770-4178-baa3-77be846a3405","resolution":{"observed_at":"2026-08-15T19:39:33.337710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.314759Z","title":"Migc: Multi-instance generation controller for text-to-image synthesis","venue":null,"work_id":"38c51d36-80ee-4f94-a505-377a499f8b4b","year":2024},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.110963Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:f542b2588f808e14ce458b9f45a52658a2044d9e86f41fd6cb2b17f81c652d1a","observation_id":"d6cc944e-2f0b-4a17-81f2-832cd5acafcf","resolution":{"observed_at":"2026-08-15T19:39:33.319198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:39:33.114969Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T19:39:33.114969Z"},"links":{"citing_paper":"/paper/2506.15563"},"observation_digest":"sha256:6c1126127920db00f329aaff19064817a6314625844b173575b202db0c1234c3","observation_id":"161595ce-bc65-49c8-bc7e-8f81cec4b469","resolution":{"observed_at":"2026-08-15T19:39:33.114969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.15563","last_updated":"2025-06-18T15:39:02Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T19:01:29.275839Z","submitted_at":"2025-06-18T15:39:02Z","title":"Control and Realism: Best of Both Worlds in Layout-to-Image without Training"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":44},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 0 inbound Pith citation observations for arXiv:2506.15563."}