{"as_of":"2026-08-20T08:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:90688005f665985f70da133a71aa03719f57b983bb0cfc16d5bc5b306f5455d1","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:31:50.942053Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.01079/citation-record","integrity":"/paper/2505.01079/integrity","json":"/paper/2505.01079/citation-record.json","paper":"/paper/2505.01079"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:52.001333Z","title":"Adobe Photoshop","venue":null,"work_id":"0b349512-41d7-4796-8e23-fc0891e75e67","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.630217Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:d6c02fd31e90719c3189b83e2a487f072d8a1856d25a751f73613e0faa58b4d5","observation_id":"6d153399-c596-4b9b-8ac3-193903332771","resolution":{"observed_at":"2026-08-16T04:31:52.007202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:50.636230Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.636230Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:42236b37ea9a1812046c8bc201601d84d6b7e62b8a15376e3fd157b786ebb1e2","observation_id":"f59bc5a7-878a-4245-ae3c-ff8dccdc47a3","resolution":{"observed_at":"2026-08-16T04:31:50.636230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.972362Z","title":"Blended latent diffusion","venue":null,"work_id":"baac2a22-ac13-4903-b0e2-50522fb943ff","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.641763Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:7e530214709de6b4be9a455f66f52222970a7a34ae6eca3c325956e7dae56e15","observation_id":"031d52b9-7868-4324-91fe-92228f1bf5cc","resolution":{"observed_at":"2026-08-16T04:31:51.977739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.954842Z","title":"Hrs-bench: Holistic, reliable and scalable benchmark for text-to-image models","venue":null,"work_id":"b3a7c90d-f22f-4757-9ad9-c4c0ebcfbce2","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.647380Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:973908ad89d6f4c3abfc8744f61b312a36e1c284983fa581bab5d7fbd45f68ad","observation_id":"6bea7b03-d627-4726-9ef5-9af2ba987d75","resolution":{"observed_at":"2026-08-16T04:31:51.960365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.937524Z","title":"Filling-in by joint in- terpolation of vector fields and gray levels","venue":null,"work_id":"c1a0214a-a50a-4507-aa23-14ce7b9fcb0c","year":2001},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.652872Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:f1768ced133f5883fc8cd51808cb3cb129e3a427333d75a17138a8918be65437","observation_id":"21715562-7c5c-4d85-a458-ed35a4f004c3","resolution":{"observed_at":"2026-08-16T04:31:51.942799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:50.657920Z","title":"Meteor: An automatic metric for mt evaluation with improved correlation with hu- man judgments","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.657920Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:c2cf9fea3d5b8ed27d20b061ea18806be7e5fcacf78e7d699fdced2fd548ca1e","observation_id":"e6303b84-d3ba-4ac8-90cf-b22339a9a4e0","resolution":{"observed_at":"2026-08-16T04:31:50.657920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.907508Z","title":"Multidiffusion: Fusing diffusion paths for controlled image generation","venue":null,"work_id":"4a3fd663-11ec-4959-a0f1-575832b43737","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.663674Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:de1349059ec41bd6dacee5336a11247e60e5ac2e8141bfdf256f23610e61a357","observation_id":"82fc6228-c66c-4cc7-831b-2042f2b2831a","resolution":{"observed_at":"2026-08-16T04:31:51.912882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.888800Z","title":"Patchmatch: A randomized correspon- dence algorithm for structural image editing","venue":null,"work_id":"971b5eb1-e9ec-4f27-94e1-bc31dbbc160f","year":null},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.670160Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:337592ab1c4b1163d87acc01f7d0e40f36f0772b8c1e234b5885c1b17282dd0c","observation_id":"718b0e52-5764-431a-b00f-6adcc411e011","resolution":{"observed_at":"2026-08-16T04:31:51.894073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.870677Z","title":"Image inpainting","venue":null,"work_id":"030e31ee-23fc-45f3-85cd-86df59008b84","year":2000},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.675534Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:3a02398571bd0e6bf8c49e0e622955a0e6481b56b8380c8aa541438fc1302c8c","observation_id":"d1c592b2-f79b-4cd9-931a-23b0f691ed93","resolution":{"observed_at":"2026-08-16T04:31:51.876000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.852996Z","title":"Mitra, and Peter Wonka","venue":null,"work_id":"cc7af4fc-f02d-4428-ae52-5e96f6f4306f","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.681730Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:1b3e0d89598997129ec258a8feb8e474578a3c46bbd7ed1039af29f6f4216b75","observation_id":"2e51d042-7326-45e7-9314-ce6f3d7218fa","resolution":{"observed_at":"2026-08-16T04:31:51.858538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.834717Z","title":"Flux, 2023","venue":null,"work_id":"c0892651-035a-4ccc-a6b1-49c78e6b9103","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.686890Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:e0734a03b7ab6919e5136ba43cb461f4578d12a01816747bf680c6f376a21eeb","observation_id":"63bd475b-a886-4152-ba1a-530904cf9ba7","resolution":{"observed_at":"2026-08-16T04:31:51.840458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04692","last_updated":"2024-03-17T16:59:25Z","snapshot_observed_at":"2026-08-16T14:11:52.899972Z","submitted_at":"2024-03-07T17:41:37Z","title":"PixArt-\\Sigma: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04692","snapshot_observed_at":"2026-08-16T04:31:50.692087Z","title":"Pixart- σ: Weak-to-strong training of diffusion transformer for 4k text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.692087Z"},"links":{"cited_paper":"/paper/2403.04692","citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:ece560aa6afbd270ed84e36a2513642f59c0f30b9f5671dd1ede006c1912fba4","observation_id":"fbc42c5e-5bdd-4ab2-8237-95e8ab57dbb4","resolution":{"observed_at":"2026-08-16T04:31:50.692087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.815732Z","title":"Pixart-α: Fast training of dif- fusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":"7b974189-3236-4360-b275-1b5062331d60","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.697777Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:ae7530c6b06a8984c251e21e938b935f2283e30901b99403e5bfc3f88670d62c","observation_id":"007bbad4-0902-488f-ac08-8ba32f822bc7","resolution":{"observed_at":"2026-08-16T04:31:51.821468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:50.702833Z","title":"Training- free layout control with cross-attention guidance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.702833Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:07c0873a443febe7da9177f055d2ec09b403ce978fe531080a0337da1e8d9eee","observation_id":"4e288339-6a1f-43fd-9142-4be43cf17579","resolution":{"observed_at":"2026-08-16T04:31:50.702833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.782761Z","title":"Anyscene: Customized image synthesis with composited foreground","venue":null,"work_id":"f004fcdc-76d7-46ac-8d58-25fe31da565c","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.707590Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:223e89a0b7c12b38297f0c37ae3fe9f7b9a33edc7d18338ad5e368e60fa59446","observation_id":"d6d49575-1a15-4963-be3d-3615a0596816","resolution":{"observed_at":"2026-08-16T04:31:51.789352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.763850Z","title":"Improving text-guided object inpainting with semantic pre-inpainting","venue":null,"work_id":"00880560-2041-490e-bdc8-027a885c2a71","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.712763Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:410852154e251e9a8f85fe6a487ae895349ece547ef0e3d12a472983be3c779c","observation_id":"6cfd4946-3b72-41da-a58d-368743520b32","resolution":{"observed_at":"2026-08-16T04:31:51.769256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.746369Z","title":"Diagnostic benchmark and itera- tive inpainting for layout-guided image generation","venue":null,"work_id":"57a43461-9262-4408-a29d-24c18aabe86f","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.717959Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:1de6962fc66e8971b0b682cb1ceafc2760a33e29035e6fe81e6e9bcfae30cd6d","observation_id":"3532489f-6e42-437b-b88c-6381e705f869","resolution":{"observed_at":"2026-08-16T04:31:51.752161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.728700Z","title":"Re- gion filling and object removal by exemplar-based image in- painting","venue":null,"work_id":"2e6b78ef-e3b2-488b-8afe-1fed5700822c","year":2004},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.723379Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:67adbd373e4a73db4263f29249494ec719083a20f22bef58e05d6e04b1afde3e","observation_id":"5710b323-65f4-493d-9a0c-f12b928a1c98","resolution":{"observed_at":"2026-08-16T04:31:51.734079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.710203Z","title":"Build-a-scene: Interactive 3d layout control for diffusion-based image gen- eration","venue":null,"work_id":"ea88b4a8-e359-4b81-ac20-68d83c2679d1","year":2025},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.728726Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:0451c192775eb40c97edaf4dc605dc1c232930d2855372fa95cc926183453384","observation_id":"56443bae-4c2b-4ca8-952a-aaa26dc33f17","resolution":{"observed_at":"2026-08-16T04:31:51.715285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.691216Z","title":"Scaling rectified flow trans- formers for high-resolution image synthesis","venue":null,"work_id":"88b407d8-a5d7-4ba8-9fba-7e27dda06d2d","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.734107Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:3cac2284d65f58f21d174662690d36ddac0e33bdbd2a8e229aa5340a26035bb4","observation_id":"c386771d-b72d-4090-a35d-beae5c727956","resolution":{"observed_at":"2026-08-16T04:31:51.697808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:50.740554Z","title":"Layoutgpt: Compositional visual plan- ning and generation with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.740554Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:4bfb71537bf9247472e2d381a6bfbb217cd57a71305a7e9813815c270f4ede13","observation_id":"2cb2979d-703a-4130-8463-601c28d2047b","resolution":{"observed_at":"2026-08-16T04:31:50.740554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04007","last_updated":"2024-05-07T04:55:47Z","snapshot_observed_at":"2026-08-20T02:31:55.947510Z","submitted_at":"2024-05-07T04:55:47Z","title":"SEED-Data-Edit Technical Report: A Hybrid Dataset for Instructional Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04007","snapshot_observed_at":"2026-08-16T04:31:50.745691Z","title":"Seed-data-edit technical report: A hybrid dataset for instruc- tional image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.745691Z"},"links":{"cited_paper":"/paper/2405.04007","citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:0916bbe709393ec5c9430300299020054fe98314ddfaec69056eb365b4c63b1f","observation_id":"69912903-869a-4b38-8f77-07330c392179","resolution":{"observed_at":"2026-08-16T04:31:50.745691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.661941Z","title":"Check locate rectify: A training- free layout calibration system for text-to-image generation","venue":null,"work_id":"cf971af4-d77a-4b34-81b8-e0894840f672","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.751500Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:00a328670ab6eaaaeb9152815849897aae8afbd7a4160bbe5c09f1dffb883073","observation_id":"03df1fc5-a419-49fa-906a-4334ffcd2e31","resolution":{"observed_at":"2026-08-16T04:31:51.667222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:50.756342Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.756342Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:f3170483a524c462d13102301adb51deb28b8bc6b42d974d18b0f153df5c4956","observation_id":"38b1df53-6bb5-48ea-8677-17b5d21fe166","resolution":{"observed_at":"2026-08-16T04:31:50.756342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.627862Z","title":"Layerdiff: Exploring text-guided multi-layered composable image synthesis via layer-collaborative diffu- sion model","venue":null,"work_id":"6a518c91-3a92-4ce6-8816-94fa9245b02e","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.761106Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:3e6b5286d250e1da7de69bd8284dce8a387ecd93334cedf6a63f1a4d2b47138f","observation_id":"128243cc-ca59-44cc-a1f1-958a0fa3d5f5","resolution":{"observed_at":"2026-08-16T04:31:51.633768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.609046Z","title":"Compose and conquer: Diffusion-based 3d depth aware composable image synthe- sis","venue":null,"work_id":"347940ae-e4f9-4554-b8aa-15f7bba141de","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.766359Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:b80a2092395255634ecbb9c6483879b47eaadc17b72c22c5b22aeeba602ab92b","observation_id":"cb06180a-c7e9-477a-9667-3d755f753455","resolution":{"observed_at":"2026-08-16T04:31:51.615128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09055","last_updated":"2025-06-01T14:29:54Z","snapshot_observed_at":"2026-08-16T14:09:58.806891Z","submitted_at":"2024-03-14T02:51:01Z","title":"SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09055","snapshot_observed_at":"2026-08-16T04:31:50.771163Z","title":"StreamMultiDiffusion: real-time in- teractive generation with region-based semantic control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.771163Z"},"links":{"cited_paper":"/paper/2403.09055","citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:bbb860bccfee6e8dc6c81175b8e2edabe848c5d30768e2d7f4505f808fb336d9","observation_id":"21aa78f4-9b72-4477-8f71-f4dccad14886","resolution":{"observed_at":"2026-08-16T04:31:50.771163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.590713Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":"b545a55b-7d5f-4843-b0dc-e9a94ef555da","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.776890Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:241c15aa321fb55b9b7e8578e683d419ef41ed113a3ff0856e8e0b1be37d7be4","observation_id":"e516fd10-da4d-484a-b6c3-4bc58d9c2119","resolution":{"observed_at":"2026-08-16T04:31:51.596875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.573416Z","title":"Visual instruction tuning","venue":null,"work_id":"bc7b3b1d-74e5-4b34-b0c1-deb042dacf5d","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.781960Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:a56fad11fc39bcda52a9f41090c289dcb595a92ef93a66ab2acd4cc07d4e2927","observation_id":"f4747641-b0f1-4f03-9ac4-f05c54c7fc68","resolution":{"observed_at":"2026-08-16T04:31:51.578166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.556061Z","title":"Place: Adaptive layout-semantic fusion for semantic image synthesis","venue":null,"work_id":"7697f8ff-431f-4372-9a92-35a8d1b4ccd5","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.787053Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:055f2a871aeb4c1b0f72aa2dd1f20873eb3d323d47cf65153036855f79bad09b","observation_id":"1e7fabd4-ef3d-4039-9224-01e237f80726","resolution":{"observed_at":"2026-08-16T04:31:51.561667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.537179Z","title":"I2ebench: A comprehensive benchmark for instruction- based image editing","venue":null,"work_id":"c3bb46ea-1b6f-4f71-a44c-ac1dae4298d1","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.792324Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:df2540ad874027baad50b6448db3daf68cafc45f6818ded9aac14694336fdfaf","observation_id":"6d541889-5225-429e-ac6e-659d24e6c3b7","resolution":{"observed_at":"2026-08-16T04:31:51.542967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.518803Z","title":"Hd-painter: High-resolution and prompt-faithful text-guided image inpainting with diffusion models","venue":null,"work_id":"0bd242a5-9a60-4490-a9c8-69417efda44f","year":2025},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.798547Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:56931187999e288518fd6c53bd91bcb9443e04645c7e7b79d58620a0d5d7a882","observation_id":"4f8ecec7-73c3-4932-8a99-330f1d1f2529","resolution":{"observed_at":"2026-08-16T04:31:51.525009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.500462Z","title":"T2i- adapter: Learning adapters to dig out more controllable abil- ity for text-to-image diffusion models","venue":null,"work_id":"60a44a41-4d8a-4e09-869e-6016101abe1c","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.803502Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:0286aa0279feb721b572622a71c3c341f313d5c83be81e0304efb3be28e57e8d","observation_id":"af42611b-3ea2-4ed9-b767-33219e9bf77b","resolution":{"observed_at":"2026-08-16T04:31:51.506575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:50.808694Z","title":"Glide: Towards photorealistic image genera- tion and editing with text-guided diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.808694Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:53ac3bfbb6e0368e1d3b884fcfcfc0a3aa2ce73f5a9835c81aa242ac93af1741","observation_id":"39ebbfce-33ab-4c8c-adb7-457668d8bd4e","resolution":{"observed_at":"2026-08-16T04:31:50.808694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.469293Z","title":"Lazy diffusion transformer for interactive image editing","venue":null,"work_id":"d08bc062-a6f4-4739-a89c-f928115010eb","year":null},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.814546Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:bf4dfb8e2f096746e606597884bac3128de354582ff65bd8eb66d6dee7145cd9","observation_id":"aae578ba-e1bc-482c-84cd-48d81f03f24c","resolution":{"observed_at":"2026-08-16T04:31:51.475629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:50.821147Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.821147Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:0817f76668fb1edb440add84d5b7a99500f4df918cf8b98473b836a61c4e6937","observation_id":"37b8294e-d372-4149-af25-cb93f5e98775","resolution":{"observed_at":"2026-08-16T04:31:50.821147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.436992Z","title":"Pincel: Ai image editor, 2024","venue":null,"work_id":"af1e9cd2-926a-4148-9a5d-8c70b10a1d6b","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.826042Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:15d487c813ee2780167815f5b1b9f2f192d0c4739cc410eeefbd49e0a364bc51","observation_id":"79928172-923b-4209-9145-bc28b92b0d40","resolution":{"observed_at":"2026-08-16T04:31:51.443044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.417013Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"d026e3e8-1767-41e0-b0c9-19f43b008e1e","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.830912Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:32402a16e835868216b4d033a57d7b04f0625a327ac41a129918b461f23b52eb","observation_id":"0061d1d8-7f86-4e66-bc72-782ec39cc21a","resolution":{"observed_at":"2026-08-16T04:31:51.423170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.398505Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":"9c06f7ba-4745-442a-b258-ff9ed6f7b699","year":2025},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.835926Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:88e7785c2690d8a4d9b66c814c790dc99559c3ea2c4016673c386de4a1f5e674","observation_id":"91b1fb9a-89ff-4393-bc3d-7c47500f848c","resolution":{"observed_at":"2026-08-16T04:31:51.404260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.380930Z","title":"You only look once: Unified, real-time object de- tection","venue":null,"work_id":"0f7ae312-a74a-4ff6-b996-3e955da1874c","year":2016},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.841141Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:9b9dec69a0464c0de4f7e787807ec42eb61db4f16bee9ba0012b9f86ba74adce","observation_id":"97401e37-af89-4df4-9247-10164fffb0e6","resolution":{"observed_at":"2026-08-16T04:31:51.386338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.362240Z","title":"Move anything with layered scene diffusion","venue":null,"work_id":"8dbb8ab9-9b2c-49f7-8f52-c4dfd4363348","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.846093Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:7b0295ba05c197e5594abe7e2eeb156b7ed3dae6d699d47240e0cda7bd019956","observation_id":"f276b585-833b-4d88-b54d-e17d8f78fd51","resolution":{"observed_at":"2026-08-16T04:31:51.367781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:50.855483Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.855483Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:1c3345d38adf748b5a3795190a9b6ee1026b9ef60371f7564bcdfeb2a6af7d92","observation_id":"69fbbd6d-9cba-4c03-aee8-a85fd6475599","resolution":{"observed_at":"2026-08-16T04:31:50.855483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.334059Z","title":"Noisecollage: A layout-aware text-to-image diffusion model based on noise cropping and merging","venue":null,"work_id":"a1ae3628-790e-4a84-a198-dcece1dd36b9","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.860726Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:14e1323b57338e6bc033d822ef5866635e84c004aad2b1114d610f4da503665e","observation_id":"90191d69-c5ec-4908-8379-124de7540718","resolution":{"observed_at":"2026-08-16T04:31:51.339608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.316273Z","title":"A picture is worth more than 77 text tokens: Evaluating clip- style models on dense captions","venue":null,"work_id":"c3146b6a-fbaf-4b89-ae18-2643233cd609","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.866222Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:e28a44eeac311647e14c961d94b9a331bd306d01e97f900f2b0d7078d6ea5ef2","observation_id":"1e369df2-dec9-4fad-aec7-af286c383f15","resolution":{"observed_at":"2026-08-16T04:31:51.321780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.298801Z","title":"Fleet, Radu Soricut, Jason Baldridge, Mo- hammad Norouzi, Peter Anderson, and William Chan","venue":null,"work_id":"32ccc3ec-7d81-4291-a9cb-7e4a6ca53578","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.871478Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:a2a2f51a96c088ff949b0ac75b351e886a5d370293d70a367f0eeac647723daf","observation_id":"d2ab9c7a-ff5c-4c5f-86d1-289da9754aee","resolution":{"observed_at":"2026-08-16T04:31:51.304303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.281812Z","title":"Instancediffusion: Instance-level control for image generation","venue":null,"work_id":"22b0008f-b3cd-4cf1-a412-93d23041ff15","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.876837Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:21b2faaff867898e70e8290e1f810d83b5b4aff1bc2a3842043f8857f0f044b1","observation_id":"5883a0fc-8845-43de-b686-078be640d28f","resolution":{"observed_at":"2026-08-16T04:31:51.287122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.262134Z","title":"Boxdiff: Text-to-image synthesis with training-free box-constrained diffusion","venue":null,"work_id":"74f91658-d754-464c-8984-0c34f19c3af9","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.881950Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:d99aede0ed9d146df74c2b6ead728d1a6403bad1a4d37668270d14a3ed3e221a","observation_id":"72ecbddc-ad9a-4d81-8f56-b46fbbca483f","resolution":{"observed_at":"2026-08-16T04:31:51.268447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.244887Z","title":"Smartbrush: Text and shape guided object inpainting with diffusion model","venue":null,"work_id":"0914c711-7a54-4ecf-84a0-5f0aa607ef93","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.887035Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:e3bd522e1a1f0810c188593fd18421cc0cd97da039bcc17f7ea4cd4bb0df9dd6","observation_id":"7d340eb4-f4f6-406a-a3b9-ee8e03cb8685","resolution":{"observed_at":"2026-08-16T04:31:51.250152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.225345Z","title":"High-resolution image inpainting using multi- scale neural patch synthesis","venue":null,"work_id":"4937e5a0-be0b-48c4-8a98-b7d65115fd31","year":2017},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.892193Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:ced3a5d95386f3b9517a419efc1d10ff473de91f74362c9b125ae48c479a429e","observation_id":"37a40490-d314-42ea-a781-d378768dca50","resolution":{"observed_at":"2026-08-16T04:31:51.231324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.205099Z","title":"Contextual residual aggregation for ultra high-resolution image inpainting","venue":null,"work_id":"d9e76dc3-baff-4bc8-8086-80e94feb5d83","year":2020},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.897318Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:0013050307f41603d619c6a5430a6c5bbe43a3815c98a6f61b30cd52221c15b8","observation_id":"3528f164-5cc2-4149-ac98-a923cedc736e","resolution":{"observed_at":"2026-08-16T04:31:51.210768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.186803Z","title":"Free-form image inpainting with gated con- volution","venue":null,"work_id":"6fd7f36a-8b46-402f-aef8-c4f9aa2386ca","year":2019},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.902968Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:f2c723df210eb2cc295536a73f02305f370679c4b7ac753d6bcd3a8c592e7b03","observation_id":"c755b10b-9e58-4ed9-a01a-5f0deb0e51b4","resolution":{"observed_at":"2026-08-16T04:31:51.192568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.168347Z","title":"Long-clip: Unlocking the long-text capability of clip","venue":null,"work_id":"964fe102-8db0-4efa-bce0-bbddeda937b8","year":2024},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.908426Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:a1437e054c3cedb54d11046cb5dbae862c1ee50b906df328e0b0946893430b0c","observation_id":"9e3579b2-6588-4a70-9dce-d97fb5ca7ec2","resolution":{"observed_at":"2026-08-16T04:31:51.173993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.149309Z","title":"Text-guided neural image inpainting","venue":null,"work_id":"e4d86405-4ee6-4777-888b-a4256f2cbfb9","year":2020},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.914168Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:d19346464869534edbfa2391289b9765873d246a2d287786767c0eaf443fcb6b","observation_id":"b72806f8-9ba4-4ab4-a105-2b0b53a8f5fc","resolution":{"observed_at":"2026-08-16T04:31:51.155558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.128224Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"55afef6f-e0ea-48a0-b084-befbc6c69fb8","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.919871Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:3a8b1ebc940928df1da799321dce3d7b99d9d619ba15bc19be4c105341223b16","observation_id":"8116369b-c1c8-44c2-8431-84338cb2e097","resolution":{"observed_at":"2026-08-16T04:31:51.134677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09781","last_updated":"2023-07-19T06:56:07Z","snapshot_observed_at":"2026-08-18T20:02:53.955280Z","submitted_at":"2023-07-19T06:56:07Z","title":"Text2Layer: Layered Image Generation using Latent Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09781","snapshot_observed_at":"2026-08-16T04:31:50.925466Z","title":"Text2layer: Layered image generation using latent diffusion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.925466Z"},"links":{"cited_paper":"/paper/2307.09781","citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:bdeace61f61a6a28df957a05aa701e5794998983685bff395ea4703c0cc67e48","observation_id":"e475e5f4-6e5f-4a23-8213-8a322359f802","resolution":{"observed_at":"2026-08-16T04:31:50.925466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:50.931235Z","title":"Image generation from layout","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.931235Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:1fe05afa25dfba5f28f340a4c9845fa9f8ddca591769496fab83cdf73e294e2f","observation_id":"7d867dd9-2765-4e86-9f43-e8e235d0181b","resolution":{"observed_at":"2026-08-16T04:31:50.931235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.091675Z","title":"Uni-controlnet: All-in-one control to text-to-image diffusion models","venue":null,"work_id":"d882297b-8b77-4edb-941b-24ddde9f9629","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.936848Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:539a3ee2497847c28fe7871949a869d23c536f66817d14e1538551686dd52f4b","observation_id":"982c3adb-2af3-4358-8689-1546bf830dcf","resolution":{"observed_at":"2026-08-16T04:31:51.098967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:31:51.069015Z","title":"A knightriding a horse","venue":null,"work_id":"ea699761-14a5-4dfa-ba3a-edce2283c71f","year":2023},"citing_paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T04:31:50.942053Z"},"links":{"citing_paper":"/paper/2505.01079"},"observation_digest":"sha256:fcfae49772b716fd4a63c2cf48f935a022959fda7a53211df05f793bddf1f524","observation_id":"5ba136d2-d614-45b2-98a4-fcd9b82b210f","resolution":{"observed_at":"2026-08-16T04:31:51.077826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.01079","last_updated":"2025-05-02T07:36:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T20:03:48.655857Z","submitted_at":"2025-05-02T07:36:49Z","title":"Improving Editability in Image Generation with Layer-wise Memory"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":45},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2505.01079."}