{"as_of":"2026-08-07T11:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21ddb868b5145bf11c3b70d6de85492219d4f524da7b4bf988043383d434d912","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T15:24:49.983611Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2512.17151/citation-record","integrity":"/paper/2512.17151/integrity","json":"/paper/2512.17151/citation-record.json","paper":"/paper/2512.17151"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:42.787589Z","title":"Ames, Xiangru Xu, Jessy W","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:42.787589Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:8a33b03c852e333435b6a04c7edfa12c9c078e536836d628a62dfeec906e08f5","observation_id":"131deede-5ad4-4b78-86fa-85d4d683f9c6","resolution":{"observed_at":"2026-08-03T15:24:42.787589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:42.845339Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:42.845339Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:ead76786de57b0049c63dcfc78fe9e4a97c5ada63efa17a2177dd9095fab55aa","observation_id":"cdf072ed-86de-4181-b1c2-31c8b9ce3bb2","resolution":{"observed_at":"2026-08-03T15:24:42.845339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:42.952872Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:42.952872Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:39be9b3bbdc0796e3828ededfd0f8434c1df88b02c10c7c697a221fd898427cf","observation_id":"73998e9e-3c6f-40ab-aac6-b310a9b5456b","resolution":{"observed_at":"2026-08-03T15:24:42.952872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.029581Z","title":"Masactrl: Tuning-free mu- tual self-attention control for consistent image synthesis and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.029581Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:9179f2296b662b8a2164c4f0208840365c86b7d626dc6fabe3c561056bb18afb","observation_id":"f6959836-2bd3-40de-813a-a8e208a1c74d","resolution":{"observed_at":"2026-08-03T15:24:43.029581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.149785Z","title":"Attend-and-excite: Attention-based se- mantic guidance for text-to-image diffusion models.ACM transactions on Graphics (TOG), 42(4):1–10, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.149785Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:e0df59246ec8d76b1add4ca2a45e55497ecb2fd126474e5eaf7579d9567a252f","observation_id":"fe08e747-cc24-46bd-997a-61a285192ac2","resolution":{"observed_at":"2026-08-03T15:24:43.149785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.262491Z","title":"Posta: A go-to framework for customized artistic poster gen- eration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.262491Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:90e98a1b2c22bfb3434ef2e085584ad31560093579f3002b218865c4b3ea397e","observation_id":"c3d88c4b-2aad-48d4-a78b-37b5b2de9ef3","resolution":{"observed_at":"2026-08-03T15:24:43.262491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.340077Z","title":"Textdiffuser: Diffusion models as text painters.Advances in Neural Information Processing Sys- tems, 36:9353–9387, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.340077Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:142373b16f29175f3ffe6c46c3bb12194b5de0b460f278adf6bb1c04118a0c68","observation_id":"7a9f5aab-d860-40c1-b883-1aebb0dac432","resolution":{"observed_at":"2026-08-03T15:24:43.340077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.422304Z","title":"Textdiffuser-2: Unleashing the power of language models for text rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.422304Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:369c376ae9f33c5eacfd61e6b016f6908550f56fbd9642bb834a4604c67ccfd4","observation_id":"f90e2a39-27f0-4eb6-8126-5e5700d29d2c","resolution":{"observed_at":"2026-08-03T15:24:43.422304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.582392Z","title":"Training-free layout control with cross-attention guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.582392Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:e4752d359cd47d5ba4934eec05103ad17ce5c5c15201db9da233f87ad67f34dc","observation_id":"70e53204-fdc6-4c47-9cac-a53281040b30","resolution":{"observed_at":"2026-08-03T15:24:43.582392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11427","last_updated":"2022-10-20T17:16:37Z","snapshot_observed_at":"2026-08-01T15:07:11.635426Z","submitted_at":"2022-10-20T17:16:37Z","title":"DiffEdit: Diffusion-based semantic image editing with mask guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11427","snapshot_observed_at":"2026-08-03T15:24:43.681131Z","title":"Diffedit: Diffusion-based seman- tic image editing with mask guidance.arXiv preprint arXiv:2210.11427, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.681131Z"},"links":{"cited_paper":"/paper/2210.11427","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:9d3452dd1e5a8a831ebfe8b3760fb53f545de2a5fa4e370c2a57487b2397904a","observation_id":"c9225ee8-d207-4128-b868-c941bcffa928","resolution":{"observed_at":"2026-08-03T15:24:43.681131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03166","last_updated":"2021-07-07T11:49:14Z","snapshot_observed_at":"2026-08-07T05:59:02.438663Z","submitted_at":"2021-07-07T11:49:14Z","title":"FBC-GAN: Diverse and Flexible Image Synthesis via Foreground-Background Composition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03166","snapshot_observed_at":"2026-08-03T15:24:43.825588Z","title":"Fbc-gan: Diverse and flexible image synthesis via foreground-background composition.arXiv preprint arXiv:2107.03166, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.825588Z"},"links":{"cited_paper":"/paper/2107.03166","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:c56367a717b631395b36f9867d1b910218498634965d07e02cd2c6f65b77b8be","observation_id":"d7381d9c-d298-446c-84a0-ed953299c896","resolution":{"observed_at":"2026-08-03T15:24:43.825588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04460","last_updated":"2024-12-05T18:59:18Z","snapshot_observed_at":"2026-08-06T18:59:38.223405Z","submitted_at":"2024-12-05T18:59:18Z","title":"LayerFusion: Harmonized Multi-Layer Text-to-Image Generation with Generative Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04460","snapshot_observed_at":"2026-08-03T15:24:43.938435Z","title":"Layerfusion: Harmo- nized multi-layer text-to-image generation with generative priors.arXiv preprint arXiv:2412.04460, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.938435Z"},"links":{"cited_paper":"/paper/2412.04460","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:c78a23846a27d9fd1ff2467b98ef5a80617120710b25dc3546cfe2d36f837332","observation_id":"a4316021-2923-4946-b558-d4d0ee13d619","resolution":{"observed_at":"2026-08-03T15:24:43.938435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-03T15:24:44.046072Z","title":"Emerging properties in unified multimodal pretraining.arXiv preprint arXiv:2505.14683, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.046072Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:bfd108aa2748a707531f4ed20737a9d95e9bdf7260066bb6651bceefce715f29","observation_id":"c46352bc-d703-4f39-8d30-9010852dbc9c","resolution":{"observed_at":"2026-08-03T15:24:44.046072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.188172Z","title":"Salient object-aware background genera- tion using text-guided diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.188172Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:d5b69dc0fdbac073a4a160bcd6ee228af072883339fe84aa0a4d78ba33817ded","observation_id":"a744a7b2-0ef3-4b3c-a24e-e7086ffa7b3b","resolution":{"observed_at":"2026-08-03T15:24:44.188172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.306393Z","title":"A barrier function method for the optimization of trajectory functionals with constraints","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.306393Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:64179103f830654acfca19b4ebeb168e438db084aebafeaf0866549701459dd6","observation_id":"50a20055-8832-41f4-a306-48a854f8eae7","resolution":{"observed_at":"2026-08-03T15:24:44.306393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-03T15:24:44.312226Z","title":"Prompt-to-prompt im- age editing with cross attention control.arXiv preprint arXiv:2208.01626, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.312226Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:adf33c5098903bf3e912a45b84bea8502905e93ae08a4c16aaba8caaaa683ac5","observation_id":"067cb5cb-8930-4b5d-9689-af15f02caf94","resolution":{"observed_at":"2026-08-03T15:24:44.312226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-04T23:51:18.339338Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-08-03T15:24:44.338397Z","title":"Ella: Equip diffusion models with llm for enhanced semantic alignment.arXiv preprint arXiv:2403.05135, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.338397Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:a724d3368939e4e811b8c9bba38130d5668a4e6920646db3f8d169fe1251b8c7","observation_id":"5069d3de-37d7-4c7a-a3f3-b4d7b896070a","resolution":{"observed_at":"2026-08-03T15:24:44.338397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.426736Z","title":"Layerdiff: Exploring text-guided multi-layered composable image synthesis via layer-collaborative diffu- sion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.426736Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:4398a6907940dbba13b95b418f893804599a36fb770c5cfeacf62b77f0eeb8e9","observation_id":"9f5a110c-ec25-42f1-838d-2826168a5b34","resolution":{"observed_at":"2026-08-03T15:24:44.426736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.699689Z","title":"Diffusion model-based image editing: A survey.IEEE Transactions on Pattern Analysis and Machine Intelligence, 47(6):4409–4437, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.699689Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:e19cb337344d20ff571fefa696a1dc9ac0380d5c7d03f19c394d71ad82f56970","observation_id":"b5daab9b-44f6-4fd7-80e0-20f59a63360c","resolution":{"observed_at":"2026-08-03T15:24:44.699689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.833461Z","title":"Opencole: Towards reproducible automatic graphic design generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.833461Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:a164f85f9636687eb0f7ef4c164bbcf2ead85fa2da647895123762369a3b98ce","observation_id":"fe5ea067-0a62-4895-87d8-77c5cca46b33","resolution":{"observed_at":"2026-08-03T15:24:44.833461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.937499Z","title":"Brushnet: A plug-and-play image inpainting model with decomposed dual-branch diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.937499Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:a4c7e02ee9f9066b62595337485fc253e6816d9d736b8547d4f248df96cbf8b8","observation_id":"d51e02b7-1da3-4934-8953-3b1c2968e480","resolution":{"observed_at":"2026-08-03T15:24:44.937499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:45.088443Z","title":"Multiple gan inversion for exemplar-based image-to-image translation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.088443Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:40e23b60f6956a2e283a73b8ad3ee0373262fb0e9814c85fc88a3003e3153fb2","observation_id":"4b60eea5-8e17-4a10-92dc-6aa795f3c1c7","resolution":{"observed_at":"2026-08-03T15:24:45.088443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16819","last_updated":"2026-05-19T15:22:52Z","snapshot_observed_at":"2026-08-01T07:12:14.758494Z","submitted_at":"2025-05-22T15:54:42Z","title":"Character-Centered Dialogue Generation from Scene-Level Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16819","snapshot_observed_at":"2026-08-03T15:24:45.295351Z","title":"Action2dialogue: Generating character-centric narratives from scene-level prompts.arXiv preprint arXiv:2505.16819, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.295351Z"},"links":{"cited_paper":"/paper/2505.16819","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:49a5d5ce24e871ddf8ad9449176bcdbba007e7d9700315ff31b01c16d5e68f08","observation_id":"8fc33ea0-2946-47ab-8c23-e2955c88ec14","resolution":{"observed_at":"2026-08-03T15:24:45.295351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:45.457749Z","title":"Automatic determination of text readability over textured backgrounds for augmented reality systems","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.457749Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:efa187b17ed317cb4a4f87436ab5886d4def0568e5e091a3b7e8d3a5ee734838","observation_id":"3f862fac-06ee-4f1b-8989-a371f1377766","resolution":{"observed_at":"2026-08-03T15:24:45.457749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:45.620025Z","title":"Relation-aware diffusion model for controllable poster layout generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.620025Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:c2627b13350e76b251b6ac2aaabcde91906ab37321bbdde298240cdaedbe9c70","observation_id":"35cecc87-e44f-4c06-b9ab-090dcb87b493","resolution":{"observed_at":"2026-08-03T15:24:45.620025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:45.772310Z","title":"Layerdiffusion: Layered controlled image editing with dif- fusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.772310Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:a229fc445e654def9bd0cf24df118767c1c567bf6776cf24d025ee3bfdc32054","observation_id":"5cc7ea7b-fbc0-4309-9f88-ee4b00d9a419","resolution":{"observed_at":"2026-08-03T15:24:45.772310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:45.893166Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.893166Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:7c71d93806561036535ceec71021ffd4657a4dd6ccf22a270101237e9286986b","observation_id":"da7cb8a7-56f8-45c6-b8e5-c19597551d71","resolution":{"observed_at":"2026-08-03T15:24:45.893166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08822","last_updated":"2024-09-03T07:42:44Z","snapshot_observed_at":"2026-08-05T13:30:57.339252Z","submitted_at":"2023-12-14T11:11:50Z","title":"Planning and Rendering: Towards Product Poster Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08822","snapshot_observed_at":"2026-08-03T15:24:46.040629Z","title":"Planning and rendering: Towards prod- uct poster generation with diffusion models.arXiv preprint arXiv:2312.08822, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:46.040629Z"},"links":{"cited_paper":"/paper/2312.08822","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:ead87b19ee53b08c6c1ae1e99e7baaf2e06209a62852fa8c0aa1b136a453c1a7","observation_id":"56330e0a-39bb-4243-a496-017f1a5f18b4","resolution":{"observed_at":"2026-08-03T15:24:46.040629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:46.185236Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:46.185236Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:ea6589dad73927145ea642a165abca503cf807090796f4b5dc9d0cb5bfe21918","observation_id":"a3b5509d-c132-4562-aac4-c0fee1140a05","resolution":{"observed_at":"2026-08-03T15:24:46.185236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:46.415149Z","title":"Layoutllm: Layout instruction tuning with large language models for document understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:46.415149Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:736cb9cfb2693779989159a1ce1dfc19734c7131cef9aceb40d45a1c7264d1b0","observation_id":"87342198-2089-41dd-b807-6814a939f035","resolution":{"observed_at":"2026-08-03T15:24:46.415149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:46.639212Z","title":"Hico: Hierarchical controllable diffu- sion model for layout-to-image generation.Advances in Neu- ral Information Processing Systems, 37:128886–128910,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:46.639212Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:02b84f58a91b664bb0865bbf75ad5e98fefed78b9f1ffc73c7cc28548a33dda2","observation_id":"a9bd597b-8b42-4a52-b962-e6c713375585","resolution":{"observed_at":"2026-08-03T15:24:46.639212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:46.867225Z","title":"Sawna: Space-aware text to image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:46.867225Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:5e5a960721deb67f74487b344a0df78283bc4b65ab454ca9d602c6102c7b1db4","observation_id":"747d2cd4-449d-46f5-9cb7-95416d7ad018","resolution":{"observed_at":"2026-08-03T15:24:46.867225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:47.008397Z","title":"Gpt-4o: Openai’s most advanced generative text and vision model.https://openai.com/index/ hello-gpt-4o/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.008397Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:494ba54dac49653bdbd577a2705076ffed5358713bd13fcf28346d8a4e4bc143","observation_id":"54dc6382-e3cd-4704-9abb-1244bb49d95c","resolution":{"observed_at":"2026-08-03T15:24:47.008397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:47.241872Z","title":"Introducing gpt-5.https://openai.com/ index/introducing-gpt-5/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.241872Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:ee84c5df9e433087dca4d110014884cf74ebbde4452292e516f527d7bc00c064","observation_id":"cf19e76d-5f84-4fa5-be1f-5227b830d7f1","resolution":{"observed_at":"2026-08-03T15:24:47.241872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:47.395463Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.395463Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:2d07509b3c38a45e356f60ce6ad8be159b7c6cdf945dd3f5d74805c58b723a3f","observation_id":"2226e346-02f3-45de-8b54-3b6bc96c9911","resolution":{"observed_at":"2026-08-03T15:24:47.395463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:47.570614Z","title":"Contrast mea- sures for predicting text readability","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.570614Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:1e4c820b705028fb08a225d83589698de0fa47e648850f91c68bacde9fb93fab","observation_id":"730e10e8-d833-4c78-9108-f841c2309a93","resolution":{"observed_at":"2026-08-03T15:24:47.570614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:47.735639Z","title":"Discriminability measures for predicting readability of text on textured backgrounds.Optics express, 6(4):81–91, 2000","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.735639Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:abd9bb98eecce708e1a861c0e814880520a183a327a366525932976361170a98","observation_id":"9faef261-e560-4738-8664-2d51d8ce4224","resolution":{"observed_at":"2026-08-03T15:24:47.735639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16157","last_updated":"2024-01-29T13:42:01Z","snapshot_observed_at":"2026-07-06T17:21:51.054477Z","submitted_at":"2024-01-29T13:42:01Z","title":"Spatial-Aware Latent Initialization for Controllable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16157","snapshot_observed_at":"2026-08-03T15:24:47.931336Z","title":"Spatial-aware latent initialization for controllable image gen- eration.arXiv preprint arXiv:2401.16157, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.931336Z"},"links":{"cited_paper":"/paper/2401.16157","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:5ac11bc736cfcd53942fe633d3204a9b47e679c31fbdaa9101493382c9dc0a31","observation_id":"27e9a6dc-5f86-4ab2-b0e3-28df43bad43b","resolution":{"observed_at":"2026-08-03T15:24:47.931336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:48.159850Z","title":"Web content accessi- bility guidelines 2.1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:48.159850Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:7875089375463cd815e78082241df15e10bf6ae652e269f66b2e7f05eee7f490","observation_id":"6cc56ff9-011e-4b29-af39-004aab0b44ad","resolution":{"observed_at":"2026-08-03T15:24:48.159850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15090","last_updated":"2023-06-13T17:38:20Z","snapshot_observed_at":"2026-07-06T13:57:58.305779Z","submitted_at":"2022-09-29T20:49:25Z","title":"Enforcing Hard Constraints with Soft Barriers: Safe Reinforcement Learning in Unknown Stochastic Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15090","snapshot_observed_at":"2026-08-03T15:24:48.599709Z","title":"Enforcing hard constraints with soft barriers: Safe reinforcement learning in unknown stochastic environments.ArXiv, abs/2209.15090, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:48.599709Z"},"links":{"cited_paper":"/paper/2209.15090","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:b9748ba406f29a1126b06a99bc8a3caf69e0f0a6a6c424372458990d9780fcac","observation_id":"3df208ff-baa3-4e65-80e2-4b8267414622","resolution":{"observed_at":"2026-08-03T15:24:48.599709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:48.736865Z","title":"Designdiffusion: High- quality text-to-design image generation with diffusion mod- els","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:48.736865Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:95deb4deee28e70a3813ae7c58544fc9d2a5b7802ee7dccac74f4f172485a085","observation_id":"0e1433d6-7eff-48a1-97c1-25a068908b76","resolution":{"observed_at":"2026-08-03T15:24:48.736865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:48.882840Z","title":"Desigen: A pipeline for controllable design template generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:48.882840Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:d371a37061ae06b7306f0bf31a98f237c8c4656ce3bbd5a95a57f181d6f4e42a","observation_id":"7f1a64b0-6a4c-4e2b-bf11-148913857ef9","resolution":{"observed_at":"2026-08-03T15:24:48.882840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:49.027281Z","title":"Boxdiff: Text-to-image synthesis with training-free box-constrained diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.027281Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:aa58f61ac1bb35233f8e7bbdf376787f831a29050570dd78b5fe03bd2eaa1d8b","observation_id":"3059c9c9-180f-4bd4-a5f8-88177fef2cdb","resolution":{"observed_at":"2026-08-03T15:24:49.027281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:49.196838Z","title":"Mastering text-to-image diffu- sion: Recaptioning, planning, and generating with multi- modal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.196838Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:c393c40cd2bce97d619e8231393ff6e88f86b29aa19636a44e3df59de78a91c0","observation_id":"51226779-b2d8-44c5-9914-8f78c08ca7ca","resolution":{"observed_at":"2026-08-03T15:24:49.196838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17113","last_updated":"2024-06-23T03:47:27Z","snapshot_observed_at":"2026-08-07T05:26:05.587260Z","submitted_at":"2024-02-27T01:19:53Z","title":"Transparent Image Layer Diffusion using Latent Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17113","snapshot_observed_at":"2026-08-03T15:24:49.440605Z","title":"Transparent image layer diffusion using latent transparency.arXiv preprint arXiv:2402.17113, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.440605Z"},"links":{"cited_paper":"/paper/2402.17113","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:6405adee16dccd36404c5bad5c294970ab4de45a376fc58c689453fa3f456f2a","observation_id":"e6d91a74-f4fc-447d-a1ae-f0816d90cda4","resolution":{"observed_at":"2026-08-03T15:24:49.440605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10890","last_updated":"2025-06-12T16:54:39Z","snapshot_observed_at":"2026-08-07T04:12:55.069588Z","submitted_at":"2025-06-12T16:54:39Z","title":"CreatiPoster: Towards Editable and Controllable Multi-Layer Graphic Design Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10890","snapshot_observed_at":"2026-08-03T15:24:49.697863Z","title":"Creatiposter: Towards editable and control- lable multi-layer graphic design generation.arXiv preprint arXiv:2506.10890, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.697863Z"},"links":{"cited_paper":"/paper/2506.10890","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:d24fed38f993ca805e21ae0a454aeb8ffc585926f8278eabd84092d5ffd99539","observation_id":"844b82df-f07b-4b27-9111-199762691dac","resolution":{"observed_at":"2026-08-03T15:24:49.697863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:49.815339Z","title":"Layoutdiffusion: Controllable diffu- sion model for layout-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.815339Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:d734edeff401cdad8e7ad0472a9f3482618002496558d54a422dc9c31658155a","observation_id":"2b2d97bf-5296-4bc1-9901-7fd406cad4cc","resolution":{"observed_at":"2026-08-03T15:24:49.815339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:49.900562Z","title":"Human computer interaction: Legibility and contrast","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.900562Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:6487a69466375faac19131caf1400b2bddedf1c0339b7ed66691a18c80ef566b","observation_id":"f13e40bb-108a-460f-a848-b94a00b26993","resolution":{"observed_at":"2026-08-03T15:24:49.900562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:49.983611Z","title":"Add a cream background with snowflakes","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.983611Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:2ab25e4d40227597ead7b161507f35a4f85f97aa65bcf7d14d7a47c4ad7c6ac9","observation_id":"8a30063c-c0fc-4c2b-b79b-74b2b5755f65","resolution":{"observed_at":"2026-08-03T15:24:49.983611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:48.338646Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:48.338646Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:87cdd8bf5fabb90c414a88e9aae98cd7c9c381275bb285ee60da7687b72ef3b2","observation_id":"fd523e79-7c7d-4143-8bd3-1ef2e7053855","resolution":{"observed_at":"2026-08-03T15:24:48.338646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T15:24:38.126406Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2512.17151."}