{"as_of":"2026-08-08T11:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ce665f34ad477ec83248c67aba73eacbfa0ed55ba6fde1bec83888b2d09941a1","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:48:35.908863Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20909/citation-record","integrity":"/paper/2505.20909/integrity","json":"/paper/2505.20909/citation-record.json","paper":"/paper/2505.20909"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:40.269535Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":"c79a2c03-62c9-4e20-bb9a-f0c4cd286b88","year":2022},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.386159Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:43ddce222a55d62b6e00ed264fb09e4127aace48730b00371440b33a3d8d5fc7","observation_id":"c348abd5-6460-4ca8-a46b-52eafef98d75","resolution":{"observed_at":"2026-08-07T13:48:40.404666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:39.992519Z","title":"TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models,","venue":null,"work_id":"f215ec6a-1058-43a7-aaf9-d481a6bb025c","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.474528Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:0f357aecac546b6854084da5b1cd25a5aa776f00516e16b48bd5924ceea2816a","observation_id":"26a7605a-4054-407f-981a-8ac79d29763b","resolution":{"observed_at":"2026-08-07T13:48:40.134070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:39.766180Z","title":"MotionPro: A Precise Motion Controller for Image-to-Video Generation,","venue":null,"work_id":"f9b79c6d-cb5a-42cd-8a78-bd5da858687b","year":2025},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.589031Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:262049a9366c54603e82f5e01ccdd2e46a3e0887f3b9cab7e5cbb14842c5208b","observation_id":"5bb18277-1c48-40a1-84c4-b4fe440dd5fd","resolution":{"observed_at":"2026-08-07T13:48:39.876686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:39.524050Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion,","venue":null,"work_id":"22b4e990-bfee-42f8-8249-886521725f18","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.738311Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:b02c39188a675a43fad1443c62b60de9d80c94ef6cbbba170971653ca23b0e99","observation_id":"22c6a66e-5de6-46e7-bde5-8fedde2ed8a1","resolution":{"observed_at":"2026-08-07T13:48:39.635937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:39.255460Z","title":"Dreambooth: Fine tuning text-to- image diffusion models for subject-driven generation,","venue":null,"work_id":"bb5adac0-85eb-4867-b3d0-df81be56ead9","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.832069Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:dce1c8cc918b73dcce144775ee6f4e3c4233d1e2f47bb8aa01d0a1a1d2ec7c93","observation_id":"742c8803-9113-4b15-ac20-b7b8464716fc","resolution":{"observed_at":"2026-08-07T13:48:39.367858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:38.944832Z","title":"Multi-concept customization of text-to-image diffusion,","venue":null,"work_id":"c22faae0-b34d-478b-a16c-a0fb09e7d936","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.957635Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:86e5bc18cacf997e88893c31aa1e985bb4f2473e808351ac6775b2d17e7912a0","observation_id":"e4c96d64-81e2-435e-a482-890d2d36d444","resolution":{"observed_at":"2026-08-07T13:48:39.086919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:38.703225Z","title":"Ssr-encoder: Encoding selective subject representation for subject-driven generation,","venue":null,"work_id":"be65e02e-7088-4966-974c-2e05673d4826","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:33.992942Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:60adb449f7e42a79161b74e9d6139a2177cc4b43a927d7793473b6f814d3babb","observation_id":"52aaa2b9-cb12-4240-bf55-86607696c232","resolution":{"observed_at":"2026-08-07T13:48:38.800091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:38.432726Z","title":"Blip-diffusion: Pre-trained subject representation for controllable text-to-image generation and editing,","venue":null,"work_id":"308d7af9-0713-45a8-81de-4e1d9bc3f040","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.033547Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:07b0a39e973154380d7534346a43181e43346bc79652e5bdbbcc42df7fc4819b","observation_id":"8af1e7b6-2f03-410a-a01d-dce5a9be7c2e","resolution":{"observed_at":"2026-08-07T13:48:38.550719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:38.177903Z","title":"Generative multimodal models are in- context learners,","venue":null,"work_id":"5f6f52cc-1591-425a-9f3a-e813d8c30413","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.104135Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:204cba0ce34c964e6c1e3b00c75bc449ea7dc9120db2e16a96d03d30227e82fa","observation_id":"eec0c16d-21bc-44c5-9bbe-506982e15ce7","resolution":{"observed_at":"2026-08-07T13:48:38.327398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02992","last_updated":"2024-04-26T01:24:57Z","snapshot_observed_at":"2026-07-06T16:27:47.445841Z","submitted_at":"2023-10-04T17:28:44Z","title":"Kosmos-G: Generating Images in Context with Multimodal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02992","snapshot_observed_at":"2026-08-07T13:48:34.203912Z","title":"Kosmos-g: Generating images in context with multimodal large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.203912Z"},"links":{"cited_paper":"/paper/2310.02992","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:87ad144ad850703d32985dbd1701ae753f2ec8e96354b8559551d54a4a0d202f","observation_id":"c3a3fb72-17da-4008-a3fc-acab907f9fec","resolution":{"observed_at":"2026-08-07T13:48:34.203912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:37.905409Z","title":"Instancediffusion: Instance-level control for image generation,","venue":null,"work_id":"ec0ca248-da9d-42e3-a00d-6f0c2682bc8c","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.254379Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:d7011c76dda0054064ae0f91bdebf14e5b2802e074ce889aff90da160e9862d3","observation_id":"e96bcf18-40bc-4b62-b569-891094033f2d","resolution":{"observed_at":"2026-08-07T13:48:38.028216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-07T13:48:34.323871Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.323871Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:5cade0a2397ef6323183c10d90b1e3dc789f1312e2248f0ec92f37886f019088","observation_id":"edf20545-e900-4265-adb5-ac7574cac077","resolution":{"observed_at":"2026-08-07T13:48:34.323871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05195","last_updated":"2024-04-09T22:14:37Z","snapshot_observed_at":"2026-08-07T14:37:15.434465Z","submitted_at":"2024-02-07T19:07:10Z","title":"$\\lambda$-ECLIPSE: Multi-Concept Personalized Text-to-Image Diffusion Models by Leveraging CLIP Latent Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05195","snapshot_observed_at":"2026-08-07T13:48:34.424437Z","title":"λ- eclipse: Multi-concept personalized text-to-image diffusion models by leveraging clip latent space,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.424437Z"},"links":{"cited_paper":"/paper/2402.05195","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:ff0f7e63d5099d305b844da75219cd37ca9683d288e1724c263310d8a678f7c0","observation_id":"5ffda3e5-f2de-4fe0-9615-ebf98a369428","resolution":{"observed_at":"2026-08-07T13:48:34.424437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:37.699471Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"becff80c-23b5-40f8-bbdb-6bf5a1d95f6a","year":2021},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.542654Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:19fd3405f26200601da75f7a05308f9a4719e38f327a20b86a625b898319a8ba","observation_id":"0bebb68c-7160-440d-9d48-2e403e5d86e2","resolution":{"observed_at":"2026-08-07T13:48:37.787586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09481","last_updated":"2024-05-08T03:21:34Z","snapshot_observed_at":"2026-08-08T09:53:49.503106Z","submitted_at":"2023-07-18T17:59:02Z","title":"AnyDoor: Zero-shot Object-level Image Customization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09481","snapshot_observed_at":"2026-08-07T13:48:34.680927Z","title":"Anydoor: Zero-shot object-level image customization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.680927Z"},"links":{"cited_paper":"/paper/2307.09481","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:f48de084edfce57fa650d3129c4158acc7ecc56892238ecf5fc8042e48f63066","observation_id":"8ffa62a7-eafc-4385-aba8-9c8474f19a33","resolution":{"observed_at":"2026-08-07T13:48:34.680927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07209","last_updated":"2025-03-04T06:21:26Z","snapshot_observed_at":"2026-07-06T18:28:51.180903Z","submitted_at":"2024-06-11T12:32:53Z","title":"MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07209","snapshot_observed_at":"2026-08-07T13:48:34.780116Z","title":"Ms- diffusion: Multi-subject zero-shot image personalization with layout guidance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.780116Z"},"links":{"cited_paper":"/paper/2406.07209","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:d87d6e4aaba973b7deb6152aa9deaef464fca42638b7d8114956536e77c0b8be","observation_id":"f9fc5dca-64d6-4fd3-ac47-eb9cc2073c7c","resolution":{"observed_at":"2026-08-07T13:48:34.780116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:34.831272Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.831272Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:db709812b0c12ccfc8a4f3893f44720d8d39dcf753802a840437837d7d852b05","observation_id":"7317e420-0fc7-42cd-99bd-24eacbb74771","resolution":{"observed_at":"2026-08-07T13:48:34.831272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:37.506778Z","title":"Layoutdiffusion: Controllable diffusion model for layout-to-image generation,","venue":null,"work_id":"be385f17-a1a3-43db-96a4-882120e06156","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:34.922080Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:3692eea0fa15ace3e9233ea6db2959d5ecd168918e3e1400834d38fc18f23c75","observation_id":"4c3e7534-910f-4107-aa70-0f7f1c5e4c38","resolution":{"observed_at":"2026-08-07T13:48:37.563702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:35.031893Z","title":"Gligen: Open-set grounded text-to-image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.031893Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:7a2a32757330a559cdce4146b6ba951418afb41fba11daacfebc73f184c8a85c","observation_id":"cd9dda3d-d91a-42f8-8de2-515769dda517","resolution":{"observed_at":"2026-08-07T13:48:35.031893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:37.241248Z","title":"Training-free layout control with cross-attention guidance,","venue":null,"work_id":"12276351-caf0-4d9e-8952-6e52e67bca50","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.145813Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:1b6fe0f4ee20a3ca589dd5f2367b395c11062b4fe8074f886264c6124d3a2a79","observation_id":"2d86ae8a-24c5-44b4-8b14-f28400fb0224","resolution":{"observed_at":"2026-08-07T13:48:37.384930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:37.102919Z","title":"Boxdiff: Text-to-image synthesis with training-free box-constrained diffusion,","venue":null,"work_id":"17419297-deca-438c-964d-ef3d97a47c29","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.246863Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:65e0984649c55877891c1cd8e9433351b10dd826ff44fa0a77d1b68e9846998b","observation_id":"cbc2de7e-2525-41c2-86c7-f78454cc78be","resolution":{"observed_at":"2026-08-07T13:48:37.184320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:36.952090Z","title":"Segment anything,","venue":null,"work_id":"324e5b1b-8366-45b3-84df-23bcf220179d","year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.366089Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:d6d9ac19c2372cac349778cdf2d7f6f9d7fa2a7169bd646710cd709c095ad607","observation_id":"362291ea-99af-4558-b3fa-446df2ac9510","resolution":{"observed_at":"2026-08-07T13:48:36.998320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:36.739841Z","title":"Flamingo: a visual language model for few-shot learning,","venue":null,"work_id":"4483f3c5-6683-4a1e-95c8-e6b269161e2c","year":2022},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.486664Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:404d8eead223ee283850b791557ba021130ab4c893eb77e40adf63e4e294a378","observation_id":"d2560623-8c75-4ff0-b8ef-d8ba3a464216","resolution":{"observed_at":"2026-08-07T13:48:36.810479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:36.472912Z","title":"Moma: Multimodal llm adapter for fast personalized image generation,","venue":null,"work_id":"9d67e183-7388-456d-88f7-0df609e4d06b","year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.583537Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:b0526679898159cf2042fb68fb2ff83372f5d31a8ca5d4d6bc3774ef4ab42b8b","observation_id":"f949f0bc-1185-4ac4-8c49-be374de90ac8","resolution":{"observed_at":"2026-08-07T13:48:36.566877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:36.305241Z","title":"Coco-stuff: Thing and stuff classes in context,","venue":null,"work_id":"e6fe340d-1809-4b4b-846f-630fb9fa8a0b","year":2018},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.647233Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:35630c094025d72c8bda3bbd7f30dd02211421fc55e08b025e907fcd4adbf3a9","observation_id":"d3902ba2-2b04-482a-ab5c-c793de3bc6a4","resolution":{"observed_at":"2026-08-07T13:48:36.366437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:48:36.105712Z","title":"The open images dataset v4: Unified image classification, object detection, and visual relationship detection at scale,","venue":null,"work_id":"e00e6f9e-eeba-498e-b1c3-bc4c80321aa0","year":2020},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.760399Z"},"links":{"citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:69c7daecead0a2df4aab3f433b390bd57caf8dd942c5839fe82e2b8e1972fd9c","observation_id":"c9d062ff-09f2-419f-bb80-5f8df0e6b607","resolution":{"observed_at":"2026-08-07T13:48:36.219074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03459","last_updated":"2024-06-05T17:07:24Z","snapshot_observed_at":"2026-07-06T18:26:01.717861Z","submitted_at":"2024-06-05T17:07:24Z","title":"LW-DETR: A Transformer Replacement to YOLO for Real-Time Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03459","snapshot_observed_at":"2026-08-07T13:48:35.843367Z","title":"Lw-detr: A transformer replacement to yolo for real-time detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.843367Z"},"links":{"cited_paper":"/paper/2406.03459","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:5a43b320ec072998f3ae654b1a6f4fe58a867a20f97b43c4a05762b04b9f535d","observation_id":"95a8d426-622c-4254-a8c7-3bb79f77ee92","resolution":{"observed_at":"2026-08-07T13:48:35.843367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T13:48:35.908863Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:48:35.908863Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2505.20909"},"observation_digest":"sha256:a74cc2f886ac61afb581d3c0293fac1509b600f86efe66f5fe76cf6641236472","observation_id":"d0dd19e8-53fd-41ef-93e8-0723dbe878f5","resolution":{"observed_at":"2026-08-07T13:48:35.908863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20909","last_updated":"2025-05-27T08:57:07Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T13:41:51.105468Z","submitted_at":"2025-05-27T08:57:07Z","title":"Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2505.20909."}