{"as_of":"2026-08-16T22:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c75f2e2c6ad56c3ef8c7a4c440df9e37e22bc51205c7a8bdc81c5fe34929329","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:00:51.602062Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.03203/citation-record","integrity":"/paper/2505.03203/integrity","json":"/paper/2505.03203/citation-record.json","paper":"/paper/2505.03203"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.402442Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":"b9467c92-5a95-4e05-8648-71d4de85607d","year":2021},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.423885Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:17ea0d949b4ee03c26912c6bb2c39e93ed26e13122c6c99aae208339feb4267e","observation_id":"33527ffd-ed40-4f05-8092-9909ff6fc4dd","resolution":{"observed_at":"2026-08-16T00:00:52.407342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.385067Z","title":"Hierarchical text-conditional image generation with clip latents,","venue":null,"work_id":"ead5b4c4-a9af-4705-87dd-7ed15eac9a81","year":2022},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.428836Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:62e400033cc3db22e83b4bd18c66829b81f5c720f3c8671b396f84d641869778","observation_id":"29d5bb94-f3d1-4da8-884f-3afce276867a","resolution":{"observed_at":"2026-08-16T00:00:52.389986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.362901Z","title":"Gligen: Open-set grounded text-to-image generation,","venue":null,"work_id":"95b534df-91c0-43b6-b224-db5bafa46e2b","year":2023},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.440460Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:8fed6e34e36d9d1d91e70a82c92e0693664e266cf48f91287244fade47cea2b8","observation_id":"a53e76cb-0bd9-4e23-8f70-834a16484892","resolution":{"observed_at":"2026-08-16T00:00:52.371027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.348373Z","title":"Training-free structured diffusion guidance for compositional text-to-image synthesis,","venue":null,"work_id":"3053c9b7-dae1-43ce-8bfe-f3e8e7d34d44","year":2023},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.450372Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:7a74af1b0cd5132317da3eaa772a6dbae49d82f45e20e48622db39770b0ada1e","observation_id":"55a39ce4-cacf-4800-8d2b-58beb8358126","resolution":{"observed_at":"2026-08-16T00:00:52.353017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.332498Z","title":"Svdiff: Compact parameter space for diffusion fine-tuning,","venue":null,"work_id":"618ae362-544e-4d4f-b559-c0b8200efd6c","year":2023},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.458740Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:24d0c41486cdfb99426851565a958ed8861a26a8fe02fc14e0bf76bd03da40a4","observation_id":"27ba067e-1ed9-4ab2-9966-73fc03592053","resolution":{"observed_at":"2026-08-16T00:00:52.337764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02412","last_updated":"2023-02-05T15:49:26Z","snapshot_observed_at":"2026-08-16T15:57:36.500232Z","submitted_at":"2023-02-05T15:49:26Z","title":"Mixture of Diffusers for scene composition and high resolution image generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02412","snapshot_observed_at":"2026-08-16T00:00:51.467729Z","title":"Mixture of diffusers for scene composition and high resolution image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.467729Z"},"links":{"cited_paper":"/paper/2302.02412","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:467cb6c2678df6e73eecc11b4837da4b203cf37528003615630c3b43e2c73ad1","observation_id":"d340d189-b2fb-464d-aee2-1d96cea3fc94","resolution":{"observed_at":"2026-08-16T00:00:51.467729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.311031Z","title":"Training-free layout control with cross-attention guidance,","venue":null,"work_id":"47face46-e3ef-4708-b464-3284fcde0470","year":2023},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.472920Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:680a145958ef72f01d6f585d94f74f4e5efa62a9aa7094d7bde41532cacfe1c1","observation_id":"0898d70c-e96c-4e58-8f8c-839d9a23476a","resolution":{"observed_at":"2026-08-16T00:00:52.318133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14828","last_updated":"2025-04-16T20:39:59Z","snapshot_observed_at":"2026-08-16T13:50:04.537480Z","submitted_at":"2024-05-23T17:46:23Z","title":"Good Seed Makes a Good Crop: Discovering Secret Seeds in Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14828","snapshot_observed_at":"2026-08-16T00:00:51.477420Z","title":"Good seed makes a good crop: Discovering secret seeds in text-to-image diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.477420Z"},"links":{"cited_paper":"/paper/2405.14828","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:109a0eb4d959e6c8440f38e49b5ea3b1f50ea848e9b064af52888c7745143601","observation_id":"0d438e9b-6d3e-435b-952d-1ce30202215c","resolution":{"observed_at":"2026-08-16T00:00:51.477420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19967","last_updated":"2024-09-30T05:36:24Z","snapshot_observed_at":"2026-08-16T13:14:16.700372Z","submitted_at":"2024-09-30T05:36:24Z","title":"Magnet: We Never Know How Text-to-Image Diffusion Models Work, Until We Learn How Vision-Language Models Function","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19967","snapshot_observed_at":"2026-08-16T00:00:51.481975Z","title":"Magnet: We never know how text-to-image diffusion models work, until we learn how vision-language models function,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.481975Z"},"links":{"cited_paper":"/paper/2409.19967","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:d6c6e2bf14b344c114f167ba1e2cceb2d6bbafccf661bf001f595bbf97071670","observation_id":"7649b0b8-6060-4a8a-9e0e-1627ee22ff10","resolution":{"observed_at":"2026-08-16T00:00:51.481975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.282393Z","title":"Compositional text-to- image synthesis with attention map control of diffusion models,","venue":null,"work_id":"47d479e3-687f-4c02-96e3-f5e911de99e4","year":2023},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.487089Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:6ddb0bfd39556397b0b5756d874b3e2d0b4bde9c8cd1188e6c8d244c14716c5c","observation_id":"7be4737f-23b2-46e1-b6ba-eb7f8d675528","resolution":{"observed_at":"2026-08-16T00:00:52.291121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02236","last_updated":"2023-06-04T02:33:12Z","snapshot_observed_at":"2026-08-16T15:26:50.446628Z","submitted_at":"2023-06-04T02:33:12Z","title":"Detector Guidance for Multi-Object Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02236","snapshot_observed_at":"2026-08-16T00:00:51.492854Z","title":"Detector guidance for multi-object text-to-image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.492854Z"},"links":{"cited_paper":"/paper/2306.02236","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:cb49e3629e2f9c64f7c1538f48132a344bf0c2ead390ae8dacfc1c5e0f13bc9f","observation_id":"8054aa5d-b80f-4308-8862-b99c3d0c00ae","resolution":{"observed_at":"2026-08-16T00:00:51.492854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05375","last_updated":"2024-02-08T03:15:06Z","snapshot_observed_at":"2026-08-16T14:20:23.101030Z","submitted_at":"2024-02-08T03:15:06Z","title":"Get What You Want, Not What You Don't: Image Content Suppression for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05375","snapshot_observed_at":"2026-08-16T00:00:51.506838Z","title":"Get what you want, not what you don’t: Image content suppression for text-to-image diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.506838Z"},"links":{"cited_paper":"/paper/2402.05375","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:b04374cd7d187843f29874b21bf3151bd978b6bd7ab05a3c0c05faea3ba15790","observation_id":"80e68bc9-33e8-427c-9a5e-c7d500c2f189","resolution":{"observed_at":"2026-08-16T00:00:51.506838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14101","last_updated":"2024-09-16T20:20:30Z","snapshot_observed_at":"2026-08-16T13:50:25.267071Z","submitted_at":"2024-05-23T02:08:44Z","title":"Enhancing Image Layout Control with Loss-Guided Diffusion Models","version":2},"cited_work":{"arxiv_id":"2405.14101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.14101","snapshot_observed_at":"2026-08-16T00:00:51.780490Z","title":"Enhancing Image Layout Control with Loss-Guided Diffusion Models","venue":"cs.CV","work_id":"bc9250ca-30b9-41db-8a38-1f272fac2a96","year":2024},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.511851Z"},"links":{"cited_paper":"/paper/2405.14101","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:12ed5a6ce5e3f8446b0117814a73a687d761c785ddc6834c8ce9563582302645","observation_id":"06263cf0-c2fb-4a1f-ac5d-5f0804c813ee","resolution":{"observed_at":"2026-08-16T00:00:51.796513Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.265249Z","title":"Linguistic binding in diffusion models: Enhancing attribute correspondence through attention map alignment,","venue":null,"work_id":"78405575-e32f-45ae-b413-92d7018073a7","year":2024},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.524569Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:0057ed08769547e1aa63e5fc76e2452a851f8e3b8042b4dd73ccfc6433ad3678","observation_id":"01828fc7-bb42-4495-822c-95d022ee070b","resolution":{"observed_at":"2026-08-16T00:00:52.271036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.228204Z","title":"Image segmentation using text and image prompts,","venue":null,"work_id":"5e33e25e-d70a-435f-87ba-a40270d0c2a5","year":2022},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.534039Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:91e9a04562d7e983cb38dd621fad01526ab7596ff8c21553ef4349e8805015c8","observation_id":"d73566bc-0926-4cfc-ae82-6276af0bbf99","resolution":{"observed_at":"2026-08-16T00:00:52.252878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-16T00:00:51.540136Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.540136Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:5968d4c0000fd708464112d5f2eacb74e8543f55592271e0b53ad33d23d1dfa2","observation_id":"780655bd-7ca8-431c-99e9-1edfcefbaea7","resolution":{"observed_at":"2026-08-16T00:00:51.540136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.150156Z","title":"Attend-and-excite: Attention-based semantic guidance for text-to-image diffusion models,","venue":null,"work_id":"a86dbbb5-e3e1-43a0-8a73-0c6967517a86","year":2023},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.548660Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:a8c11e5d7c917ee83b561d2e804dd3caee0902ce3f9c720d99ecb95e993487c6","observation_id":"2d1f4542-a38d-4459-b22a-0b35b6a829f8","resolution":{"observed_at":"2026-08-16T00:00:52.180970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.07082","last_updated":"2020-04-23T04:22:16Z","snapshot_observed_at":"2026-08-14T01:19:29.014936Z","submitted_at":"2020-03-16T09:05:53Z","title":"Stanza: A Python Natural Language Processing Toolkit for Many Human Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.07082","snapshot_observed_at":"2026-08-16T00:00:51.553883Z","title":"Stanza: A python natural language processing toolkit for many human languages,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.553883Z"},"links":{"cited_paper":"/paper/2003.07082","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:c1e09c36c3a35f44d3a46fe007410ea0fb7ee208b617fb6ce3aac00a6c94cfee","observation_id":"34effceb-fbdd-4a7a-9642-d86e73238073","resolution":{"observed_at":"2026-08-16T00:00:51.553883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.074870Z","title":"You only look once: Unified, real-time object detection,","venue":null,"work_id":"1eed22cb-879a-4c45-816c-4f86575dfbd3","year":2016},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.561760Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:245ae92d75606650d18bb421483796b57ddc014fe1bf17f82450685d534304a9","observation_id":"59529fe4-2e81-4581-97a8-6fba3a648239","resolution":{"observed_at":"2026-08-16T00:00:52.114643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.044149Z","title":"T2i- compbench: A comprehensive benchmark for open-world compositional text-to-image generation,","venue":null,"work_id":"f63d28c2-1cc0-4354-bc3e-a00fa7706a82","year":2023},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.566677Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:7828c9df73e636dacc632769b4f2aa41d75f931aa1ee79ee7290c67011c5be4e","observation_id":"3c9ae9bd-7819-4649-89a4-aada692c82be","resolution":{"observed_at":"2026-08-16T00:00:52.049298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:52.017442Z","title":"Boxdiff: Text-to-image synthesis with training-free box-constrained diffusion,","venue":null,"work_id":"54fb1dbe-65aa-4e66-bbbf-59e3272c8550","year":2023},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.571061Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:238275b02fd5b6512bf89bbbfb7a03a4c57c4bc8fe43c13d5169571fff4cbf17","observation_id":"e99ead89-5c38-4a98-90f2-cb97c6e7c8c9","resolution":{"observed_at":"2026-08-16T00:00:52.023848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:51.994243Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":"70e4eb47-c995-4230-913d-4424962d434a","year":2014},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.575906Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:a209ebf47f8c4b1097514589b45ecddaafd4229917259d71a2c08fe64347d7bb","observation_id":"75d26f34-f4b2-45d6-85df-954d299cb081","resolution":{"observed_at":"2026-08-16T00:00:52.000032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:51.972444Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"181b7dcb-9a8c-41c2-9a03-025d80d5be87","year":2021},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.584803Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:fe423ce2b68df4e3831053a3861180cc6c12a8c1d1a391b276b1c92c04c92d44","observation_id":"a68a0389-69d3-4010-bd3d-e2a84e2eae9c","resolution":{"observed_at":"2026-08-16T00:00:51.977803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-16T00:00:51.590426Z","title":"Clipscore: A reference-free evaluation metric for image captioning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.590426Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:9b935b65187bb5df8e3de57fb5050a66585419e56e6dcd662e52cf0cb17dded9","observation_id":"c17f3d91-7749-4548-91a4-4a1fcde7e46d","resolution":{"observed_at":"2026-08-16T00:00:51.590426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-16T13:41:21.785733Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-16T00:00:51.595885Z","title":"Genai-bench: Evaluating and improving compositional text-to-visual generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.595885Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:e286fe21e73f3d75e55b940a830575a094fc26bec1172c69b48fcc53316ad758","observation_id":"81838fe5-29bc-4b25-8eb6-c8fbb5e161c5","resolution":{"observed_at":"2026-08-16T00:00:51.595885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:00:51.945645Z","title":"Introducing gpt-4o and more tools to chatgpt free users,","venue":null,"work_id":"2020bdf1-2bfe-45a8-a859-fd797bb9160e","year":2024},"citing_paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:00:51.602062Z"},"links":{"citing_paper":"/paper/2505.03203"},"observation_digest":"sha256:d97f49ffaeecf643d752c7c1cc2c5134ffc0aba81c2e03ef17d7e4cf27c78c62","observation_id":"4c119443-ed6c-4d18-ac17-02be54d96c47","resolution":{"observed_at":"2026-08-16T00:00:51.954113Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.03203","last_updated":"2025-05-06T05:38:13Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T23:54:58.597647Z","submitted_at":"2025-05-06T05:38:13Z","title":"PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":15},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2505.03203."}