{"as_of":"2026-08-09T11:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:54f6df20cfd310668167c8ab25e9df8034802f7308d2184eaeecff4dfd33c6e0","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T13:38:44.707837Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T13:38:44.707837Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T04:47:38.315879Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"cited_work":{"arxiv_id":"2606.10892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.10892","snapshot_observed_at":"2026-07-03T04:47:38.315879Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","venue":"cs.CV","work_id":"32a2f165-43de-4ebe-8d9d-5d1ffb875312","year":2026},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"cited_paper":"/paper/2606.10892","citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:7697dd8e7f6b29e67fa1f057c8af87b48fcbb1e0d86de1b2e56329844c49960c","observation_id":"0185a2ac-0c67-4453-8a44-ab2efd08ef6c","resolution":{"observed_at":"2026-07-03T04:47:38.317169Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.10892/citation-record","integrity":"/paper/2606.10892/integrity","json":"/paper/2606.10892/citation-record.json","paper":"/paper/2606.10892"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"cited_work":{"arxiv_id":"2606.10892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.10892","snapshot_observed_at":"2026-07-03T04:47:38.315879Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","venue":"cs.CV","work_id":"32a2f165-43de-4ebe-8d9d-5d1ffb875312","year":2026},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"cited_paper":"/paper/2606.10892","citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:7697dd8e7f6b29e67fa1f057c8af87b48fcbb1e0d86de1b2e56329844c49960c","observation_id":"0185a2ac-0c67-4453-8a44-ab2efd08ef6c","resolution":{"observed_at":"2026-07-03T04:47:38.317169Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"x should be artifact-free and conform to y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:01b65661fff0b7323c64e606783a0686efb0361bf92259f3849d090d4e6b9cc3","observation_id":"60758d02-373b-4755-9b75-11b1d77be557","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:3a991072cc0700b0a4219fc9f88ba38978c31a9fae345ede872962d3fc89cef8","observation_id":"7cf32bea-f358-4322-9f01-57ec39495e53","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:2478420588805373358c07da38bb1c45789b50d1392c7eea02e134269249ca33","observation_id":"345aae86-c0a6-4ff6-8556-80125a2aa2ed","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Blended latent diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:035e6c5030a91e3fc1418a4b4ff938ef1d98a9b630880ae02cb5e43a5e89106b","observation_id":"18faf429-43b2-4410-a886-5a8073271cbf","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Blended diffusion for text-driven editing of natural im- ages,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:b4f80c08b30d0bf9f1568b6e9b581e904ff99debd2f021b5c87be3b0d526fb3e","observation_id":"a72479b5-8986-4552-bf69-ead4ce9ce181","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"High-resolution image synthesis with latent dif- fusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:9b926eb079fa821fd7171f51f6d979a47a075c70ae01e7c8bd8c5c441fb28b8e","observation_id":"92a56736-21de-4ad4-b15e-66eb983df8b1","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"A task is worth one word: Learning with task prompts for high-quality versatile image inpainting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:9941ce61171ad97bbee0dfb6da015539b08e0917e5ac7903fa8bf6ff7a133ac9","observation_id":"cd1da71a-b9b4-4f04-9bcd-60708f49d0ec","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Transparent im- age layer diffusion using latent transparency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:02260faed6725db9ea195124b9bc4ee52250ae362512bcd852187f8ea5c38b7f","observation_id":"872aedf7-eec2-44b8-a5dc-4b39139ef3a4","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"BrushNet: A plug-and-play image inpainting model with decom- posed dual-branch diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:74dc5aab707807a2e1df0be1e2ca401f5f9bb844a49465258fa2227edfcd27db","observation_id":"c862692a-64ab-4513-b9c3-12195d3be57e","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:4cd7cd5e779a1c60a9efb3031cf0a0510fe3bb9dac33bc1552eeb1caa5760543","observation_id":"57397949-0712-43b6-b3d9-2f465ffa3ff7","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"GLIDE: towards photorealistic image generation and editing with text-guided diffusion mod- els,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:fabb5d091b6d630c73b16b30672e29696e770852172829a0a927f9b7022da349","observation_id":"0a3b2135-f773-497d-ba19-6b210fa621b4","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Zero-shot text-to-image generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:bb71001eeb0407c3b4950e51521065a6d55c47d61f3e0dfe5888d6db89981342","observation_id":"6bc7b700-8e0e-442a-b6d3-cb1565edc40e","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"PixArt-α: Fast training of diffusion transformer for photorealistic text-to-image synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:58ce7385df200163ac6eabc514ddb1457778a7e7dd2fd29a9f34c3590722863a","observation_id":"44739a5d-8375-42da-85ba-99319d418008","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Null- text inversion for editing real images using guided dif- fusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:462e00804741f04e0d5ab49e1158867856dfe01e389fabfea89a6b5e70e23255","observation_id":"1f60000f-47cc-4599-acb4-4afb50287e28","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"ProxEdit: improving tuning-free real image editing with proximal guidance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:4d5d2a368c1ee38417c7469ffa42ee743c988fe1b0ec2c94417c0886e0a972f8","observation_id":"744edf53-072f-4fc0-8929-8f010efad6cf","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:87366cd4fb9f4bc6bef6e2c21d71c1b6be152b4b1a816cde31d7d22aa61ad1ca","observation_id":"5c04a25e-0acc-4dde-b45f-07158e9abdd1","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Imagen Editor and EditBench: advancing and evaluat- ing text-guided image inpainting,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:d2720cf09d9de3675508c038e98c6a56679f08bed7648d54ba0a20e877644ca6","observation_id":"1216dc7a-d6e9-4e03-9004-7633c13da358","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Attend- and-excite: Attention-based semantic guidance for text- to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:4412bfbc6badd951286095d89e3fb0119a89749fbac5bf65856767bf12082350","observation_id":"2339ff2d-07ca-4854-ae21-1b97426f4a6e","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Prompt-to-prompt image editing with cross-attention control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:9a2dbcf1019c34dab12c408ded29d05b5d8297225998801e7a62926d21b7b01e","observation_id":"78df26b9-158f-4b4f-bb1e-217a216c5473","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Learning transferable visual models from natural lan- guage supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:f2ee90b5532b520da3724c8776e2d564ee20747302fcbd3d2949c43d7531bb5e","observation_id":"e5f9352d-6359-4728-8ac1-031312e4c97e","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Plug-and-play diffusion features for text-driven image- to-image translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:46a46be0868ebc4db7cb6c132d7a5dd72187b6bb9f9ef36cf249ecc8ba5d22c7","observation_id":"26750e58-3284-4e81-aa9c-b28168771bf9","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"An im- age is worth one word: Personalizing text-to-image gen- eration using textual inversion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:8f4ece587cdfe2f29900a21cd836bb555ad36981a856c3bbbdbf42f8fa384f8e","observation_id":"2bce5a5e-492c-44bb-abe0-57c5d9ecc702","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Subject- Diffusion: open domain personalized text-to-image gen- eration without test-time fine-tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:4d21ffc2a79dce92ef8c25a7346cbc8d534d0d3ea952b03b89c6104e1df69d70","observation_id":"92c4a788-dc97-439b-9754-68097784814f","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"BLIP- Diffusion: pre-trained subject representation for control- lable text-to-image generation and editing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:516eb50f80e88bd07a35e965fc7251f104ccc680c51b020842f737f0e1baa01a","observation_id":"496547ed-c058-448e-a816-755e68ff575f","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14142","last_updated":"2022-11-17T16:20:21Z","snapshot_observed_at":"2026-07-06T14:10:16.603292Z","submitted_at":"2022-10-25T16:42:03Z","title":"From colouring-in to pointillism: revisiting semantic segmentation supervision","version":2},"cited_work":{"arxiv_id":"2210.14142","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14142","snapshot_observed_at":"2026-07-03T04:47:38.318471Z","title":"From colouring-in to pointillism: revisiting semantic segmen- tation supervision,","venue":null,"work_id":"7d4c5144-0daf-4cac-8f86-d371057d4b8f","year":2022},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"cited_paper":"/paper/2210.14142","citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:72424bc39ce231701362b2427d51bea2521294c8c4fe08498f2040286858fba8","observation_id":"bcafd246-db44-4bfb-9bf9-e48066e6dd36","resolution":{"observed_at":"2026-07-03T04:47:38.319934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:8c21d291785c658e5256c3785a3859f0ddeb899a2c5159fdb9ea4441e6383701","observation_id":"d30c39b7-5bf5-479a-8328-947fede000c7","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"De- noising diffusion implicit models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:fd12e4c578ac5c41080bccc1562f8e8816a32269cb089ffcafa35287526d494b","observation_id":"ffb59a2e-5fab-43e6-93b5-310059f27eaf","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:785eefde3dc05ebbc385c2027c3a0923a9087732795af1ec66f13de166ce1d37","observation_id":"7a342623-166d-493e-8dfe-fe1623f960bc","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Grounding DINO: marrying DINO with grounded pre- training for open-set object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:1759fe1bf26ec19aa7c92d9aaecdc85568aed7aec8903ed8122f5a7d88e6beee","observation_id":"b5504037-e7b5-4780-86bb-1ed8aabb6e2c","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"ImageRe- ward: learning and evaluating human preferences for text-to-image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:96f24cc7a444f5f208f6c6f2eef6069ea9585bfae0d3a8b5c518579bb81ff7f8","observation_id":"d5e645bc-6bb3-462e-8d56-0670641d1bf8","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"LAION-5B: an open large-scale dataset for training next generation image-text models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:9f14ffb33d9b7efa907a70368984018516ca51c727592db89bd92c4f566cfe9f","observation_id":"d914fec5-f3a7-42e4-a37e-17a47acb3fed","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T09:13:13.138021Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2606.10892."}