{"as_of":"2026-08-07T21:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e0c8b7dc6a7c3f0a0088e6b2c4ba999fc4ba63777a47e471c28dafe437ab35e9","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:54:41.801190Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06826/citation-record","integrity":"/paper/2506.06826/integrity","json":"/paper/2506.06826/citation-record.json","paper":"/paper/2506.06826"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.500210Z","title":"Wan 2.1 flf2v: First-last frame video generation","venue":null,"work_id":"6b62b858-5f23-4ce7-99d6-4c72f531a865","year":2025},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.569936Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:39138858ef6a1d0f039487e1030c37022ac56908d7702cfa3d5e249a79f15223","observation_id":"59fd8493-e45f-4ffb-a7ae-48a93d98fa71","resolution":{"observed_at":"2026-08-07T05:54:42.503855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.489347Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":"f295c83b-1e0a-472b-8345-48dc814dc85a","year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.573980Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:d707af2eef11c1084110e1928cac39d91df417a01b7b8223d5fa77f5314fd044","observation_id":"4a2b3ec0-a74a-4b26-9106-6535725b38cf","resolution":{"observed_at":"2026-08-07T05:54:42.493422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-07-06T03:53:10.336430Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-07T05:54:41.578096Z","title":"Neural machine translation by jointly learning to align and translate","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.578096Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:0f09b14c7157df72d85b48c7aace1fe00cd2860b97962dbbf008a2b15d8b301d","observation_id":"787b3a90-8077-4bf2-933d-8a3bc98d9f7f","resolution":{"observed_at":"2026-08-07T05:54:41.578096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.478383Z","title":"Flux.1 redux [dev]: Image variation adapter for flux.1 models","venue":null,"work_id":"4b64984b-92bb-4467-bfda-407ed4a6f9e9","year":2025},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.582028Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:6a2d9fa81b8e9ef8f8e4a8063420b2d58bd9e252ff17d69583770855238ab92a","observation_id":"6bbaeca0-49a0-4222-a39f-7574acedcb97","resolution":{"observed_at":"2026-08-07T05:54:42.482289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.468036Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"d19265b7-e75f-4c29-8164-1b982b3a6cc8","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.586109Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:49e4066f7cbf951643041b37abe503c76220a7482c8f2d388a3a87db57f05591","observation_id":"2d6741c8-7af0-46e8-a20d-fb25052ea07f","resolution":{"observed_at":"2026-08-07T05:54:42.471625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.457456Z","title":"Multi-view consistency loss for improved single-image 3d reconstruction of clothed people","venue":null,"work_id":"94949cb0-92db-4e71-807b-53d50cfd3bf7","year":2020},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.589807Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:47add6bb6185063133823421e0ee20674c2fc3d517ef58d3542eb3592599233e","observation_id":"bbd622f8-04a3-4509-9d1b-60481d70fa7e","resolution":{"observed_at":"2026-08-07T05:54:42.460943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.593481Z","title":"Masactrl: Tuning-free mutual self-attention control for consistent image synthesis and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.593481Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:f6a087248d544fe393698b0f2d348bd041502ece5fce6be39a59e395d1c7506a","observation_id":"c9888a0e-b5e4-4a83-a448-9c851a467d50","resolution":{"observed_at":"2026-08-07T05:54:41.593481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.441122Z","title":"Training-free layout control with cross-attention guidance","venue":null,"work_id":"a906cbbd-34b8-4544-859f-bdd65056fbf7","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.596805Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:afb91bbeb1a2854881803295d837291bf314cf8f6794e133b9c2066589f72536","observation_id":"3cfe740e-c9b9-48d9-ac89-0ac2ecbb309e","resolution":{"observed_at":"2026-08-07T05:54:42.444962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.430732Z","title":"Perception prioritized training of diffusion models","venue":null,"work_id":"305a517b-79f0-419e-96ca-40e5e8711490","year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.599952Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:1dce50f58b848f30db0036d9a495f15fece24ecd95da71faeee7327ec75afcaa","observation_id":"edb52951-f602-428d-96b4-acdba64a8fe9","resolution":{"observed_at":"2026-08-07T05:54:42.434340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.420535Z","title":"Flux.1-dev-controlnet-inpainting-beta","venue":null,"work_id":"0a2c4279-3ad7-4463-94f0-b7074a711dd3","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.603120Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:57fd6082adfc9c5b17c8f846dd01975d93a26507c0c93469937e7f3de4cec525","observation_id":"2c21c13d-d4fc-4429-971f-37c78afeefc7","resolution":{"observed_at":"2026-08-07T05:54:42.424038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.609794Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.609794Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:33ebb5cca45dac95e268c319c97e8218b3a693673b6d70342eec51a8c817bcc7","observation_id":"802e2eb3-7063-4a09-be43-d3629119f161","resolution":{"observed_at":"2026-08-07T05:54:41.609794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16420","last_updated":"2024-01-29T18:59:02Z","snapshot_observed_at":"2026-08-05T03:42:54.599829Z","submitted_at":"2024-01-29T18:59:02Z","title":"InternLM-XComposer2: Mastering Free-form Text-Image Composition and Comprehension in Vision-Language Large Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16420","snapshot_observed_at":"2026-08-07T05:54:41.613378Z","title":"Internlm-xcomposer2: Mastering free-form text-image composition and comprehension in vision-language large model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.613378Z"},"links":{"cited_paper":"/paper/2401.16420","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:a33c593d0b76c867069530a705ab631740fc7edca0a8cbbcb27fc58a1c29920b","observation_id":"2bb1ccdb-5715-4bcc-b5d3-4d8d6b0713e4","resolution":{"observed_at":"2026-08-07T05:54:41.613378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.404277Z","title":"Efros, and Aleksander Holynski","venue":null,"work_id":"bbd8ee9f-9f0f-4993-9861-165fe0209078","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.617190Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:d668db78c10b217c69605a97d5d1b1848b26fea56951752c7fde9b7aba18ff98","observation_id":"09d67ae2-211d-4260-85e5-264bcffaf608","resolution":{"observed_at":"2026-08-07T05:54:42.407838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09630","last_updated":"2026-06-05T14:06:55Z","snapshot_observed_at":"2026-08-07T17:12:06.463329Z","submitted_at":"2025-03-11T18:20:20Z","title":"CASteer: Cross-Attention Steering for Controllable Concept Erasure","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09630","snapshot_observed_at":"2026-08-07T05:54:41.620334Z","title":"Casteer: Steering diffusion models for controllable generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.620334Z"},"links":{"cited_paper":"/paper/2503.09630","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:f8a317b0f375729330cfbdcf9d619d69863f3b2619bf814778a05e8f41e2eac5","observation_id":"d10cfc10-2eb7-4846-be85-743208858275","resolution":{"observed_at":"2026-08-07T05:54:41.620334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.624039Z","title":"Generative adversarial networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.624039Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:d278013782f7b3ecc6a525a019116afbfbffa1852d3d6ece90cb95916c77aeea","observation_id":"8d1e1d5e-64f6-4a23-b870-5e180255454a","resolution":{"observed_at":"2026-08-07T05:54:41.624039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.627283Z","title":"Generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.627283Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:1552471e20ffdfad9cde7a2d5bfe7adb0b23fc9c73cab0f9de6ab0b7388655d3","observation_id":"b8e76a78-def9-46dc-8648-420519faac55","resolution":{"observed_at":"2026-08-07T05:54:41.627283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-07T05:54:41.630660Z","title":"Prompt-to-prompt image editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.630660Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:94d9c66b5b4b181d4b1526c7e47ac0a99ad20141574e9f893b3ff8e55cced6fe","observation_id":"0bb73e4f-1d0b-43d5-a824-2eb1bf5cd69b","resolution":{"observed_at":"2026-08-07T05:54:41.630660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-07T05:54:41.634098Z","title":"Clipscore: A reference-free evaluation metric for image captioning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.634098Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:fb2bf97b4ff62caed6077bfcea28d97e7117d467e141e968348840b32d571564","observation_id":"61a4a234-c2ea-4081-8d17-dce417e66eb7","resolution":{"observed_at":"2026-08-07T05:54:41.634098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.637948Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.637948Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:ee9d0d7815aac4cb44e2653669fa665cf5ddc91b09f628a9f57edba0900ebd5a","observation_id":"fec7d823-1454-42e7-9e41-c6abac6a9db0","resolution":{"observed_at":"2026-08-07T05:54:41.637948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.375258Z","title":"3d shape completion with multi-view consistent inference","venue":null,"work_id":"a2a87e61-a858-4924-a420-8522d564c517","year":2020},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.641284Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:d5f22d3e30e6733b848e5c34314c2886a1e4a3e8d9e9ca7f3e528367f9791a17","observation_id":"2bdab274-0e9c-44c5-b836-317b192a671d","resolution":{"observed_at":"2026-08-07T05:54:42.379063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.364276Z","title":"Globally and locally consistent image completion","venue":null,"work_id":"b025da63-7d99-43e0-a39a-63e8e63cf59b","year":2017},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.644508Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:c5d0c48f20218159d988c56f7b8098c008dee91c3b96c0494630b65d104c867a","observation_id":"6a9dba46-3dc8-4ad4-a41b-2819cef99ada","resolution":{"observed_at":"2026-08-07T05:54:42.367896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.353630Z","title":"Video interpolation with diffusion models","venue":null,"work_id":"b8e26bd4-908a-42c4-8cc4-ef0c8594b998","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.647545Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:5054c551e3e3d928d8a37172e9add302793301dd71066697b269fd3878e96322","observation_id":"ead48133-d038-4d02-b34d-7fd93def5f03","resolution":{"observed_at":"2026-08-07T05:54:42.357276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15842","last_updated":"2025-08-27T10:30:27Z","snapshot_observed_at":"2026-07-06T18:50:13.559866Z","submitted_at":"2024-07-22T17:58:05Z","title":"DiffArtist: Towards Structure and Appearance Controllable Image Stylization","version":4},"cited_work":{"arxiv_id":"2407.15842","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.15842","snapshot_observed_at":"2026-08-07T05:54:41.942928Z","title":"DiffArtist: Towards Structure and Appearance Controllable Image Stylization","venue":"cs.CV","work_id":"2ad512cf-6eba-427a-a5ba-04d51ec77ec3","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.650780Z"},"links":{"cited_paper":"/paper/2407.15842","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:e8de1f02a99cc14c4cdf36b26a6bec846f10e58a54320b07f0eb8b2562787e48","observation_id":"5bf12def-21ea-404c-bf78-14152976fd60","resolution":{"observed_at":"2026-08-07T05:54:41.949073Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.342691Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":"7c59a4a4-7abe-40c4-b560-9040398dcdc8","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.654339Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:38d810ccfade144e4d23301c76bd700ff5222fb16e0414c1bc96e614de99bec0","observation_id":"4c4632a6-e9fa-44c0-aedc-f90cbd76f935","resolution":{"observed_at":"2026-08-07T05:54:42.346788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.331347Z","title":"Dense text-to-image generation with attention modulation","venue":null,"work_id":"3cc091ed-530a-4994-b841-276f7c733bac","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.657495Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:9d61d02c35f68e7a98395da9c93ebcfd833a4392c754d71623cd91da2a3546e9","observation_id":"c7547ae0-7f0c-4100-95b2-d7ae25e6aacf","resolution":{"observed_at":"2026-08-07T05:54:42.335324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.660443Z","title":"Auto-encoding variational bayes, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.660443Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:8ef6b9c304aa013a3204e16555ffe618fba70b5dfb0d50afbb767a76fd678928","observation_id":"e26dfa68-bce1-4c9e-9b8a-9f921ac150e1","resolution":{"observed_at":"2026-08-07T05:54:41.660443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.663699Z","title":"Segment anything","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.663699Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:2baf6afb3a670f77b5934bb7123e1266237b7ec6a7e3fd68d54a7d23b9954b67","observation_id":"d7dafdb3-97b3-476e-90a5-2d0229d5512c","resolution":{"observed_at":"2026-08-07T05:54:41.663699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.308446Z","title":"o hler, Christian Schuler, Bernhard Sch \\","venue":null,"work_id":"986298ec-65dc-4e75-a3c7-2817885c9d17","year":2014},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.666782Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:8f21bf7dd2e7954c1700c7beed56ca339d91f37101587609ee529a8a90368c25","observation_id":"ddce91d7-8351-470b-9e66-d498b28b8f2d","resolution":{"observed_at":"2026-08-07T05:54:42.311815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.298480Z","title":"Kuaishou unveils proprietary video generation model 'kling'","venue":null,"work_id":"08605a55-6288-49b4-81be-ed5afbad21e5","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.669974Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:f8d82aa75cccc7391d415c2146fcf37e6815268e8b59e37d2190494f6c8c58ca","observation_id":"feedae91-8c63-4fc9-85e4-092822a90c06","resolution":{"observed_at":"2026-08-07T05:54:42.302012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.288027Z","title":"Flux.1 [dev]","venue":null,"work_id":"a87341a0-b479-48e3-8f89-81368e99ad81","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.672951Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:682be7bb2858aff7c6674c224160d836c20e5caa56a2cd9be84429f2f794faec","observation_id":"92480f6c-b441-4bf2-a92e-d823a3384506","resolution":{"observed_at":"2026-08-07T05:54:42.291527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.277942Z","title":null,"venue":null,"work_id":"8fb73eba-f311-4c74-9420-138d69422f62","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.676144Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:5aa936e4f8f0737258ec19449b98d38e99e43d90b60023f7e7f0ab1aeafb9790","observation_id":"3cf7a701-e983-4e6a-bb70-78f472e0966f","resolution":{"observed_at":"2026-08-07T05:54:42.281429Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.267030Z","title":"Context-aware synthesis and placement of object instances","venue":null,"work_id":"dbc1dae7-4a47-43f8-8f22-0e41841eae0e","year":2018},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.679202Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:a7becdc666e64644f8dec1b34850432ec666fe9219aaea4184b5bf2d91a171e0","observation_id":"57b75549-3e03-4ccf-bd1d-19d5d6d1252d","resolution":{"observed_at":"2026-08-07T05:54:42.270996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.256037Z","title":"Layerdiffusion: Layered controlled image editing with diffusion models","venue":null,"work_id":"a8a537ed-2d28-41e5-9f83-b823be1b413b","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.682081Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:44dc5657e921012bbbf34e976aa9f38987c33ad775f99659d13a7b17ff2d6033","observation_id":"3a38e6fc-55b1-46e6-866b-c0ac8e09cd1a","resolution":{"observed_at":"2026-08-07T05:54:42.259766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.245558Z","title":"Mt-gan: toward realistic image composition based on spatial features","venue":null,"work_id":"d0614c63-6768-411b-8c71-35d7e2303e74","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.685287Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:18a779b5dcf8725faa266174271c04ef22f17a97707490a0bd67b604d7051cf8","observation_id":"2a54b398-2597-45d4-aabf-a8f338277591","resolution":{"observed_at":"2026-08-07T05:54:42.249323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T05:54:41.688572Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.688572Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:a7035c326a4e3cbdaecbaed130621888f35ff4a10a45983a35079ece0fdfc55f","observation_id":"57312b3f-d82d-48b8-8900-04aff4faf300","resolution":{"observed_at":"2026-08-07T05:54:41.688572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.234574Z","title":"Image inpainting for irregular holes using partial convolutions","venue":null,"work_id":"d159b5e2-ad78-4cd4-a3cc-2be51e29ed82","year":2018},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.692193Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:5734445c7ed41fa7053109582b3e7b474411db95ea0db7444e70d916cfc0150f","observation_id":"61867c1d-f6b2-46d4-8b0f-7aee92b97f2c","resolution":{"observed_at":"2026-08-07T05:54:42.238359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20280","last_updated":"2024-10-26T21:12:32Z","snapshot_observed_at":"2026-07-06T19:40:12.973874Z","submitted_at":"2024-10-26T21:12:32Z","title":"MarDini: Masked Autoregressive Diffusion for Video Generation at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20280","snapshot_observed_at":"2026-08-07T05:54:41.695472Z","title":"Mardini: Masked autoregressive diffusion for video generation at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.695472Z"},"links":{"cited_paper":"/paper/2410.20280","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:85a1a12be0a14328c8914536aff28abfa550322b378ce0adfcc5350d203b76e5","observation_id":"141567d3-d732-4661-8fad-0912920fecb9","resolution":{"observed_at":"2026-08-07T05:54:41.695472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.223862Z","title":"Diffpop: Plausibility-guided object placement diffusion for image composition","venue":null,"work_id":"c752a560-a2d6-46fa-aea3-75a573713896","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.698894Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:3c15e2638cb8255133927aaecf56617f3c643040e14c6c2f7641508150df59be","observation_id":"0e421cde-1b84-4b88-94cb-4ec75163e71b","resolution":{"observed_at":"2026-08-07T05:54:42.227537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-08-07T05:54:41.701802Z","title":"Step1x-edit: A practical framework for general image editing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.701802Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:3ae49d16f7d3d5c2d02deee24e0c5137555ca8aff2c1f262774588e7b03bfaff","observation_id":"c5c04562-cf32-4c74-9092-7469807673db","resolution":{"observed_at":"2026-08-07T05:54:41.701802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.212287Z","title":"Directed diffusion: Direct control of object placement through attention guidance","venue":null,"work_id":"8ddfc057-18f8-4198-930f-d0e6802f01b2","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.705201Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:fe4f6e7f840c315450e356300af048f12d3f6a77cddf87b3f31e6d7cbd452465","observation_id":"6a7425a3-5da8-4c08-906f-c5557d15dae3","resolution":{"observed_at":"2026-08-07T05:54:42.216754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.708387Z","title":"Null-text inversion for editing real images using guided diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.708387Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:41c552200f3e0a03913cc6d782ea0f615aa977eda3623680dc2b989d960d446c","observation_id":"a13828ed-edbc-4243-949e-67f68bbbe8d6","resolution":{"observed_at":"2026-08-07T05:54:41.708387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.195851Z","title":"Intelligent scissors for image composition","venue":null,"work_id":"045da0fd-1aa2-482f-b4ac-ea875cf794f5","year":1995},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.711574Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:563f18da5313283c1ad9d20e5226beeb875679983a36bb7437fa20a6ea25c0de","observation_id":"cc3360f5-8d2c-4ec4-b9a5-57e4aaa31ace","resolution":{"observed_at":"2026-08-07T05:54:42.199383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.715058Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.715058Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:6982be84f261de38f7ebc976e7fb2466e61c40ec8040ba59b9278e2b3e974a23","observation_id":"148ebdb7-6825-42dc-b3ce-1756929de76b","resolution":{"observed_at":"2026-08-07T05:54:41.715058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.178654Z","title":"Understanding the latent space of diffusion models through the lens of riemannian geometry","venue":null,"work_id":"33c30635-df4e-4e72-a976-58602c82d601","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.718376Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:f543235cf8d4da89f00ee26a0f6801b50fea2f93364a631ca9aa328facb9f4fd","observation_id":"cb3a8ada-4db7-4545-aa3f-fab94cda353e","resolution":{"observed_at":"2026-08-07T05:54:42.182317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.721778Z","title":"Context encoders: Feature learning by inpainting","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.721778Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:b1bb95f053cf8ef9babbb0e2e219376a6cd5ddaf7cd09f7a06d7cf8e056fe1da","observation_id":"fa1d4024-6f5a-47dc-9cc7-3cb387776a68","resolution":{"observed_at":"2026-08-07T05:54:41.721778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.161352Z","title":"Grounded text-to-image synthesis with attention refocusing","venue":null,"work_id":"71f907b4-df88-4dd8-86c4-edffdd5b7554","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.725119Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:8f9696344a93b547172974656cd13ba77a37e7576d281ae1971862bf31cb76b4","observation_id":"22244d90-b74f-4e7d-9dee-2578d27685de","resolution":{"observed_at":"2026-08-07T05:54:42.165312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.149961Z","title":"Deadiff: An efficient stylization diffusion model with disentangled representations","venue":null,"work_id":"c41e771f-3866-4c1b-a89f-05347cc8729c","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.728199Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:70e6be3a6d5f475ebc16da0126383d9392fd8f51b63e8a7790c642e54aed69f2","observation_id":"740e2af0-01b0-499e-a332-4656633327f5","resolution":{"observed_at":"2026-08-07T05:54:42.153765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11147","last_updated":"2023-11-02T17:59:06Z","snapshot_observed_at":"2026-08-06T14:12:33.767391Z","submitted_at":"2023-05-18T17:41:34Z","title":"UniControl: A Unified Diffusion Model for Controllable Visual Generation In the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11147","snapshot_observed_at":"2026-08-07T05:54:41.731278Z","title":"Unicontrol: A unified diffusion model for controllable visual generation in the wild","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.731278Z"},"links":{"cited_paper":"/paper/2305.11147","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:115887b7edcbdf6db580a86782aed7106333f9d88debcf80b593f777effd6440","observation_id":"d06f9419-645f-45c9-9975-5a1cdcf8ffed","resolution":{"observed_at":"2026-08-07T05:54:41.731278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.734633Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.734633Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:dae2021721e4c903c22a5a2c391861497af0790cbd7220a235ba7121f0d9f27e","observation_id":"a6aa0691-ac95-4374-b461-641133f36b12","resolution":{"observed_at":"2026-08-07T05:54:41.734633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.738601Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.738601Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:abe006d0886f805a09ec22d95e7b1180fe622c2cc3fde746732fa9c2b45a06fa","observation_id":"6585b1df-9b08-40d2-af2e-1806c823a17e","resolution":{"observed_at":"2026-08-07T05:54:41.738601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10792","last_updated":"2024-10-14T17:56:24Z","snapshot_observed_at":"2026-08-02T16:03:59.021980Z","submitted_at":"2024-10-14T17:56:24Z","title":"Semantic Image Inversion and Editing using Rectified Stochastic Differential Equations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10792","snapshot_observed_at":"2026-08-07T05:54:41.742210Z","title":"Semantic image inversion and editing using rectified stochastic differential equations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.742210Z"},"links":{"cited_paper":"/paper/2410.10792","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:08e3c30f9b0e8c8efd125b7dd159f270ac531738ba920a06921e13eeb3ed20db","observation_id":"85389a90-a42d-4bab-9ba1-2cc4e6a851dd","resolution":{"observed_at":"2026-08-07T05:54:41.742210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:41.745794Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.745794Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:7e0ddbf62c70cdfcf9927b919d735aa2bf89d9b1a28d89216d8681246a5241f2","observation_id":"de7013f0-8a47-40fe-9904-4e71c4934e1f","resolution":{"observed_at":"2026-08-07T05:54:41.745794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T05:54:41.749042Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.749042Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:cb087426bbcceb6a264209780172c256327ac2a9f101f80562fcc4a1dc87efe3","observation_id":"bd87cd26-a60a-4e56-9ec6-28a9ddb68799","resolution":{"observed_at":"2026-08-07T05:54:41.749042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-07T05:54:41.752302Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.752302Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:d55655f809268743c0f330e9400aecd9ce87ea55b98dd8b73ca39bc0d7240e22","observation_id":"d778a17a-f709-4ab6-b318-dd3560d759e6","resolution":{"observed_at":"2026-08-07T05:54:41.752302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.119446Z","title":"Parasol: Parametric style control for diffusion image synthesis","venue":null,"work_id":"b7222c2e-ac6f-4256-be29-fbdc25be9f23","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.755542Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:52a44e84efe1fabcd71af38aeeba7b9c31f7aab14c09d75d977574730664ac99","observation_id":"745a0bc0-7212-4fd0-9da8-bd1165121dc8","resolution":{"observed_at":"2026-08-07T05:54:42.123302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07232","last_updated":"2024-11-12T07:49:39Z","snapshot_observed_at":"2026-08-06T03:09:10.188671Z","submitted_at":"2024-11-11T18:50:09Z","title":"Add-it: Training-Free Object Insertion in Images With Pretrained Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07232","snapshot_observed_at":"2026-08-07T05:54:41.758667Z","title":"Add-it: Training-free object insertion in images with pretrained diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.758667Z"},"links":{"cited_paper":"/paper/2411.07232","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:5f033d7e73d65b360382e954422e072390461ece7c3595b283ab89c886ca0af1","observation_id":"1a09ddf0-2200-4c8a-baae-189bf15fdb27","resolution":{"observed_at":"2026-08-07T05:54:41.758667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.108926Z","title":"Towards effective usage of human-centric priors in diffusion models for text-based human image generation","venue":null,"work_id":"32ec3666-a96e-422f-94e9-001dd30e0020","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.762090Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:0aeeb9392af8b9b28b51cd1a2ed0ec1569ba1c22fa97fffebac3f8bf0b29741a","observation_id":"8abcf8e1-4e11-4a33-9cdb-0f8b3044170b","resolution":{"observed_at":"2026-08-07T05:54:42.112816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.098671Z","title":"Stylediffusion: Controllable disentangled style transfer via diffusion models","venue":null,"work_id":"8ee46377-154e-4906-8517-486e0ecd1fc3","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.765269Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:34ddba75dee49f08cf28c5c04ba6e7e959ae862270f68b231ec252348fa29697","observation_id":"bb84141d-9300-4ff2-94b1-0d8685b6bd36","resolution":{"observed_at":"2026-08-07T05:54:42.102069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.088454Z","title":"Tokencompose: Text-to-image diffusion with token-level supervision","venue":null,"work_id":"b83d77bf-bf5b-4cd9-a441-ed7374a55d69","year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.768745Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:6bc24dddba62eb77af475cee83ec0904d6c6b21c0216356b6622cfa713f793e2","observation_id":"a14bdc14-0ffa-4f3e-a68a-c5838f2da39b","resolution":{"observed_at":"2026-08-07T05:54:42.092167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.077180Z","title":"Uncovering the disentanglement capability in text-to-image diffusion models","venue":null,"work_id":"16f78d32-c63e-4ec9-90ff-85298a18b1f1","year":1900},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.772124Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:ee78ed0abf3c68d67ede5f0dea01d393bf4773594d79a119eee7f2aa7f661b14","observation_id":"ed390ec3-120b-4758-ad5b-fc8719bc20bc","resolution":{"observed_at":"2026-08-07T05:54:42.081287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.066342Z","title":"Deep convolutional neural network for image deconvolution","venue":null,"work_id":"9950fbc1-33e3-4017-88c7-09e9a474f519","year":2014},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.775459Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:894dd2c3e371a49d501fcc8cc8de776cd902c5e49c671a7d3dede7b0490eaa1b","observation_id":"accbf321-a149-4c81-9635-22a348f254ec","resolution":{"observed_at":"2026-08-07T05:54:42.070104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.055146Z","title":"Attngan: Fine-grained text to image generation with attentional generative adversarial networks","venue":null,"work_id":"b98880ec-6192-487d-93bf-57ae6788c7e0","year":2018},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.778508Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:bf876ec1acd28a6833ce9adfaf369fb568e8250c5dedcb2f61d7bf1fd5dd11c2","observation_id":"59cc709f-691e-47b4-83e9-f7f84633e9f1","resolution":{"observed_at":"2026-08-07T05:54:42.058895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.044124Z","title":"Dynamic prompt learning: Addressing cross-attention leakage for text-based image editing","venue":null,"work_id":"0bc5b115-3afe-4ed1-bc0d-3550d8223913","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.781531Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:40dcbc3cd5d037209a0fd9eabf06f971352881a6fbcba870d63c68579bee44be","observation_id":"1bde4031-f263-40fd-8b21-d6806516e025","resolution":{"observed_at":"2026-08-07T05:54:42.047995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-07T05:54:41.784685Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models.(2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.784685Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:53861b9fecca00fb4098bdddc9e7dc09339980c7a7b91215a9243230672eb47d","observation_id":"6675dd94-d1dc-4de3-8644-d4a835c910ad","resolution":{"observed_at":"2026-08-07T05:54:41.784685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.031758Z","title":"Semantic image inpainting with deep generative models","venue":null,"work_id":"939df083-ae94-48a9-8d4a-a4e3e3c33a0c","year":2017},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.788224Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:ce976d037592c45005e602f2430225f2f04e2ff66d652287f732bba4319ef6d3","observation_id":"fdaeaade-c94a-4e4a-90f2-2bb6fe0503d9","resolution":{"observed_at":"2026-08-07T05:54:42.035646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.020482Z","title":"Generative image inpainting with contextual attention","venue":null,"work_id":"3b8b0265-8d08-41a5-a49c-daf7f5a6f5ca","year":2018},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.791461Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:a759b3b5a5a9a26590cc43bd7419b80d2305718ad858ba2984126806ababfa60","observation_id":"65a1e9f5-c12d-4529-a17b-fee1df272199","resolution":{"observed_at":"2026-08-07T05:54:42.024412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11430","last_updated":"2024-01-21T08:35:25Z","snapshot_observed_at":"2026-07-06T17:18:24.209069Z","submitted_at":"2024-01-21T08:35:25Z","title":"Exploring Diffusion Time-steps for Unsupervised Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11430","snapshot_observed_at":"2026-08-07T05:54:41.794804Z","title":"Exploring diffusion time-steps for unsupervised representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.794804Z"},"links":{"cited_paper":"/paper/2401.11430","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:dd87a98de21813fd2f287b96377b17670ec362be08c0a094d5c53254ac4df737","observation_id":"d7a1635d-f20c-47bd-8fe3-c16760be4d50","resolution":{"observed_at":"2026-08-07T05:54:41.794804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:54:42.009241Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"4d628d8f-e54c-4577-a0b9-2f5a0cfc1347","year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.798109Z"},"links":{"citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:ac6dfe83cfb38c4ad384a989e45f798576a45fa1a188d56f9ceee2d52c0c3166","observation_id":"ad04b77d-2dc1-4c8c-8f61-7eecbabb2328","resolution":{"observed_at":"2026-08-07T05:54:42.013157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13077","last_updated":"2023-05-22T14:48:53Z","snapshot_observed_at":"2026-08-07T10:11:05.104768Z","submitted_at":"2023-05-22T14:48:53Z","title":"ControlVideo: Training-free Controllable Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13077","snapshot_observed_at":"2026-08-07T05:54:41.801190Z","title":"Controlvideo: Training-free controllable text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T05:54:41.801190Z"},"links":{"cited_paper":"/paper/2305.13077","citing_paper":"/paper/2506.06826"},"observation_digest":"sha256:48f5ceb772181a993a663ced04bc9e2d45b838178801e6c58a568431050e05bb","observation_id":"3cd75832-ee52-4205-a91f-c9d317662a89","resolution":{"observed_at":"2026-08-07T05:54:41.801190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06826","last_updated":"2025-06-07T15:09:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:46:19.364805Z","submitted_at":"2025-06-07T15:09:08Z","title":"Controllable Coupled Image Generation via Diffusion Models"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":38},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2506.06826."}