{"as_of":"2026-08-08T06:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:20998a87ec8f388a1822e97beffb94430213a9a3045c3f8482f6c254a1dde95d","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:26:31.248399Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T19:54:47.490062Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T21:00:08.960735Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02528","snapshot_observed_at":"2026-08-03T19:54:47.490062Z","title":"Relationadapter: Learning and transferring vi- sual relation with diffusion transformers.arXiv preprint arXiv:2506.02528, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.22098","last_updated":"2026-07-16T03:47:27Z","snapshot_observed_at":"2026-08-03T19:54:46.253087Z","submitted_at":"2025-11-27T04:40:37Z","title":"WorldWander: Bridging Egocentric and Exocentric Worlds in Video Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T19:54:47.490062Z"},"links":{"cited_paper":"/paper/2506.02528","citing_paper":"/paper/2511.22098"},"observation_digest":"sha256:35024d757010694caa1182c414423747d2e9bd8bb779aa3c878e7b5efa52c449","observation_id":"df5cc13a-d604-40a9-9119-28f9617c8ded","resolution":{"observed_at":"2026-08-03T19:54:47.490062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2506.02528","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02528","snapshot_observed_at":"2026-07-04T21:00:08.960735Z","title":"Relationadapter: Learning and transferring visual relation with diffusion transformers","venue":null,"work_id":"49b2a563-4863-4c8d-816c-0de6098d2c98","year":2025},"citing_paper":{"arxiv_id":"2605.17019","last_updated":"2026-05-16T14:45:32Z","snapshot_observed_at":"2026-07-06T23:28:06.971959Z","submitted_at":"2026-05-16T14:45:32Z","title":"StreamingEffect: Real-Time Human-Centric Video Effect Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T20:11:47.359922Z"},"links":{"cited_paper":"/paper/2506.02528","citing_paper":"/paper/2605.17019"},"observation_digest":"sha256:63cbc2a1ac6ffae784c4fc58a79525fff88eff1d20667946ee550a1d3b7212a7","observation_id":"a1449e96-b8bd-4110-94e1-2fbd95d8502b","resolution":{"observed_at":"2026-05-19T20:12:44.741376Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2506.02528","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02528","snapshot_observed_at":"2026-07-04T21:00:08.960735Z","title":"Relationadapter: Learning and transferring visual relation with diffusion transformers","venue":null,"work_id":"49b2a563-4863-4c8d-816c-0de6098d2c98","year":2025},"citing_paper":{"arxiv_id":"2605.17312","last_updated":"2026-05-17T08:03:53Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T08:03:53Z","title":"VISTA: Triplet-Supervised Video Style Transfer with Diffusion Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T14:14:41.662856Z"},"links":{"cited_paper":"/paper/2506.02528","citing_paper":"/paper/2605.17312"},"observation_digest":"sha256:988957e5cd078ed5a2ca718a695d03842d22e23343d8caba110c2adeb1444e69","observation_id":"c4940a23-4c0d-46f0-9344-4c44d7c9aed7","resolution":{"observed_at":"2026-05-20T14:18:21.356872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2506.02528","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02528","snapshot_observed_at":"2026-07-04T21:00:08.960735Z","title":"Relationadapter: Learning and transferring visual relation with diffusion transformers","venue":null,"work_id":"49b2a563-4863-4c8d-816c-0de6098d2c98","year":2025},"citing_paper":{"arxiv_id":"2605.19319","last_updated":"2026-05-19T03:54:46Z","snapshot_observed_at":"2026-08-02T08:21:58.883943Z","submitted_at":"2026-05-19T03:54:46Z","title":"SWEET: Sparse World Modeling with Image Editing for Embodied Task Execution","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T07:04:24.854846Z"},"links":{"cited_paper":"/paper/2506.02528","citing_paper":"/paper/2605.19319"},"observation_digest":"sha256:2cc140d9f2a7002367b31a5b2d053eff21bd105a32712b44454cb1a5133ab626","observation_id":"017e772e-181b-478d-be57-999c9dae427d","resolution":{"observed_at":"2026-05-20T07:08:07.203306Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2506.02528","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02528","snapshot_observed_at":"2026-07-04T21:00:08.960735Z","title":"Relationadapter: Learning and transferring visual relation with diffusion transformers","venue":null,"work_id":"49b2a563-4863-4c8d-816c-0de6098d2c98","year":2025},"citing_paper":{"arxiv_id":"2606.26092","last_updated":"2026-07-03T12:28:57Z","snapshot_observed_at":"2026-08-02T05:18:16.697250Z","submitted_at":"2026-06-24T17:59:06Z","title":"TryOnCrafter: Unleashing Camera Trajectories for Realistic Video Virtual Try-on via a Renderable 4D Try-on Proxy","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-25T19:20:45.217627Z"},"links":{"cited_paper":"/paper/2506.02528","citing_paper":"/paper/2606.26092"},"observation_digest":"sha256:64db8445966d2076b6bf763e4e15b26b9b0b6d7e755f5c60345aa88755600896","observation_id":"cd800ed7-9c54-4bc0-b297-a112e4c960da","resolution":{"observed_at":"2026-07-04T21:00:08.962307Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02528","snapshot_observed_at":"2026-07-12T12:05:10.800662Z","title":"arXiv preprint arXiv:2506.02528 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26092","last_updated":"2026-07-03T12:28:57Z","snapshot_observed_at":"2026-08-02T05:18:16.697250Z","submitted_at":"2026-06-24T17:59:06Z","title":"TryOnCrafter: Unleashing Camera Trajectories for Realistic Video Virtual Try-on via a Renderable 4D Try-on Proxy","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T12:05:10.800662Z"},"links":{"cited_paper":"/paper/2506.02528","citing_paper":"/paper/2606.26092"},"observation_digest":"sha256:f61d36d1480775fce7a093d8d53973f6c1dbaf7a408753804639e3cc83f90304","observation_id":"997ff181-f4d9-47b1-9a52-543d5e44ffd1","resolution":{"observed_at":"2026-07-12T12:05:10.800662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2506.02528","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02528","snapshot_observed_at":"2026-07-04T21:00:08.960735Z","title":"Relationadapter: Learning and transferring visual relation with diffusion transformers","venue":null,"work_id":"49b2a563-4863-4c8d-816c-0de6098d2c98","year":2025},"citing_paper":{"arxiv_id":"2606.29308","last_updated":"2026-06-28T10:07:38Z","snapshot_observed_at":"2026-07-07T00:03:16.968118Z","submitted_at":"2026-06-28T10:07:38Z","title":"MirrorPPR: Exemplar-Based Portrait Photo Retouching","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T07:50:25.117845Z"},"links":{"cited_paper":"/paper/2506.02528","citing_paper":"/paper/2606.29308"},"observation_digest":"sha256:9807eb256510b8fd005c32a5c46d1464f7a0140696dd126c280950729c9941a3","observation_id":"1de58fa4-05cd-4812-b226-df6adb71cc14","resolution":{"observed_at":"2026-06-30T07:54:22.094711Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02528/citation-record","integrity":"/paper/2506.02528/integrity","json":"/paper/2506.02528/citation-record.json","paper":"/paper/2506.02528"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:36.272919Z","title":"Flux: Official inference repository for flux.1 models","venue":null,"work_id":"b2303cc3-62a2-4f7e-90b4-fe50d556b156","year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:25.503759Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:739888785758e74134641b1ca4d459a3667c3d6208d076dae5cfcc2c6f977452","observation_id":"a310153a-8271-4e45-81c3-95c41f1e41c0","resolution":{"observed_at":"2026-08-07T11:26:36.319170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:36.104314Z","title":"Flux.1-dev: A 12b parameter rectified flow transformer for text-to-image generation","venue":null,"work_id":"7f09d684-058b-44bb-b367-157721dcca5a","year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:25.577765Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:50dd91b0e7be6eb0b539601bf41faf5105bc524e164eb661a6063d1fabceca4f","observation_id":"70770c67-1c34-4fc1-9507-b4d288d6fb0d","resolution":{"observed_at":"2026-08-07T11:26:36.221934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:35.831014Z","title":"Flux.1 redux-dev","venue":null,"work_id":"13a18a42-9e72-4ae9-b0d5-cc2bb54150dc","year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:25.642200Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:60c7483e8423650998771843d22da57fa8b3238bf0e66ef1723278f8b2187ffa","observation_id":"8ccc135a-053c-4dc6-ac9d-041e39f79a66","resolution":{"observed_at":"2026-08-07T11:26:35.945195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:25.718579Z","title":"Instructpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:25.718579Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:9a27f21804fa52f80701d97d7dddca5c23967f8355d13b9cdbd05cb6512b5ddf","observation_id":"76754b25-7c54-455f-b5da-624931d8228b","resolution":{"observed_at":"2026-08-07T11:26:25.718579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:25.794555Z","title":"Masactrl: Tuning-free mutual self-attention control for consistent image synthesis and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:25.794555Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:c41ce5b9e75e114272a86ff989a91ae08123325bb61ee265de38b6e3435d058e","observation_id":"260b2e52-8a14-449e-83dc-e00838354ce2","resolution":{"observed_at":"2026-08-07T11:26:25.794555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13327","last_updated":"2025-07-01T12:30:24Z","snapshot_observed_at":"2026-08-08T01:07:38.124750Z","submitted_at":"2025-03-17T16:04:44Z","title":"Edit Transfer: Learning Image Editing via Vision In-Context Relations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13327","snapshot_observed_at":"2026-08-07T11:26:25.872473Z","title":"Edit transfer: Learning image editing via vision in-context relations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:25.872473Z"},"links":{"cited_paper":"/paper/2503.13327","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:52e0f103668c6ce641f2ad2ad1f9d58a67a1ee9df5bda119a6d56038a59433af","observation_id":"bf585d37-4e1a-45a5-9dfb-c19b35ed685c","resolution":{"observed_at":"2026-08-07T11:26:25.872473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:35.667275Z","title":"Ringid: Rethinking tree-ring watermarking for enhanced multi-key identification","venue":null,"work_id":"79443684-3a84-408a-9dec-3a84f4969033","year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:25.954693Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:b068392a4caeeac7de04509007a130e77a5b38d9846bfa86138448fabe8a3b17","observation_id":"caf7f31f-6af9-4073-9bf9-293f0fa33b41","resolution":{"observed_at":"2026-08-07T11:26:35.735335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:35.488318Z","title":"Video demoireing with relation-based temporal consistency","venue":null,"work_id":"1b3263d2-f0f9-4eea-acf1-82484c4b929f","year":2022},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:25.994644Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:0f64789eed5725d303c91ff2f615ecc12ec06dd3c0cd3067999b63ed819b4acf","observation_id":"27442a58-4f25-4067-bab7-a4c340f16deb","resolution":{"observed_at":"2026-08-07T11:26:35.595400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:35.313979Z","title":"The cube++ illumination estimation dataset","venue":null,"work_id":"51baf552-692b-44ce-80fe-5833a39c42ac","year":2020},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.064372Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:0dbf6710d2bf6e1ca9d3e9bdb2fc7541492ce7025ec9e3fa989655952375ccfc","observation_id":"9e73cc68-f07c-40a1-97ad-8e0dc4a05fee","resolution":{"observed_at":"2026-08-07T11:26:35.426601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:35.167705Z","title":"Geometric representation learning for document image rectification","venue":null,"work_id":"ca29865d-976a-49e9-8885-7115cc888e79","year":2022},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.145803Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:6aa268462b333f019c99f7debac31fbc2f3d5c2f28636c9cd44138f4a2a8f99c","observation_id":"05c80204-00ab-4742-b650-3213580a0e36","resolution":{"observed_at":"2026-08-07T11:26:35.245083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:34.994451Z","title":"Concept sliders: Lora adaptors for precise control in diffusion models","venue":null,"work_id":"0bea731a-bfd2-4645-8d72-02e60a50daf1","year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.195129Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:a263769cfe33753e3f0f53dbcc50a3c8ace0f1b5a6df1d03bf36d78ae52f3eb2","observation_id":"f83ab52a-7c07-407e-99d8-eb6038014a9e","resolution":{"observed_at":"2026-08-07T11:26:35.071299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15891","last_updated":"2025-03-26T02:08:33Z","snapshot_observed_at":"2026-07-06T20:26:37.280206Z","submitted_at":"2025-01-27T09:33:23Z","title":"Any2AnyTryon: Leveraging Adaptive Position Embeddings for Versatile Virtual Clothing Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15891","snapshot_observed_at":"2026-08-07T11:26:26.252338Z","title":"Any2anytryon: Leveraging adaptive position embeddings for versatile virtual clothing tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.252338Z"},"links":{"cited_paper":"/paper/2501.15891","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:bd1bb1ebabb5c137ddd9479c9662b063588b503a0a9f51a8bfe6486bf2e85539","observation_id":"2faeb9cd-0ad5-427e-b92d-b4db75a6e7e6","resolution":{"observed_at":"2026-08-07T11:26:26.252338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:34.868511Z","title":"From sky to the ground: A large-scale benchmark and simple baseline towards real rain removal","venue":null,"work_id":"967ae100-438b-4e95-ae73-b45354c3270a","year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.362249Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:befe069833c1ea0de4bde76b84f2ec2116d500d91ab39d0ca43f655b0f1ef7ee","observation_id":"2ff2661a-d827-4ef5-8a63-e36e26b3da65","resolution":{"observed_at":"2026-08-07T11:26:34.920211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-07T11:26:26.421202Z","title":"Prompt-to- prompt image editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.421202Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:e6990907f96a69bc118c9b4aa4cc9304559eba89f08fbfbbb179e72ff7d8b16e","observation_id":"f004abc8-9d7f-463a-9018-a182b8338906","resolution":{"observed_at":"2026-08-07T11:26:26.421202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:26.507655Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.507655Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:a3a1b20c05244a5ab42fc85acf3b895c52ea3648859c9fb49db816d9338144d6","observation_id":"65ae66d5-36b0-4221-8dfe-4fd6cd453bca","resolution":{"observed_at":"2026-08-07T11:26:26.507655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:26.581575Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.581575Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:9ceee27e31425e90e9695ddd35a8b20fd672076b349ae206b466a32368834b06","observation_id":"ccbc7202-c46f-434e-bdfe-292c1b95dcd7","resolution":{"observed_at":"2026-08-07T11:26:26.581575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14397","last_updated":"2025-02-23T06:30:46Z","snapshot_observed_at":"2026-08-07T18:02:32.083931Z","submitted_at":"2025-02-20T09:35:38Z","title":"PhotoDoodle: Learning Artistic Image Editing from Few-Shot Pairwise Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14397","snapshot_observed_at":"2026-08-07T11:26:26.633060Z","title":"Photodoodle: Learning artistic image editing from few-shot pairwise data.arXiv preprint arXiv:2502.14397, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.633060Z"},"links":{"cited_paper":"/paper/2502.14397","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:fed947902033c03e81e14d62355cd3667ad495d0a6726d1cb74568d87f763ac4","observation_id":"99ec8a21-4ba5-4c4e-897f-6707b727168a","resolution":{"observed_at":"2026-08-07T11:26:26.633060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:34.724313Z","title":"Humansd: A na- tive skeleton-guided diffusion model for human image generation","venue":null,"work_id":"792c93d2-91e3-48e8-8248-edb8126842e6","year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.707032Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:03483e4aa499abf35ec49f3d336bd2fc0b643b0650eafafbb20b479bf73e6196","observation_id":"8ef90e08-1b43-4de2-a3f1-96bf782f95be","resolution":{"observed_at":"2026-08-07T11:26:34.789002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:34.533701Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":"c8220da5-f5c4-4f04-b0fa-5312719ebb41","year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:26.906508Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:09e678714b1953e1cea708f25ad11ccd9be1b395b89cd89b5bcc10973bfd0a2c","observation_id":"6fc98b77-8af1-4bc2-97a1-d959ff2c51b2","resolution":{"observed_at":"2026-08-07T11:26:34.594054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:27.005581Z","title":"Auto-encoding variational bayes, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:27.005581Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:bdad7f4f0c3ae98f98a8322e39f8e9a5796cc20722d93efedbfc2c912992bab0","observation_id":"4354f44e-61dd-4907-8bc1-7064a3426859","resolution":{"observed_at":"2026-08-07T11:26:27.005581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:27.119746Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:27.119746Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:8a4c40e8d110da2074f570a8023bbe7f0778a175c6f30affb45d7efcbe883ef3","observation_id":"f2046233-0781-4d76-97e6-befd9a906b7b","resolution":{"observed_at":"2026-08-07T11:26:27.119746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:27.232631Z","title":"Visualcloze: A universal image generation framework via visual in-context learning.arXiv preprint arXiv:2504.07960, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:27.232631Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:23319d525a663185a3219f00e0b54f8f8c890f5f88eba930f018367c5f0e18e5","observation_id":"82c30e4b-73fa-4c4c-b69c-2b873b5822fb","resolution":{"observed_at":"2026-08-07T11:26:27.232631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:27.367235Z","title":"Exploring the limits of weakly supervised pretraining","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:27.367235Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:5a851b8a2c3abd37ea9a77c1646013bc5dd7b331fc63871d8124a636681fa814","observation_id":"2ad5b333-8a37-432c-b1c7-dc603c95e5fc","resolution":{"observed_at":"2026-08-07T11:26:27.367235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-07-06T11:34:54.333802Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-07T11:26:27.535923Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equations.arXiv preprint arXiv:2108.01073, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:27.535923Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:748a168ad2d4c9ed7615ccc5ed5d51c7cef14be27a8156f94ed0615ba7941c24","observation_id":"ec590b87-3435-4d1c-bbcb-bb69992a6727","resolution":{"observed_at":"2026-08-07T11:26:27.535923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:27.668185Z","title":"T2i- adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:27.668185Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:e68809bcebe861ee1cdc321487049ce092d036a11ecae8e315f001a7fde18004","observation_id":"e83759ad-13a5-47b0-9d42-fed66b85d8b0","resolution":{"observed_at":"2026-08-07T11:26:27.668185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:34.307624Z","title":"Deep multi-scale convolutional neural network for dynamic scene deblurring","venue":null,"work_id":"fc2b6aea-da09-4ce2-8a49-e1f6208aa721","year":2017},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:27.836599Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:c7b0af2e35bcb9dafb89e16aa1c4283f2bd30190a51806d1fe690c0db906aa9d","observation_id":"517b936b-c81c-4d9f-ac5b-5bff74d94d97","resolution":{"observed_at":"2026-08-07T11:26:34.368713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:34.180440Z","title":"Gpt-4o technical report","venue":null,"work_id":"9d0fb8a4-e35d-46c6-bbfe-78e8cd451a05","year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:27.966603Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:d42eb05ae54506aa8035da7632ad94bee411c114abb4ed2d87d799d61b1a137c","observation_id":"69367777-eb1f-45ee-8472-bfd5d56b5c4e","resolution":{"observed_at":"2026-08-07T11:26:34.221356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","snapshot_observed_at":"2026-07-06T09:54:02.091694Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04107","snapshot_observed_at":"2026-08-07T11:26:28.052890Z","title":"Multi-modal attention for speech emotion recognition","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.052890Z"},"links":{"cited_paper":"/paper/2009.04107","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:11c30f9b170e38d8e04fa72bac9101156c337ea52b9b0e0cff39a700b503ee88","observation_id":"70218a74-fba3-4563-817a-34557ad3eb31","resolution":{"observed_at":"2026-08-07T11:26:28.052890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:28.104561Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.104561Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:1b9d6aec2e87f7637ea468e6a0d4d29544b1b028a2df443fac399d0dee04f361","observation_id":"4cff08b8-a17a-4ab1-bf9a-b2c4b6df10c2","resolution":{"observed_at":"2026-08-07T11:26:28.104561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:34.040035Z","title":"Ntire 2021 challenge on high dynamic range imaging: Dataset, methods and results","venue":null,"work_id":"4a319664-68cc-465b-993a-1a98305d9401","year":2021},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.153472Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:1b574e047f1e544b8ba9667b8db81757a1203df04a655ad9ecf2d45b028fd0d7","observation_id":"d4056f61-c66a-49b6-bf12-618a7ef6e978","resolution":{"observed_at":"2026-08-07T11:26:34.110740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:33.869747Z","title":"Dense extreme inception network: Towards a robust cnn model for edge detection","venue":null,"work_id":"e0e43f5e-2b94-4f66-9eef-8bc1e653c430","year":1923},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.204667Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:e940dc95d878a2e94457b30ce477de0c817e024c515f2392493ee326c289367d","observation_id":"af979b9c-851e-42fe-b7a4-b1dda2ed31f2","resolution":{"observed_at":"2026-08-07T11:26:33.952402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:28.269032Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.269032Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:e741f71036b73138ff800176d15f7172c0e5b157e0eaaf5304cbd700b5b242e8","observation_id":"19c9f941-4ebc-42a4-8474-5b4b79288d75","resolution":{"observed_at":"2026-08-07T11:26:28.269032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-07T11:26:28.324295Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.324295Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:336400e36770d86cba02bdd4183e1b757648565c486a8d8a7c3f16e4d07abd9d","observation_id":"a3f481d8-6aea-40f0-bb8f-99b19c44ae5c","resolution":{"observed_at":"2026-08-07T11:26:28.324295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:28.386907Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.386907Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:087aa73487031c99af3e99c84f3b3e02bd4e2e94843d065a0e03136420c16f27","observation_id":"ea39b648-23ff-4acc-a5ad-5232cff0c637","resolution":{"observed_at":"2026-08-07T11:26:28.386907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:28.422715Z","title":"Dream- booth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.422715Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:37b02aff4edc34adb70d5f64d9272416bdbcf991fbce1d1be0660538cde9821c","observation_id":"733308b4-23e1-4538-8767-f079716599d4","resolution":{"observed_at":"2026-08-07T11:26:28.422715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:33.714518Z","title":"Schönberger, Silvano Galliani, Torsten Sattler, Konrad Schindler, Marc Pollefeys, and Andreas Geiger","venue":null,"work_id":"255d9510-6303-455a-bd7e-562fd3b82fe8","year":2017},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.458054Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:c079e43c89ef300293657f583336d80954a97756441c62d7965a9814903b0e01","observation_id":"4d8f41e9-81d6-4a4c-a2f0-87919bb3a0d8","resolution":{"observed_at":"2026-08-07T11:26:33.752496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00136","last_updated":"2025-07-11T09:19:13Z","snapshot_observed_at":"2026-08-02T05:19:20.505310Z","submitted_at":"2024-11-28T16:19:37Z","title":"FonTS: Text Rendering with Typography and Style Controls","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00136","snapshot_observed_at":"2026-08-07T11:26:28.536012Z","title":"Fonts: Text rendering with typography and style controls","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.536012Z"},"links":{"cited_paper":"/paper/2412.00136","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:9472d71aae271a10aaac11c1da16347f16777c2e33f1863dfec9498c8b94b191","observation_id":"72fc49d9-d2d2-4f95-a5db-5b4a877d0a54","resolution":{"observed_at":"2026-08-07T11:26:28.536012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15009","last_updated":"2025-04-21T10:19:12Z","snapshot_observed_at":"2026-08-07T16:00:37.570235Z","submitted_at":"2025-04-21T10:19:12Z","title":"Insert Anything: Image Insertion via In-Context Editing in DiT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15009","snapshot_observed_at":"2026-08-07T11:26:28.644520Z","title":"Insert anything: Image insertion via in-context editing in dit","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.644520Z"},"links":{"cited_paper":"/paper/2504.15009","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:bc71e94d1b8c50b38238495290bd298e73211d1d128aa36022d88a90fcf4bfdc","observation_id":"c05e11b5-fc5f-4a57-8e49-006855fd60a3","resolution":{"observed_at":"2026-08-07T11:26:28.644520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01105","last_updated":"2025-08-13T17:32:12Z","snapshot_observed_at":"2026-07-06T20:30:02.903743Z","submitted_at":"2025-02-03T06:49:58Z","title":"LayerTracer: Cognitive-Aligned Layered SVG Synthesis via Diffusion Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01105","snapshot_observed_at":"2026-08-07T11:26:28.703173Z","title":"Layertracer: Cognitive-aligned layered svg synthesis via diffusion transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.703173Z"},"links":{"cited_paper":"/paper/2502.01105","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:d8246d3034cad6940f42a05327d25b98f790613fae520ffbacc9d88712dcfc10","observation_id":"8d076f13-d7f5-4d56-8eba-0d4e75ff391c","resolution":{"observed_at":"2026-08-07T11:26:28.703173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06062","last_updated":"2024-07-20T07:23:19Z","snapshot_observed_at":"2026-08-08T04:08:29.615896Z","submitted_at":"2024-06-10T07:18:41Z","title":"ProcessPainter: Learn Painting Process from Sequence Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06062","snapshot_observed_at":"2026-08-07T11:26:28.863975Z","title":"Processpainter: Learn painting process from sequence data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.863975Z"},"links":{"cited_paper":"/paper/2406.06062","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:de6b929998fe930400f5d462227f9b2d7ba58adf2526d63ecd8fa53ab4390845","observation_id":"396b6781-cf80-4d0e-8524-a94f31c93592","resolution":{"observed_at":"2026-08-07T11:26:28.863975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-07-06T20:30:26.881629Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-07T11:26:28.950281Z","title":"Makeanything: Harnessing diffusion transformers for multi-domain procedural sequence generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.950281Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:1e7c7e289ce3a9a9c9610498a8faf747a04fe1ca02dcfed1d16855cca4924f2f","observation_id":"b82dea6b-4752-40b1-9b8d-7f4016464b36","resolution":{"observed_at":"2026-08-07T11:26:28.950281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18445","last_updated":"2025-05-24T01:00:20Z","snapshot_observed_at":"2026-08-07T14:29:02.939579Z","submitted_at":"2025-05-24T01:00:20Z","title":"OmniConsistency: Learning Style-Agnostic Consistency from Paired Stylization Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18445","snapshot_observed_at":"2026-08-07T11:26:29.016351Z","title":"Omniconsistency: Learning style-agnostic consistency from paired stylization data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.016351Z"},"links":{"cited_paper":"/paper/2505.18445","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:ff952d026d40b38abe4778ee6063ff7c58e8e3bea59197514be2fb3a93709478","observation_id":"d8fdb208-d409-4c04-a7fe-831841288831","resolution":{"observed_at":"2026-08-07T11:26:29.016351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14580","last_updated":"2024-12-19T07:00:03Z","snapshot_observed_at":"2026-08-05T09:39:52.232873Z","submitted_at":"2024-12-19T07:00:03Z","title":"DiffSim: Taming Diffusion Models for Evaluating Visual Similarity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14580","snapshot_observed_at":"2026-08-07T11:26:29.117065Z","title":"Diffsim: Taming diffusion models for evaluating visual similarity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.117065Z"},"links":{"cited_paper":"/paper/2412.14580","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:383905ea19671d22d6b9cbde410901589986956caebd7abdc3d34e4cd768a475","observation_id":"0491bdea-bb66-4468-9b18-6f31450b14ae","resolution":{"observed_at":"2026-08-07T11:26:29.117065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05980","last_updated":"2024-12-08T16:04:45Z","snapshot_observed_at":"2026-07-06T20:03:29.510169Z","submitted_at":"2024-12-08T16:04:45Z","title":"Anti-Reference: Universal and Immediate Defense Against Reference-Based Generation","version":1},"cited_work":{"arxiv_id":"2412.05980","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05980","snapshot_observed_at":"2026-08-07T11:26:31.434484Z","title":"Anti-Reference: Universal and Immediate Defense Against Reference-Based Generation","venue":"cs.CV","work_id":"5bd23d15-0f29-4ed7-8bb9-e4d2572d25dd","year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.199820Z"},"links":{"cited_paper":"/paper/2412.05980","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:9a825d9c0dd06495138f12f6b627d0234ae35215e1179d48f5f966fcbebe3dc9","observation_id":"b2911789-b041-4db1-b350-a10d158acfb4","resolution":{"observed_at":"2026-08-07T11:26:31.465314Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10718","last_updated":"2025-06-30T10:03:43Z","snapshot_observed_at":"2026-07-06T20:06:57.159160Z","submitted_at":"2024-12-14T07:22:03Z","title":"Grid: Omni Visual Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10718","snapshot_observed_at":"2026-08-07T11:26:29.276612Z","title":"Grid: Visual layout generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.276612Z"},"links":{"cited_paper":"/paper/2412.10718","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:0a43ae200282d420ec0846616f54ded71bbdf20fd489e490d97f96d8a4d860f6","observation_id":"85d087eb-912c-4aaa-bab6-ea23d41dafd7","resolution":{"observed_at":"2026-08-07T11:26:29.276612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:29.340378Z","title":"Images speak in images: A generalist painter for in-context visual learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.340378Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:f13a922fa5ac8f57396af28f0de4eb5add5885059d2f40cc9a2b22c5b500446d","observation_id":"c67fcc53-b8c4-4372-be6e-b6eab7cfc90a","resolution":{"observed_at":"2026-08-07T11:26:29.340378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:29.430480Z","title":"Image quality assessment: From error visibility to structural similarity","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.430480Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:bbc7b8ae3d10b61e171f4039ddad5a7490d41402a7e4c73f5b3ff86b84420ca0","observation_id":"8f833c93-77b7-4c7d-b8fc-fa9783aad9d1","resolution":{"observed_at":"2026-08-07T11:26:29.430480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15462","last_updated":"2022-11-21T07:07:19Z","snapshot_observed_at":"2026-08-05T11:33:58.973698Z","submitted_at":"2022-11-21T07:07:19Z","title":"Investigating Prompt Engineering in Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15462","snapshot_observed_at":"2026-08-07T11:26:29.533343Z","title":"Investigating prompt engineering in diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.533343Z"},"links":{"cited_paper":"/paper/2211.15462","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:38bbe6fb57e3b4fc220b7414d63f49d6121cfc37e945f0c199c3f3f612a5d0ad","observation_id":"f9b2ed42-302f-42aa-8570-66ae28118dd6","resolution":{"observed_at":"2026-08-07T11:26:29.533343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:33.533688Z","title":"Versatile diffusion: Text, images and variations all in one diffusion model","venue":null,"work_id":"939bcf94-3dcd-41c4-9492-de36175a2ea1","year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.609234Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:d567479b96e31a232aa4789d02ecdbea08965ba07273e81aa4ba5315d5cd1854","observation_id":"0e9691e3-14c4-4f3a-8e0c-4c6a1d2511e8","resolution":{"observed_at":"2026-08-07T11:26:33.605922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:33.423769Z","title":"Paint by example: Exemplar-based image editing with diffusion models","venue":null,"work_id":"8c57b361-a248-4f22-95c9-c7509417138d","year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.683224Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:3a42ca6da517893c20f9d53bd145807d49fb13cdd81157266eab1b6b929bed41","observation_id":"a7343dc2-e163-41f8-84ac-fc189454df0f","resolution":{"observed_at":"2026-08-07T11:26:33.500647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:29.755611Z","title":"Imagebrush: Learning visual in-context instructions for exemplar-based image manipulation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.755611Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:114af7ee2d3ba4ff20f8aab44ff8156f25f041dec7155ac675ce0c51ba24c4e7","observation_id":"3b428b54-53b2-4efc-b393-feb13063f2a1","resolution":{"observed_at":"2026-08-07T11:26:29.755611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:29.860968Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.860968Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:e20a69b4f25d6b132be3ea5d537eb61134f94c82eba8bbf9bd83d32cc15d969b","observation_id":"a72d8917-89bf-4795-8151-485b40f49652","resolution":{"observed_at":"2026-08-07T11:26:29.860968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:33.299646Z","title":"Finestyle: Fine-grained controllable style personalization for text-to-image models","venue":null,"work_id":"fd10b265-6b57-4525-bbbd-382203dbec3d","year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:29.965747Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:60d1a524f305ee956ac724fd2aa37eb0295fab83bed21cf9269be1e855cda383","observation_id":"6c2a7556-8077-45c8-b231-038b6f1f95bf","resolution":{"observed_at":"2026-08-07T11:26:33.315640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17113","last_updated":"2024-06-23T03:47:27Z","snapshot_observed_at":"2026-08-07T05:26:05.587260Z","submitted_at":"2024-02-27T01:19:53Z","title":"Transparent Image Layer Diffusion using Latent Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17113","snapshot_observed_at":"2026-08-07T11:26:30.063204Z","title":"Transparent image layer diffusion using latent transparency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.063204Z"},"links":{"cited_paper":"/paper/2402.17113","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:014e7ba453608103f0d807351bbe423668b0a953db6a12b063eeffd6af0822ac","observation_id":"ff729933-4eba-43f6-8f28-56e7b34638f2","resolution":{"observed_at":"2026-08-07T11:26:30.063204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:30.122524Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.122524Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:97c885aa6d48bb8e419274d7d421d1d066943ec2fec17c988aaaa6742b4a5089","observation_id":"98351591-9fb3-4625-a754-018c2da1c0ae","resolution":{"observed_at":"2026-08-07T11:26:30.122524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:30.217419Z","title":"Ssr-encoder: Encoding selective subject representation for subject-driven generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.217419Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:71f34b1b7c2927c7b6719a3108a99c805a8d74ad156fec83773d13760d2d234d","observation_id":"f6cb4c78-a4d6-435c-a1ac-ff93d2362a84","resolution":{"observed_at":"2026-08-07T11:26:30.217419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:33.129551Z","title":"Fast personalized text to image synthesis with attention injection","venue":null,"work_id":"878ecb5f-b17e-401f-a1ff-b3eac5cd0140","year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.283277Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:302549ef5bd47477f3cdc40d46077356110c3415542848d790359abec100f734","observation_id":"b561ba52-4045-4d5c-9655-5c99254571dd","resolution":{"observed_at":"2026-08-07T11:26:33.194879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07764","last_updated":"2025-04-01T08:37:38Z","snapshot_observed_at":"2026-07-06T17:43:22.965126Z","submitted_at":"2024-03-12T15:53:14Z","title":"Stable-Makeup: When Real-World Makeup Transfer Meets Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07764","snapshot_observed_at":"2026-08-07T11:26:30.361206Z","title":"Stable-makeup: When real-world makeup transfer meets diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.361206Z"},"links":{"cited_paper":"/paper/2403.07764","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:9cac38e748f1850e3fbf19c6e15d5875dfcac378ddeb1471d6af77e9d825cf17","observation_id":"d9cdf82b-3356-4a27-950d-6203140bf0a7","resolution":{"observed_at":"2026-08-07T11:26:30.361206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07027","last_updated":"2025-03-10T08:07:17Z","snapshot_observed_at":"2026-08-07T17:17:43.519906Z","submitted_at":"2025-03-10T08:07:17Z","title":"EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07027","snapshot_observed_at":"2026-08-07T11:26:30.437018Z","title":"Easycontrol: Adding efficient and flexible control for diffusion transformer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.437018Z"},"links":{"cited_paper":"/paper/2503.07027","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:d7bc0c468cdbf08c5b46206e7ae142278a3e167a666503cf04c4f19cecf84eaf","observation_id":"72b2355f-0259-4a73-88f7-e4ec95a3036f","resolution":{"observed_at":"2026-08-07T11:26:30.437018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14078","last_updated":"2024-12-10T16:04:50Z","snapshot_observed_at":"2026-07-06T18:48:53.833921Z","submitted_at":"2024-07-19T07:14:23Z","title":"Stable-Hair: Real-World Hair Transfer via Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14078","snapshot_observed_at":"2026-08-07T11:26:30.537511Z","title":"Stable-hair: Real-world hair transfer via diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.537511Z"},"links":{"cited_paper":"/paper/2407.14078","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:43d38af36505edf626a1b8fd960095e533dc1c1f5ac10f4d1098a7cc302933ca","observation_id":"0ffebfdb-e4a7-4998-b772-81e63a107d44","resolution":{"observed_at":"2026-08-07T11:26:30.537511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18583","last_updated":"2024-06-05T17:53:26Z","snapshot_observed_at":"2026-08-06T11:25:48.819238Z","submitted_at":"2024-06-05T17:53:26Z","title":"Lumina-Next: Making Lumina-T2X Stronger and Faster with Next-DiT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18583","snapshot_observed_at":"2026-08-07T11:26:30.614880Z","title":"4 images are organized into a grid of 2 rows and 2 columns","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.614880Z"},"links":{"cited_paper":"/paper/2406.18583","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:d5d6d08150c737759b8f562592a663ace962275b54ca06df7893b0d775688864","observation_id":"89787206-df16-40ae-a48d-3588a67b81ed","resolution":{"observed_at":"2026-08-07T11:26:30.614880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:32.946241Z","title":null,"venue":null,"work_id":"c3ff2583-ef9c-49dd-9b49-b12918abb3f9","year":null},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.696048Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:2a3e1df2a8d752ced148d555dc4f07e14235dc73ab173f94776a03a538005178","observation_id":"1378a512-0f64-4e03-9e00-1d1e3b8b7e29","resolution":{"observed_at":"2026-08-07T11:26:33.017482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:32.785114Z","title":null,"venue":null,"work_id":"d826da41-dc1e-43bb-b1da-2dfb66fbc9b2","year":null},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.778149Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:55d862729256638bbab040ce3ba062f64f2343c289a7175c1860a90f7e8326fd","observation_id":"c790220d-72c5-498c-aac0-d718ad0880d5","resolution":{"observed_at":"2026-08-07T11:26:32.858751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:32.618141Z","title":null,"venue":null,"work_id":"706ca621-8f1c-492c-b318-d2e8d53580db","year":null},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.850475Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:ab005a32f809960d3abb979e9a582e8cc5cf7eb3ec25265bc78a1206f6b68d66","observation_id":"156ca6d3-9894-4956-b049-c3da08a5d18d","resolution":{"observed_at":"2026-08-07T11:26:32.695543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:32.426949Z","title":null,"venue":null,"work_id":"3655a525-1e74-4c81-a617-ac10fbc12e04","year":null},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.923971Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:e17dcb8a4ead4482b8b2183e1f2faa58b21bd5172390eece0006dfe76cbc7c42","observation_id":"ead06ca3-b213-4e56-8c63-d3b0dc5257c2","resolution":{"observed_at":"2026-08-07T11:26:32.526412Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:32.234121Z","title":null,"venue":null,"work_id":"067c7c9f-91cd-446e-9850-05695cf00af6","year":null},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:30.997782Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:b8390c274e9cebae1b8408e4e398b512efc2d32fd8462c29834d8b0caeeb1426","observation_id":"ecd19af3-cfd5-42df-ba57-eea803bb5665","resolution":{"observed_at":"2026-08-07T11:26:32.352512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:32.093490Z","title":"Figure 9: Structured prompt used for labeling image pairs and extracting transformation instructions","venue":null,"work_id":"ec40b6a1-1628-4a6d-a42a-717ee1957f12","year":null},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:31.101356Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:0c4a404195b8b343b31223d3b463a6a71374da68dcb0a48f187dc273a408c195","observation_id":"e6c401e2-cac0-4e88-ad32-3d67999d0377","resolution":{"observed_at":"2026-08-07T11:26:32.157655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:31.935434Z","title":null,"venue":null,"work_id":"a54c352a-016d-49df-b1e4-e6ffd40f8e9e","year":null},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:31.151385Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:6e7f88d744b5c5cdd8ae062db7019aa36011209104263e9629b103f625bcbea5","observation_id":"e5e869e3-ec43-4f0c-8dbe-574684e32465","resolution":{"observed_at":"2026-08-07T11:26:32.017466Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:26:31.817195Z","title":"B1\": {\"consistency","venue":null,"work_id":"a72ec55a-cc70-4409-895d-623bba7efc59","year":null},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:31.248399Z"},"links":{"citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:354dbc8ea431dea3892fcf21b39be0f5efa983d41e8d7797e4edf63cf4faf690","observation_id":"9f97ab58-dc20-4b42-9160-03ff7c0fa24d","resolution":{"observed_at":"2026-08-07T11:26:31.864166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:19:47.569369Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":45,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 7 inbound Pith citation observations for arXiv:2506.02528."}