{"as_of":"2026-08-11T13:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0a6c7576a1c71a524bd55930e9452bc6a8d83bee5183b443e94d6d28d1024dac","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T16:06:20.797660Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2601.05127/citation-record","integrity":"/paper/2601.05127/integrity","json":"/paper/2601.05127/citation-record.json","paper":"/paper/2601.05127"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.08113","last_updated":"2023-02-16T06:28:29Z","snapshot_observed_at":"2026-08-07T03:49:49.341219Z","submitted_at":"2023-02-16T06:28:29Z","title":"MultiDiffusion: Fusing Diffusion Paths for Controlled Image Generation","version":1},"cited_work":{"arxiv_id":"2302.08113","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.08113","snapshot_observed_at":"2026-07-07T12:53:50.466635Z","title":"Multidiffusion: Fusing diffusion paths for controlled image generation","venue":"cs.CV","work_id":"1a06e9b7-e97f-4665-ba6e-55301822d3b6","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2302.08113","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:5b24218662b99c57aa68e2bfd2a6a7ca0c9d78f08586a891138481c57031e8a8","observation_id":"87a7010e-2579-4236-b8c0-cc52465936c7","resolution":{"observed_at":"2026-05-16T16:08:04.474452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flux, https://github.com/black-forest- labs/flux","venue":null,"work_id":"69afefa5-2adf-4b05-b672-ea241a24d5bb","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:45333d83bc1e93b9501c5cc09c467ac1d8145877489234e62dc3a8335d0b91b7","observation_id":"abcd5e32-dfde-447f-803b-7731d50a20c0","resolution":{"observed_at":"2026-05-16T16:08:05.043599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa8d185f-3106-4caa-b5b3-f2d8a10e7949","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:6eba17be40b303d26073475aa113ed84d6c421b4c066252519b66b3567d0e822","observation_id":"ccd57db5-cc3f-4c7c-8554-7e34fbee4431","resolution":{"observed_at":"2026-05-16T16:08:05.114221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03373","last_updated":"2023-11-29T10:21:48Z","snapshot_observed_at":"2026-08-09T12:27:27.164065Z","submitted_at":"2023-04-06T21:00:00Z","title":"Training-Free Layout Control with Cross-Attention Guidance","version":2},"cited_work":{"arxiv_id":"2304.03373","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.03373","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training-free layout control with cross-attention guidance","venue":null,"work_id":"5ea06d90-eff5-4c72-a3ee-8f6e8fefba4d","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2304.03373","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:5253f5169322954f95b299ca2f25d08347bad74449c63e057a58faa8516c6778","observation_id":"7803b524-5caa-4ce3-8bca-24bd8db3d9c1","resolution":{"observed_at":"2026-05-16T16:08:04.460743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anydoor: Zero-shot object-level im- age customization","venue":null,"work_id":"07e736bb-10d3-4aae-b771-f026c7b7fbf5","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:96364fa2ecba3f812d69210b9f51f072a57dc4a375a05d2163b15f9612dd4ee5","observation_id":"db10892c-b12c-4793-aadf-180b6ef6a256","resolution":{"observed_at":"2026-05-16T16:08:05.137711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.02938","last_updated":"2021-09-15T04:03:34Z","snapshot_observed_at":"2026-07-06T11:36:03.810011Z","submitted_at":"2021-08-06T04:43:13Z","title":"ILVR: Conditioning Method for Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":"2108.02938","doi":"10.48550/arxiv.2108.02938","metadata_source":"arxiv_reference","pith_arxiv_id":"2108.02938","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ilvr: Conditioning method for denoising diffusion probabilistic models","venue":"arXiv (Cornell University)","work_id":"cfb1b920-fb4e-4617-b335-ddfe3d6f7f84","year":2021},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2108.02938","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:daccb34592b2e8eac3471a95a5324d18d88148b8b03ff54361b2a629890fe210","observation_id":"f506409d-84fa-4b02-8ac6-e6a17f64e2cb","resolution":{"observed_at":"2026-05-16T16:08:04.447208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dovenet: Deep image harmonization via domain verification","venue":null,"work_id":"fd7d2d9e-1f6b-4bba-bbb7-c9dea8b2201b","year":2020},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:e830a153b04e47f6b62a46023ca037d6d4eea1baf8621659e864641aea78d936","observation_id":"9f847f01-7f2b-47a6-9d27-b1cc5b9d7404","resolution":{"observed_at":"2026-05-16T16:08:05.109026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving the harmony of the composite image by spatial-separated attention mod- ule.IEEE Transactions on Image Processing, 29:4759– 4771","venue":null,"work_id":"0b460853-7724-4674-b9ab-afbba6e3d2a8","year":2020},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:f434dde97e5f5eea01f6cc30c489502bc8988a171b87625bce92c4dfc0e26c83","observation_id":"b23dd311-7e97-4167-9549-b71dacda7542","resolution":{"observed_at":"2026-05-16T16:08:05.102776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Be yourself: Bounded attention for multi-subject text-to-image generation","venue":null,"work_id":"eb7952b6-f991-499c-a08b-0fe52153eaf0","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:87974f02bf07bb19495a338af4c0d8f8d143cf6c92360841be0b2d93087461fe","observation_id":"6b33ede4-d697-4b3c-9c63-15d8c8fe8f2e","resolution":{"observed_at":"2026-05-16T16:08:05.098379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Be decisive: Noise-induced layouts for multi-subject generation","venue":null,"work_id":"49aa12f6-bfb4-4849-878d-75b75479bd39","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:7221ac6532556a884f4ffc86e5a75ed532cf62b631002090d58a772d1dd804b1","observation_id":"7a8a76f1-ced2-4130-b3c0-5bf2ec6050dc","resolution":{"observed_at":"2026-05-16T16:08:05.100527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bermano, Gal Chechik, and Daniel Cohen-Or","venue":null,"work_id":"6c6ad6b9-3d29-43bb-9033-ace8100f4d76","year":2022},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:1f0361eeeadf101e405d16d4ad3868fedccfd0a900ab38d37daf85a2aae57e70","observation_id":"dd1e5bd7-b589-4d35-9126-b5af68d406d9","resolution":{"observed_at":"2026-05-16T16:08:05.111634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing Gemini 2.5 Flash Im- age, our state-of-the-art image generation and editing model.https://developers.googleblog.com/ en/introducing- gemini- 2- 5- flash- image/","venue":null,"work_id":"ff245614-ecc0-41cc-8420-0cab8a2c988e","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:52d6f98d139903164b930fe2c4c52547e621758fd2c36f6b6d68e3d78ae2c1d2","observation_id":"c3de6222-70ba-4da7-ae25-ff2c0a469e10","resolution":{"observed_at":"2026-05-16T16:08:05.088902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"71e6ea35-b749-4068-8383-9f05a9f2caa9","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:283649c001a1d66942cb78bf2edd223c2b12b4e0b43ad1170d327be537a66a3f","observation_id":"0f11723b-4f04-4abb-86c6-0df4bf6ede3a","resolution":{"observed_at":"2026-05-16T16:08:05.057390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Swapanything: Enabling arbitrary object swapping in personalized image editing.ECCV","venue":null,"work_id":"8f0384f2-1ae1-474a-8e9c-6fd4524cd3b7","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:b5c2aeef64029ce1e2d24b1227714d64aaaf8912d1604d3330f6b3bde1540b7a","observation_id":"630e604d-f748-448b-b981-88f8ac31def9","resolution":{"observed_at":"2026-05-16T16:08:05.086331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10167","last_updated":"2023-05-25T06:30:04Z","snapshot_observed_at":"2026-07-06T14:53:49.389350Z","submitted_at":"2023-02-20T18:54:04Z","title":"Cross-domain Compositing with Pretrained Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.10167","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.10167","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-domain compositing with pretrained dif- fusion models","venue":null,"work_id":"df617c79-a945-4ad6-b90c-ca6773e4c5cd","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2302.10167","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:706ffcce26f58ccd70d586f0d400695869258c714190240401ea3f5520c457cd","observation_id":"eae82c75-b1d3-4042-9010-45c07f0cd853","resolution":{"observed_at":"2026-05-16T16:08:04.439806Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rotary position embedding for vision transformer","venue":null,"work_id":"e3b1f538-59c7-4363-a6a2-3bb5c623e914","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:b8e3ec58cb38627f608d31f8769f0ecf2c7d19d840413d963258c2cef87a0dec","observation_id":"e0e64fef-3b60-4da2-9b34-e5af596801e7","resolution":{"observed_at":"2026-05-16T16:08:05.065189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt-to-prompt image editing with cross attention control","venue":null,"work_id":"94169321-fe1d-420a-a737-30a59d858f2a","year":2022},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:d8adbb3545cd0aea6fbcced9692f00618a6f584ac0ab81eabe65502c19ab4bb4","observation_id":"765f70ae-0f8a-4f30-8ad3-ee75546a18b3","resolution":{"observed_at":"2026-05-16T16:08:05.067339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"cfb58744-5a97-48a8-98c4-b0537e59990c","year":2020},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:727d7161282266dccd2eae2f20f7ec5b7bd2adad6a75f8035f915f5264a6c678","observation_id":"7dd2d886-a044-4f8f-b525-e4d193c68e90","resolution":{"observed_at":"2026-05-16T16:08:05.118727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.01929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:09:45.495563Z","title":"Image generation from contextually- contradictory prompts.arXiv preprint arXiv:2506.01929","venue":null,"work_id":"b03b9a89-e090-435e-9b29-b315c47642a5","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:2790ebf1b04d0777cecc2b6b64533cdec55300908cad6817898454a95a00a9b1","observation_id":"a4bc4304-0fde-42e8-82c0-323538c23aed","resolution":{"observed_at":"2026-05-16T16:08:04.454251Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ssh: A self-supervised framework for image harmonization","venue":null,"work_id":"aa23d512-b69c-419a-9d99-355d691a8c12","year":2021},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:75bd43c0837ab3f78f962853dd355facc41d42b4e7d8abc8f32e23565b73a603","observation_id":"d3ca717c-99b4-4ac2-86d3-bca040e1dbc5","resolution":{"observed_at":"2026-05-16T16:08:05.071492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":"7ef8602a-ec0c-401e-9175-ba4c91edf500","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:0aefae8bd13609544a04cf3bc9afbcffcc41745a17fb6df0ef4667556d2db2b8","observation_id":"231c3fdd-1b2c-4f6e-909e-5c74e81e4d55","resolution":{"observed_at":"2026-05-16T16:08:05.125312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:55:40.451482Z","title":"Flux.1 kontext: Flow matching for in-context image generation and editing in latent space","venue":null,"work_id":"68e284f0-a6c3-4a14-b75f-ac624b920c19","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:e4b1641a463048fe23a99df346f07a9a9f9e3c9b0a569cabb8b94f6f75abd43a","observation_id":"45e133de-de52-4afd-badb-3f565eb2876a","resolution":{"observed_at":"2026-05-16T16:08:05.055137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":"2301.12597","doi":"10.48550/arxiv.2301.12597","metadata_source":"pith","pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","venue":"cs.CV","work_id":"63d03f4d-15f4-4583-8286-913c19f02294","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:f36f79452c5dd533876eacc71b3491ad2a1c2446b8298af8c29c0c6e0df7409d","observation_id":"f034111c-8aba-44f7-9b75-ccf5da5a5883","resolution":{"observed_at":"2026-05-16T16:08:04.435944Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:47.354893+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:47.354893+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":"992280d0-7c29-4581-bd40-2165df3b2a79","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:4bd0178c359a2e4c97bde496545ad68c52e1d87c4fee7b33cdaee452f2495dde","observation_id":"7397afed-4c9c-4c4d-a5f7-eb85d8db9755","resolution":{"observed_at":"2026-05-16T16:08:05.045719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tf-icon: Diffusion-based training-free cross-domain image composi- tion","venue":null,"work_id":"392e9928-24c7-42bf-9fee-fcf737163e3c","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:8b3acee9c1459518956ef3ef66935d84517eeda4b7a55a7a61b30b4ee1db1ae9","observation_id":"0e4d3851-8e57-464f-85e9-bfabc3feb931","resolution":{"observed_at":"2026-05-16T16:08:05.135257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08453","last_updated":"2023-03-20T10:52:26Z","snapshot_observed_at":"2026-07-31T21:11:02.534986Z","submitted_at":"2023-02-16T17:56:08Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.08453","doi":"10.48550/arxiv.2302.08453","metadata_source":"pith","pith_arxiv_id":"2302.08453","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"2337b26e-9ca1-4157-be2a-438971c5fef3","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2302.08453","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:026e1aeca01875ae1c050b5b918f51fc4248fbb40ea12be9706b9be1da30e344","observation_id":"b5d5235a-565a-40b7-b218-ec267c9d1a96","resolution":{"observed_at":"2026-05-16T22:47:50.630300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12036","last_updated":"2024-03-18T17:59:40Z","snapshot_observed_at":"2026-07-06T17:46:29.153377Z","submitted_at":"2024-03-18T17:59:40Z","title":"One-Step Image Translation with Text-to-Image Models","version":1},"cited_work":{"arxiv_id":"2403.12036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.12036","snapshot_observed_at":"2026-07-04T02:59:25.755505Z","title":"One-step image translation with text-to-image models","venue":null,"work_id":"2195f713-f393-41e9-b1d8-0e3b7cbf5536","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2403.12036","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:2bee8de644515304b3459c563f0a5115577b83bc3f81424d8ac6764ed53728e5","observation_id":"a490ab2a-a7cf-410a-948a-fb4ab0618c73","resolution":{"observed_at":"2026-05-16T16:08:04.464433Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"65c0f981-db9c-4072-b77f-8152952f55ee","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:2b760dfcf0420bde8be3b141ae8d4df9c59b57f0f6289e77a17bc78b54905f53","observation_id":"e38e2d11-da34-4ac9-8a2f-785c20828035","resolution":{"observed_at":"2026-05-16T16:08:05.062897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Poisson image editing","venue":null,"work_id":"eafa9ed4-6dcb-4780-9773-2fa5eb83774e","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:640460ffa8b161bc515b4dc43e4db58c2eb63f59ec94ac2a939737f49fc8d122","observation_id":"98a539ca-c796-43dc-8682-a077be2d5b51","resolution":{"observed_at":"2026-05-16T16:08:05.120827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Relightful harmonization: Lighting-aware portrait background replacement","venue":null,"work_id":"3942d669-79ae-4627-853e-b347324086b7","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:bd869ceb3a9f4bf3c4a2bae9ed57d25539ba94e7e48a7c7730261a85731ff550","observation_id":"f0927200-fef9-4efc-b95c-1952482bc0a9","resolution":{"observed_at":"2026-05-16T16:08:05.091267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"535ceba1-cabb-4509-9f9e-3f07fc98ed07","year":2022},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:e1ef77aa728fa83302aa515ff6178433ecfa6f857a092f330d0d8a7ffa9e3dd9","observation_id":"fe5301cc-bafb-4447-98a3-24cb601ca5a2","resolution":{"observed_at":"2026-05-16T16:08:05.060266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"71989962-1e81-4f2e-8cc2-0122f97d44aa","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:d899e14085848da27eabc3b87882bcd98f3347a2c8a46d67cead71562bde15e0","observation_id":"6f0a1b7d-16ca-4bf1-8610-207b20d3ed12","resolution":{"observed_at":"2026-05-16T16:08:05.116521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In- stancegen: Image generation with instance-level instruc- tions","venue":null,"work_id":"bb5764c3-141c-442d-84ae-97ba24eb7f2e","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:983c909ce7d73ed00dc4ac25fa08927aa172d6f3fe97350fc1a4654d820a88e6","observation_id":"8c064bf0-07ce-42cd-972e-75aef95b295f","resolution":{"observed_at":"2026-05-16T16:08:05.123135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-10T22:24:05.831832Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":"1409.1556","doi":"10.48550/arxiv.1409.1556","metadata_source":"pith","pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","venue":"cs.CV","work_id":"1c4b4409-c14b-488b-a086-c57a5aab8a29","year":2014},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:5eae2cdbf681eff4009abedea3f04da65005530f105cd161fc4d69d5e5d5dcd3","observation_id":"fcee1615-64ad-4aa5-8ea5-116107cc52e5","resolution":{"observed_at":"2026-05-16T16:08:04.457135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-12T23:51:07.915518+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T23:51:07.915518+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":"c14364af-ff28-4964-9b68-5c4ba95097ec","year":2020},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:dbca1769386c9565f4d74ba2c714507367370b668af627d10b8aba62a0d67bc8","observation_id":"49bae8d9-df38-40e7-9a84-d7fdec63775b","resolution":{"observed_at":"2026-05-16T16:08:05.132847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object- stitch: Object compositing with diffusion model","venue":null,"work_id":"58f941cf-0ba7-4e92-9069-46c19e1ef5c3","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:3bb467dac1b9b6b94e086c4164da3dc1ee6c7e947e75d0af47fbed458248b4e6","observation_id":"8c7dd5ae-d598-43bf-9438-72e90a60f740","resolution":{"observed_at":"2026-05-16T16:08:05.127573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imprint: Generative object compositing by learning identity-preserving representation","venue":null,"work_id":"dc80090a-c1aa-45b5-abf6-d9df38148bf3","year":2024},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:1b84e6bc8f18d51715e85872b9c6591f64994eab278fffc83af7c02a99492d11","observation_id":"cfc53f00-91f0-469e-8855-62eee4a3969f","resolution":{"observed_at":"2026-05-16T16:08:05.104909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063","venue":null,"work_id":"d1af47bd-dd90-4dff-826b-302fd98831d3","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:2a2510c3acd747f19d7be91e4ece9510e0760951949b11c4c2144ae4c960958a","observation_id":"f7a9fe67-c51b-4e53-af31-007591233af2","resolution":{"observed_at":"2026-05-16T16:08:05.130393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ominicontrol: Minimal and univer- sal control for diffusion transformer","venue":null,"work_id":"11cbbf98-0f6e-42d5-80cf-06290602b7ff","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:402ef5e76842e0c50c607cbfb4bb19f10d46918456edcc6302aca4ac8ac8d140","observation_id":"c39b7452-77bf-466f-ab50-9cddfc2939ed","resolution":{"observed_at":"2026-05-16T16:08:05.093829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep image harmonization","venue":null,"work_id":"2b9356d3-c138-4c84-9de6-0b023470eb1e","year":2017},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:27b3f5d91a756723692a2468dcb0e78ef94afd7cc9d51d004b015ba8105279f6","observation_id":"b2f55741-6f0d-493e-80e9-11a3dbd82b55","resolution":{"observed_at":"2026-05-16T16:08:05.096027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ex- ploring clip for assessing the look and feel of images","venue":null,"work_id":"7bb18fd1-185f-4784-8688-0e87907f498c","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:91203131743e7d1244ef79d6e7b42e13a69e94d5fd99dcb3e3bb19c8ffed1cd8","observation_id":"264421a8-6556-46c5-988d-e426eb22b766","resolution":{"observed_at":"2026-05-16T16:08:05.052255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07209","last_updated":"2025-03-04T06:21:26Z","snapshot_observed_at":"2026-08-10T13:48:42.101892Z","submitted_at":"2024-06-11T12:32:53Z","title":"MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance","version":3},"cited_work":{"arxiv_id":"2406.07209","doi":"10.48550/arxiv.2406.07209","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.07209","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi Wang, Yinan He, Yizhuo Li, Kunchang Li, Jiashuo Yu, Xin Ma, Xinhao Li, Guo Chen, Xinyuan Chen, Yaohui Wang, et al","venue":"arXiv (Cornell University)","work_id":"273757ff-d85e-4208-bb7c-e5881a8119e4","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2406.07209","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:970a8301ffc6611fb0ce9e0c688b9a1b78398b515c3726f39f24a6a86a20ce22","observation_id":"7cc84ab5-5e7a-46de-a1ce-a5763b1880bd","resolution":{"observed_at":"2026-05-16T16:08:04.470931Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13848","last_updated":"2023-08-18T17:12:13Z","snapshot_observed_at":"2026-08-04T02:07:54.822320Z","submitted_at":"2023-02-27T14:49:53Z","title":"ELITE: Encoding Visual Concepts into Textual Embeddings for Customized Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2302.13848","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.13848","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Elite: Encoding visual concepts into textual embeddings for customized text-to-image generation","venue":null,"work_id":"0f52104e-2d64-4f37-a7f8-e9a44c02d75f","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2302.13848","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:f5189620ebfa3e7ca93b802ba1beab64c6d8db4ecfe9cf09da025affaa6dedef","observation_id":"a602dc1d-904b-4d58-b7d0-4b2ba2872fe5","resolution":{"observed_at":"2026-05-16T16:08:04.432693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:27f00227b6a1e33cfb75bef7f1ea3e0f2800f1bea535b4859b78eeb3d5f9ec6f","observation_id":"9bd574b2-b180-49ef-8236-3e9559fdd0ed","resolution":{"observed_at":"2026-05-16T16:08:04.467864Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Detectron2.https://github","venue":null,"work_id":"2923c166-4e57-404d-88c7-a7806a2af21f","year":2019},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:03b1d09d0d588cb17cc7438a954f7beac0aa532845df4b71f4b131b707b956a9","observation_id":"63bf19fc-9454-493f-94a3-329be00667b9","resolution":{"observed_at":"2026-05-16T16:08:05.106947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":"de4e20ee-512c-461e-aeed-4dd5d4fb39ba","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:261e5b3a96b89155a9d5659dac150ab611b1e0c1b24db00401292cb30aab4e54","observation_id":"d374aad1-e26a-4ca0-bf4e-a67bd4f9d171","resolution":{"observed_at":"2026-05-16T16:08:05.047897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:56:07.268021Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"6e5dc294-7e63-4630-8393-e84dd1cf2140","year":2023},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:fe539f9b4d0a88dbe7433fa68bf437f54103c049b6ef0554f6bae7cda990b23e","observation_id":"ed062727-e7fd-48a7-b3b6-3c7ddce39928","resolution":{"observed_at":"2026-05-16T16:08:05.083699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"56984d04-fd7a-468b-81a8-796a82de7663","year":2018},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:7a116d83870eb93daaa5d83cb67aa9ae082dda02c7ebb906a8142a796e9669f7","observation_id":"ebefa5d0-973d-4031-8d85-65cb0dd00054","resolution":{"observed_at":"2026-05-16T16:08:05.080884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preliminaries","venue":null,"work_id":"3182fdd4-12c7-4d22-a353-42d53bd232d0","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:5b4643cb0469f278835cb5861a31052a4bb99e122c12161cb82652780f64ba92","observation_id":"68cc24eb-48e2-49da-a923-8ab5b011c5dd","resolution":{"observed_at":"2026-05-16T16:08:05.075865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Benchmark","venue":null,"work_id":"50d48561-7bba-4788-92fc-1cd745909f77","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:cc98200f115fc0ecea29b3a4ddca8b5031054b7412a2cf6845c1dd65c6ccbe95","observation_id":"af3b6150-b6da-48cb-b858-8eec4d448600","resolution":{"observed_at":"2026-05-16T16:08:05.073733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Additional Qualitative Results","venue":null,"work_id":"f61871b5-d0d5-494f-8dd6-db59092f2e43","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:083258c3f68d65e82371a4349c18cb1b9f1e195a4abe1286e72f4395c6837feb","observation_id":"f538bd9e-0075-4d52-9ad8-8407e51c7f10","resolution":{"observed_at":"2026-05-16T16:08:05.069411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LooseRoPE","venue":null,"work_id":"cd1db751-af8b-43df-81cd-f18f71819576","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:d4dc9e9eae4ea32f4e9dee12b1dc7e13b58ba26ad31b06b7e36e361ecfd4c1fe","observation_id":"ce3079ac-aa43-49ea-b6ed-949d0864f4d4","resolution":{"observed_at":"2026-05-16T16:08:05.049933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8460.1200","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"blend the cropped ob- jects into the image in a convincing manner without chang- ing the style of the image","venue":null,"work_id":"d1976170-0fa9-4668-a613-40943e0bc9fc","year":null},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:cfbad6aeea9e384cd2f7639813ada7366a01b799a2ccf460ca4988f6eeb5fcd5","observation_id":"cc5edd94-d35e-45d7-ba2e-e3b457c73a00","resolution":{"observed_at":"2026-05-16T16:08:04.443271Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"blend the cropped objects into the image in a convincing manner without changing the style of the image","venue":null,"work_id":"83238e0f-553b-492d-a0fc-cd7781fa9325","year":2048},"citing_paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T16:06:20.797660Z"},"links":{"citing_paper":"/paper/2601.05127"},"observation_digest":"sha256:94ff75900d297e48e3f421f3e0ce8d89ab1ec8619846d3e6ea8ae71bab85fbd4","observation_id":"d97b3af3-df70-4933-a4f4-2eeba194f352","resolution":{"observed_at":"2026-05-16T16:08:05.078493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2601.05127","last_updated":"2026-04-23T07:24:19Z","latest_version":2,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-11T12:49:40.409071Z","submitted_at":"2026-01-08T17:17:47Z","title":"LooseRoPE: Content-aware Attention Manipulation for Semantic Harmonization"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":11,"verified_fuzzy":39},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2601.05127."}