{"as_of":"2026-08-13T22:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e36a9debd8ff459a02df4145880770262599f09da9de37230c3628ef1ffd4a30","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:10:42.957049Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.03812/citation-record","integrity":"/paper/2412.03812/integrity","json":"/paper/2412.03812/citation-record.json","paper":"/paper/2412.03812"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:44.160600Z","title":"Accessed: 2023-10-04","venue":null,"work_id":"f824e76c-c469-4e9d-94af-d27b18989ce4","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.579810Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:fed24c553fa47d314bbf8b00ddcd79aa72203fbaa80258268757896ec39702b4","observation_id":"69e3adc3-f2a9-4ddb-9cb3-39ab47912d7f","resolution":{"observed_at":"2026-08-11T22:10:44.165379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.585332Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.585332Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:b345c88a8f768b9e1c5f92048cb81b5604d6ade80aa79a1b75b7aa975d6b0f99","observation_id":"41d796b4-1367-4d8b-b6f9-24187d213e46","resolution":{"observed_at":"2026-08-11T22:10:42.585332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:44.136196Z","title":"Blended latent diffusion","venue":null,"work_id":"c266d5db-9aa9-4d74-9f10-d398a71caa26","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.591385Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:a17ac1aa755f09bfba5a3f26df04940b7aaf68815d5442e6f4c3c916e34571ca","observation_id":"413793b1-e795-4a56-b2eb-8d4f253b7c6e","resolution":{"observed_at":"2026-08-11T22:10:44.141147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.596673Z","title":"Imagen 3","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.596673Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:1cb9f14644d50f5c7f0ac1e08a88f2cadaa2bf42902ef28cef20fa65240ffa51","observation_id":"ff0c9a8f-a40f-4309-b993-24f628694bbe","resolution":{"observed_at":"2026-08-11T22:10:42.596673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12288","last_updated":"2023-02-23T19:13:10Z","snapshot_observed_at":"2026-07-06T14:55:15.719380Z","submitted_at":"2023-02-23T19:13:10Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12288","snapshot_observed_at":"2026-08-11T22:10:42.601357Z","title":"Zoedepth: Zero-shot trans- fer by combining relative and metric depth","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.601357Z"},"links":{"cited_paper":"/paper/2302.12288","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:4a00286247bc62c271859f99f4340e24393b9b2317cd38ce4b1a8c3b95346e62","observation_id":"2200c37d-9a59-4fff-9dc0-55cf55358917","resolution":{"observed_at":"2026-08-11T22:10:42.601357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:44.121194Z","title":"Attend-and-excite: Attention-based se- mantic guidance for text-to-image diffusion models","venue":null,"work_id":"ff245b5a-d773-44a2-8991-767759da9c78","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.606674Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:fd5b98d717957fe647ba604ad0f3da07e24dce0b2146413c6342f0a43b54b04d","observation_id":"34679cf1-fbf4-4f7b-97b4-a26bdedd50de","resolution":{"observed_at":"2026-08-11T22:10:44.126223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09985","last_updated":"2024-05-16T11:05:41Z","snapshot_observed_at":"2026-08-13T00:05:56.520040Z","submitted_at":"2024-05-16T11:05:41Z","title":"VirtualModel: Generating Object-ID-retentive Human-object Interaction Image by Diffusion Model for E-commerce Marketing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09985","snapshot_observed_at":"2026-08-11T22:10:42.612017Z","title":"Virtualmodel: Gener- ating object-id-retentive human-object interaction image by diffusion model for e-commerce marketing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.612017Z"},"links":{"cited_paper":"/paper/2405.09985","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:e954b1866dac04e0b7c97345317177dd33ae32e6b46f11277240cac1633f17c4","observation_id":"5f5fae03-824a-461b-ac79-b2a10eae79cb","resolution":{"observed_at":"2026-08-11T22:10:42.612017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03374","last_updated":"2024-02-27T02:45:34Z","snapshot_observed_at":"2026-08-13T11:48:46.737918Z","submitted_at":"2023-05-05T09:08:25Z","title":"DisenBooth: Identity-Preserving Disentangled Tuning for Subject-Driven Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03374","snapshot_observed_at":"2026-08-11T22:10:42.617066Z","title":"Disenbooth: Identity- preserving disentangled tuning for subject-driven text-to- image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.617066Z"},"links":{"cited_paper":"/paper/2305.03374","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:ff42db135e9841b894f700f857ee60d7e50b3495fba9e8701807d86081927c37","observation_id":"17cb43a3-927d-4d72-ab89-e6f18e3c3bcf","resolution":{"observed_at":"2026-08-11T22:10:42.617066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-11T22:10:42.622107Z","title":"Pixart-alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.622107Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:4d429856f227a094976091fb7deb7d082643c81d3d5657bc1a7a7f2d963343ab","observation_id":"f329969e-0b8d-40b8-aff1-ac45e5f2566d","resolution":{"observed_at":"2026-08-11T22:10:42.622107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:44.107334Z","title":"Anydoor: Zero-shot object-level im- age customization","venue":null,"work_id":"bb208046-83bb-4cb6-936b-c44459efad7e","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.628021Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:30cb5ef884fe27fc1e270218c93803637c2554ab8b2c6f93d214d3c3c9833c51","observation_id":"33d9cda6-8f58-42fd-bb5b-3e83d29a91bc","resolution":{"observed_at":"2026-08-11T22:10:44.112054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:44.090767Z","title":"Audio-driven talking video frame restoration","venue":null,"work_id":"0b161914-aac1-4be4-87d6-7fa486582892","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.632997Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:5d2049a1c3edc8216869d7ed8d96c0f47375eab8e06cbb42890f449aba203a1a","observation_id":"98a16d62-8ef3-4df8-b821-b79d3ce0c619","resolution":{"observed_at":"2026-08-11T22:10:44.095736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:44.075286Z","title":"Latentpaint: Image inpainting in latent space with diffusion models","venue":null,"work_id":"34fd91b2-897f-4c75-b8c5-dbca2ba1f75f","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.638257Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:af57866a46a737fbcf9680e526ded39b5ac0602140d227936a1e4434858fdf03","observation_id":"657bd0bd-5798-4e15-a3fc-e05f2a4e9b7d","resolution":{"observed_at":"2026-08-11T22:10:44.079920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:44.060373Z","title":"Flux.1-dev controlnet inpainting beta,","venue":null,"work_id":"0f76da2a-2dce-4556-a7e1-3952ed0504ce","year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.642886Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:7c91927597f9f98da3b20766131ad82583f0aabaa854e77be44f05e117f0b87e","observation_id":"56a7a7e8-a38e-4563-9fe2-3ab0c7ae1800","resolution":{"observed_at":"2026-08-11T22:10:44.065141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:44.029678Z","title":"Ld-bfr: Vector-quantization-based face restoration model with latent diffusion enhancement","venue":null,"work_id":"1644f655-5e34-4250-b499-5f3893659209","year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.652496Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:6184f0fd12f78fcd5347a46ecdc96211cb141c140685665c181a137b9a3aa2ea","observation_id":"06d0f69e-c0cf-47eb-a31c-2b36a1e0b432","resolution":{"observed_at":"2026-08-11T22:10:44.034632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03814","last_updated":"2024-12-11T07:50:40Z","snapshot_observed_at":"2026-08-13T10:03:36.144715Z","submitted_at":"2024-12-05T02:11:51Z","title":"Exploring Real&Synthetic Dataset and Linear Attention in Image Restoration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03814","snapshot_observed_at":"2026-08-11T22:10:42.657306Z","title":"Exploring real&synthetic dataset and linear attention in image restoration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.657306Z"},"links":{"cited_paper":"/paper/2412.03814","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:e7f9dfc51de91cd7291b4d5e66b852be63a2b23954e2776c68925b9948eabdcb","observation_id":"35fb8aa7-2a08-49ca-ad69-5ce77e1ac94e","resolution":{"observed_at":"2026-08-11T22:10:42.657306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.07825","last_updated":"2022-11-15T01:07:38Z","snapshot_observed_at":"2026-08-13T13:42:57.085126Z","submitted_at":"2022-11-15T01:07:38Z","title":"Direct Inversion: Optimization-Free Text-Driven Real Image Editing with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.07825","snapshot_observed_at":"2026-08-11T22:10:42.661972Z","title":"Di- rect inversion: Optimization-free text-driven real image edit- ing with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.661972Z"},"links":{"cited_paper":"/paper/2211.07825","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:091ebfa2a45127f9904fdeb3c5d223e87b79a4b451b097c3bf09d01dc82dd792","observation_id":"2bb961a5-5108-461b-9ced-dc3075e5e092","resolution":{"observed_at":"2026-08-11T22:10:42.661972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:44.015399Z","title":"Salient object-aware background genera- tion using text-guided diffusion models","venue":null,"work_id":"7082312a-dae5-418f-a038-98d1ac7b1fcc","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.666932Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:2fef56d05480f7098ab882a771ec5ee2568379876af15b22214168623340d9f7","observation_id":"83bc7812-ab00-4cd7-9229-9e9e642da9e8","resolution":{"observed_at":"2026-08-11T22:10:44.020236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.671839Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.671839Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:fc0ede7e32948553e3862a803c6f2ee1b9a8635e453c69554de1566800bf3f9f","observation_id":"55d212ee-3e9a-4963-8866-fcff64e76df1","resolution":{"observed_at":"2026-08-11T22:10:42.671839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.991346Z","title":"Scaling rectified flow trans- formers for high-resolution image synthesis, 2024","venue":null,"work_id":"e99c9609-0f3f-46e0-99e3-9f3eb0743197","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.676632Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:aa7159458f3b28f15eb36adeba390a01a7530ca86ae71f5ba85897b5a12ec409","observation_id":"ed33a513-ccc8-4be3-93cc-7353bdd92f9c","resolution":{"observed_at":"2026-08-11T22:10:43.996240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-11T22:10:42.681060Z","title":"An image is worth one word: Personalizing text-to- image generation using textual inversion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.681060Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:be8bdcee86512cfd2845b152a9b3aaddc8be3c4cff357aefcf5bafb310c902cb","observation_id":"e4119d62-5877-4629-bb94-e8c3840116b8","resolution":{"observed_at":"2026-08-11T22:10:42.681060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18071","last_updated":"2024-09-26T17:18:39Z","snapshot_observed_at":"2026-08-12T22:36:42.986736Z","submitted_at":"2024-09-26T17:18:39Z","title":"FreeEdit: Mask-free Reference-based Image Editing with Multi-modal Instruction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18071","snapshot_observed_at":"2026-08-11T22:10:42.685692Z","title":"Freeedit: Mask-free reference-based image editing with multi-modal instruction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.685692Z"},"links":{"cited_paper":"/paper/2409.18071","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:598a610241c889fa9d4501d4634cb5512c5445ca258aed8a68800d1c7cf9cc35","observation_id":"42ef4015-a942-4bfc-b112-ed90ce43bfda","resolution":{"observed_at":"2026-08-11T22:10:42.685692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-11T22:10:42.690661Z","title":"Prompt-to-prompt im- age editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.690661Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:85709d84f9042f77b690f2ac6feb3bc1d45a0b1530c670ad167d5af3dd66dc7f","observation_id":"88d2c3f2-c49f-4ffc-ae05-e25d6dbaea39","resolution":{"observed_at":"2026-08-11T22:10:42.690661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.976382Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":"9ac3da33-cc6c-4bf8-ba7c-19d1c08816bf","year":2017},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.695747Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:fa8ee9432cf4634517e21edf0eaacf35e7f54e71af64e7569cb881dbfc86fbfb","observation_id":"c61059f2-4ad2-4280-b424-eb4649ee131a","resolution":{"observed_at":"2026-08-11T22:10:43.981090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.961799Z","title":"Sara: High-efficient diffusion model fine-tuning with progressive sparse low-rank adapta- tion","venue":null,"work_id":"810f9d4e-fdd1-4e65-8394-8233d1033600","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.700059Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:20a79f3064fd8dfce8faf030b097702c4bc556f592a678d0832485399829ee55","observation_id":"58607a5e-bbb9-47c0-9541-670a91dde23c","resolution":{"observed_at":"2026-08-11T22:10:43.966739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04512","last_updated":"2025-05-08T08:29:00Z","snapshot_observed_at":"2026-08-08T15:15:48.227139Z","submitted_at":"2025-05-07T15:33:18Z","title":"HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04512","snapshot_observed_at":"2026-08-11T22:10:42.704604Z","title":"Hunyuancustom: A multimodal-driven architecture for customized video gener- ation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.704604Z"},"links":{"cited_paper":"/paper/2505.04512","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:1c04e29f3a0163f5a66a3501f48570417b46cd986c7a96bb115a02e87381bd0c","observation_id":"51ea1a43-98db-4371-9d43-0f209bea8c12","resolution":{"observed_at":"2026-08-11T22:10:42.704604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.945658Z","title":"Improving autoregressive visual generation with cluster- oriented token prediction","venue":null,"work_id":"2701928e-bdac-4526-84e3-1040a511e5cf","year":2025},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.709374Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:efdbfc258f3fad4cfcc8c931d56d9570d49f171c310a4cf5f603718b23cf186b","observation_id":"4d9568f5-e3e5-44a8-b3cd-8469a5e131e7","resolution":{"observed_at":"2026-08-11T22:10:43.951756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17525","last_updated":"2025-03-11T02:16:29Z","snapshot_observed_at":"2026-08-13T20:44:03.495389Z","submitted_at":"2024-02-27T14:07:09Z","title":"Diffusion Model-Based Image Editing: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17525","snapshot_observed_at":"2026-08-11T22:10:42.713601Z","title":"Diffusion model-based image editing: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.713601Z"},"links":{"cited_paper":"/paper/2402.17525","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:bf3f3c07fc100b8b3f3d91e48577c7e7feae6894103ec2999658a915ba372e3d","observation_id":"9acce6da-1e88-42ed-9ad4-d8d0bc560cc3","resolution":{"observed_at":"2026-08-11T22:10:42.713601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06976","last_updated":"2024-03-11T17:59:31Z","snapshot_observed_at":"2026-08-13T00:57:21.525577Z","submitted_at":"2024-03-11T17:59:31Z","title":"BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06976","snapshot_observed_at":"2026-08-11T22:10:42.718237Z","title":"Brushnet: A plug-and-play image inpaint- ing model with decomposed dual-branch diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.718237Z"},"links":{"cited_paper":"/paper/2403.06976","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:71bea0bfbfb026d82b939fd64bba01b205b0fe0fc95e932307cbe33a1fb550b4","observation_id":"2fd04ed8-430a-4c8f-90c7-b08c365ecc8b","resolution":{"observed_at":"2026-08-11T22:10:42.718237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.929628Z","title":"Flux-fill","venue":null,"work_id":"2ef43905-f17f-407a-ad27-8aeaebcdfd57","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.722991Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:d0ca296ddb18a3b9c8959a30ed99e2015741ab6ab18995988879dd69591823c3","observation_id":"711aecce-fa57-4bde-8278-302ad2da7e16","resolution":{"observed_at":"2026-08-11T22:10:43.934275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.914731Z","title":null,"venue":null,"work_id":"ce6e5097-a496-42e8-97b8-bcceab019d40","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.727558Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:13deb87e638aabcc4311e6f8fd6e7aca7fe0eb3b2ace9cac3849f79d3c58c9b9","observation_id":"9c756076-f90d-47c0-9ccd-36d2190d452c","resolution":{"observed_at":"2026-08-11T22:10:43.919645Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.899278Z","title":"Layerdiffusion: Layered controlled image editing with dif- fusion models","venue":null,"work_id":"713585e0-88a0-4f37-a1b4-8722c1e6e608","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.732263Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:a3887711b08b587e0242c7b5639602dd07178650fa1805151daeb0490e181d19","observation_id":"981e6cf8-20c3-4dd2-b0bf-53faefcb7b6d","resolution":{"observed_at":"2026-08-11T22:10:43.904293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.884720Z","title":"Gen- erative face completion","venue":null,"work_id":"046e5d1e-492a-45d3-8b0b-02ce62c28eeb","year":2017},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.736670Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:16518b18da8ea7841c456d699894e92ce3c52f48893f627856f7c662ba697c83","observation_id":"8be73929-d870-4088-add6-e9f7cf89e5ca","resolution":{"observed_at":"2026-08-11T22:10:43.889443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.869243Z","title":"Virtual try-on with pose-garment keypoints guided inpaint- ing","venue":null,"work_id":"d09cdf44-477b-4969-a312-80cbd5abf22c","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.741207Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:56cff5fc1b8e846321103f18c25803d2eb5b7ccb3590bfefe6692d2d17590eb4","observation_id":"6a2f90c2-c008-449b-9c93-26615b5b61ec","resolution":{"observed_at":"2026-08-11T22:10:43.874953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08748","last_updated":"2024-05-14T16:33:25Z","snapshot_observed_at":"2026-07-06T18:14:16.386835Z","submitted_at":"2024-05-14T16:33:25Z","title":"Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08748","snapshot_observed_at":"2026-08-11T22:10:42.746365Z","title":"Hunyuan-dit: A powerful multi-resolution diffusion transformer with fine-grained chi- nese understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.746365Z"},"links":{"cited_paper":"/paper/2405.08748","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:ca4a8e389eccf44f966305cbe94d8fbb8d67c2c29ffad85c4c381dfb6d90431b","observation_id":"7765ed2f-9fb4-482c-a343-69def11b1db7","resolution":{"observed_at":"2026-08-11T22:10:42.746365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.751349Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.751349Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:9b7894bd7066c2c879cd2da89460464e30d199b5f51c9a24f50ad0e3e60c2c37","observation_id":"7ba035e3-f894-4cb8-b5b6-98a105d89f73","resolution":{"observed_at":"2026-08-11T22:10:42.751349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.756374Z","title":"Evaluating text-to-visual generation with image-to-text gen- eration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.756374Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:e989a49a54f70fe11a2cd8fed06d9c6d98922cb28bd325a63f26ed9243548165","observation_id":"5482dca4-5b71-40e6-822a-79e7abe28ad9","resolution":{"observed_at":"2026-08-11T22:10:42.756374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.835515Z","title":"Towards understanding cross and self-attention in stable diffusion for text-guided image editing","venue":null,"work_id":"de1ef41e-2454-4451-bbca-65cdd185aad3","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.761102Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:ab39e3fe6ca32388b3ddf473cb171df616351946f62ae23e37978360814e4350","observation_id":"82e2f4f9-b637-4b32-b364-a1e73a860d6b","resolution":{"observed_at":"2026-08-11T22:10:43.840647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04460","last_updated":"2025-05-07T14:31:04Z","snapshot_observed_at":"2026-08-10T06:31:15.530277Z","submitted_at":"2025-05-07T14:31:04Z","title":"Learning Real Facial Concepts for Independent Deepfake Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04460","snapshot_observed_at":"2026-08-11T22:10:42.765537Z","title":"Learning real facial concepts for independent deepfake detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.765537Z"},"links":{"cited_paper":"/paper/2505.04460","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:33f0eb6b417d57a3f219a0d8787156929bafbef6aff6e0cc5861c007a1d86e51","observation_id":"3488f4c1-e284-40af-95f1-125ff97528a7","resolution":{"observed_at":"2026-08-11T22:10:42.765537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05125","last_updated":"2023-03-09T09:16:04Z","snapshot_observed_at":"2026-08-13T12:28:32.854815Z","submitted_at":"2023-03-09T09:16:04Z","title":"Cones: Concept Neurons in Diffusion Models for Customized Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05125","snapshot_observed_at":"2026-08-11T22:10:42.770036Z","title":"Cones: Concept neurons in diffusion models for customized generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.770036Z"},"links":{"cited_paper":"/paper/2303.05125","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:1839cb7c1688f338d18f0f561a80e66c78584af00b9c0d9238e3832cd9de18bf","observation_id":"7ddd596b-df61-4eca-bf57-167369a68871","resolution":{"observed_at":"2026-08-11T22:10:42.770036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.820315Z","title":"Cones 2: Customizable image synthesis with multi- ple subjects","venue":null,"work_id":"3e13ebe2-8b5d-491b-8df6-e6c487bd3637","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.774837Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:36b6a4b787fbf41e375b55fb008dc892b4e8ffea935ef22f7da9dfdd2c82fbb6","observation_id":"47df30d4-240c-419f-8342-d192799606c3","resolution":{"observed_at":"2026-08-11T22:10:43.825615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.779516Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.779516Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:07c79c8f50c95983fc05192f38075d350984eb0a2e710e02226e216e420830de","observation_id":"9de3ad8a-3578-4b71-8fea-3899b5fe0881","resolution":{"observed_at":"2026-08-11T22:10:42.779516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.796550Z","title":"Taming diffusion model for exemplar-based image translation","venue":null,"work_id":"d617863e-27dd-4780-9c6b-cd019fa37939","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.784416Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:c87fa6c70dd7b07ba19465e4f0122c8ed2d71b29a9ebdaf0aba9cd28fc5c50f3","observation_id":"5ddd5fc3-fa23-439d-ab84-145be1905c39","resolution":{"observed_at":"2026-08-11T22:10:43.801783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14091","last_updated":"2024-03-18T16:48:13Z","snapshot_observed_at":"2026-08-13T04:55:54.883202Z","submitted_at":"2023-12-21T18:09:30Z","title":"HD-Painter: High-Resolution and Prompt-Faithful Text-Guided Image Inpainting with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14091","snapshot_observed_at":"2026-08-11T22:10:42.788934Z","title":"Hd-painter: high-resolution and prompt-faithful text-guided image inpainting with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.788934Z"},"links":{"cited_paper":"/paper/2312.14091","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:2d6137fb14e7bddf55140a0a26592bf6066c7350f25104c6f096af552a32cc9e","observation_id":"205ef1c5-c877-430c-81bc-cee7f5e10dd6","resolution":{"observed_at":"2026-08-11T22:10:42.788934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.793912Z","title":"Null-text inversion for editing real im- ages using guided diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.793912Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:fefbe09d9b6c41b8433641250175a56a32a7d2f555ae2d530e39101b2a2f1c77","observation_id":"be9620f8-2a35-42ec-af48-71344aed031c","resolution":{"observed_at":"2026-08-11T22:10:42.793912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.798416Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.798416Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:e62d2c254e90036505e655c1cbf0c5f0f528de3efc69dcffef0fea6dbad88312","observation_id":"2c5af13a-bac9-4c2d-ad08-82dbef3f9dec","resolution":{"observed_at":"2026-08-11T22:10:42.798416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.807384Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.807384Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:eaeb50df6e0b956d6eee9ce4d59c7e5ce48296895483b825214669c9b5fb39ae","observation_id":"7c82c33a-4847-432b-8a53-89750808722d","resolution":{"observed_at":"2026-08-11T22:10:42.807384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-11T22:10:42.811605Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.811605Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:3580dec68885c3af63a5b047be309c118bba883903209a4e8f820acae00ac540","observation_id":"7f9adaba-a05d-4506-951a-5f0a1f458435","resolution":{"observed_at":"2026-08-11T22:10:42.811605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-11T22:10:42.815984Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.815984Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:840d8137d4ea7762edfb8cdd17d571ddd4507345db313c5628e603534a11c7a9","observation_id":"df48a05e-77ca-4755-89f8-b0ea97236c21","resolution":{"observed_at":"2026-08-11T22:10:42.815984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.820855Z","title":"High-resolution image syn- thesis with latent diffusion models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.820855Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:759112ce9a496c72d1dbd33c4c9a8b3276b2f318c96449acc6f8d9dbfe8fbde4","observation_id":"8aeddf26-feda-4eb1-926c-e523e8db44f9","resolution":{"observed_at":"2026-08-11T22:10:42.820855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.824878Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.824878Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:ba4ce81795bd8ab7033c5178e7400e5dc6617a3ba78271462ada6ee863a9c2ce","observation_id":"454ca325-a6cd-4718-adbc-889234402ef2","resolution":{"observed_at":"2026-08-11T22:10:42.824878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.829220Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.829220Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:f12c68303ddcb0b4d4aca94d153f735f30e17e3b3d64ad659f4611b503e3ca52","observation_id":"e5b68ca4-6c4b-4c21-88f9-c2c58f72c768","resolution":{"observed_at":"2026-08-11T22:10:42.829220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.833716Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.833716Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:6d4993feb5a41cc9126df1d8eb0eadb4ca7174bf8d32bfef9fa053d5c67d2af1","observation_id":"6fc350f5-0561-47de-92d9-5791bf87c1ec","resolution":{"observed_at":"2026-08-11T22:10:42.833716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.712905Z","title":"Contrastive pseudo learning for open-world deepfake attribution","venue":null,"work_id":"25eabdb2-faa9-4af2-bae5-0f7a6b384575","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.838159Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:25a981d8b7c9efbb368e38899c5ce37f95801a1abb30ab56ff2a91b05ac15803","observation_id":"14ecfe45-662a-4917-930a-6737bd61192e","resolution":{"observed_at":"2026-08-11T22:10:43.718028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.697585Z","title":"Rethinking open-world deepfake attribution with multi-perspective sensory learning","venue":null,"work_id":"4e200289-3884-4472-8b5d-85bf229d97f8","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.843197Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:fd62192a861cbda01e599cd2374585480c95c25b594854e521a7f613d637e05f","observation_id":"1c9e1783-185d-4c26-bc2f-f7e664fb722e","resolution":{"observed_at":"2026-08-11T22:10:43.702785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.680706Z","title":"Ata: Adaptive transformation agent for text-guided subject- position variable background inpainting","venue":null,"work_id":"fe2f1032-f3a0-4f0e-9223-66eef43a17f6","year":2025},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.847832Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:18a4382d36a2acc71ebd951e04d1e0b3ab7c388eaed28eab3aa024283628b0a0","observation_id":"798eab2e-d97e-4aa7-b0ad-fa6e202f83ef","resolution":{"observed_at":"2026-08-11T22:10:43.686704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.852344Z","title":"Kolors: Effective training of diffusion model for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.852344Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:56dcfa868f2aa80e652b601ba00d987a3dcba5888fed30d85bd8268a7c9b5c6b","observation_id":"daeb6243-8bb2-4db6-bb3b-d8a0a6667dd5","resolution":{"observed_at":"2026-08-11T22:10:42.852344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.655265Z","title":"Pyramid-vae-gan: Transferring hierarchical latent variables for image inpainting","venue":null,"work_id":"7d09c135-3c74-4e2e-9740-c30778e5080e","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.856844Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:c99c80bd73f96553c76784dd1708c3e6248c595728ff59c16fad306aefa0c41b","observation_id":"eb2ad6ba-8a75-4c13-8993-22cd0d218ed5","resolution":{"observed_at":"2026-08-11T22:10:43.660169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.640579Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"621d7f03-3bce-4f6b-ab57-ac74c3e4cee2","year":1921},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.861696Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:95fe6a48068430204303a1a2af95d9ca0b5a0b8c689d8abeb4c8cc39fb340881","observation_id":"7369cf4c-e6fe-45df-8266-e06563a1824d","resolution":{"observed_at":"2026-08-11T22:10:43.645478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07519","last_updated":"2024-02-02T16:15:22Z","snapshot_observed_at":"2026-08-06T23:08:20.817133Z","submitted_at":"2024-01-15T07:50:18Z","title":"InstantID: Zero-shot Identity-Preserving Generation in Seconds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07519","snapshot_observed_at":"2026-08-11T22:10:42.865954Z","title":"Instantid: Zero-shot identity-preserving generation in seconds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.865954Z"},"links":{"cited_paper":"/paper/2401.07519","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:33d7f3e7cddc13db5d603a6f6e1c7f94138dd068e7e5979e8d5803b4ab17ffdd","observation_id":"6265894c-3761-4580-88e3-2eae0d4aedc4","resolution":{"observed_at":"2026-08-11T22:10:42.865954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.625246Z","title":"Noise based deepfake de- tection via multi-head relative-interaction","venue":null,"work_id":"296dfc9b-ad46-4f0c-8a39-28ff6eb6e3ed","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.870826Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:250db50f49f5e2a2f1f27d27f65823c52f70d1f26f426a404cd6e3256a383abb","observation_id":"c171cb8a-a058-457d-9c74-77af443b22de","resolution":{"observed_at":"2026-08-11T22:10:43.630237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.609699Z","title":"Florence-2: Advancing a unified representation for a variety of vision tasks","venue":null,"work_id":"e3dafd8f-1d1a-4d96-9a9c-c24ca2ef4ba8","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.875156Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:6cad6c22a2277b9ffbcaa881ca6457c51cfd6311e5aa9da1f53bb2ed1ffccdd6","observation_id":"78cf2281-4624-4967-91bf-0d7bef5ae753","resolution":{"observed_at":"2026-08-11T22:10:43.614665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02848","last_updated":"2023-10-04T14:34:11Z","snapshot_observed_at":"2026-08-13T05:57:34.130404Z","submitted_at":"2023-10-04T14:34:11Z","title":"Magicremover: Tuning-free Text-guided Image inpainting with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02848","snapshot_observed_at":"2026-08-11T22:10:42.879911Z","title":"Magicremover: Tuning-free text-guided image inpainting with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.879911Z"},"links":{"cited_paper":"/paper/2310.02848","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:2da0616a81dc7a045d7b3ddf841ffc86c05b0bbea76e34233e4bd0e320e25d71","observation_id":"fb01cda3-6327-4b17-9981-d541bcbf4f74","resolution":{"observed_at":"2026-08-11T22:10:42.879911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-11T22:10:42.884443Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.884443Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:2fd8f8d165b51711abc5962a6684759857fb9bc476acb67c25040dc3ef4c9b03","observation_id":"ca728cf1-0938-4682-9330-0c95d679f7d3","resolution":{"observed_at":"2026-08-11T22:10:42.884443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.889451Z","title":"Feditnet++: Few-shot editing of latent semantics in gan spaces with correlated attribute disentanglement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.889451Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:fa7e87571d1765c3cb94e05bbb7a542df28e5f3120d77f3fb85993dd55573dfd","observation_id":"f9d702bb-a3d7-4ad7-9364-b87aa095fd57","resolution":{"observed_at":"2026-08-11T22:10:42.889451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.584371Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"45763fc5-94ba-4fdb-b9c2-3aa53e09794d","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.894952Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:6578eb146d8d7f1e64a8004dbab2f667e1a7168783d226c28436d9c52265355d","observation_id":"fe5f806a-1614-48fd-adba-57e636cf5989","resolution":{"observed_at":"2026-08-11T22:10:43.589397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:42.899551Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.899551Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:471524f77763351768e872baf25d9fb78f29589d8b8d9124aa427d548c64952b","observation_id":"6136f20b-5167-404e-a31a-997b31cc10e2","resolution":{"observed_at":"2026-08-11T22:10:42.899551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16199","last_updated":"2024-09-18T23:54:36Z","snapshot_observed_at":"2026-08-13T10:46:50.834601Z","submitted_at":"2023-03-28T17:59:12Z","title":"LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.16199","snapshot_observed_at":"2026-08-11T22:10:42.905132Z","title":"Llama-adapter: Efficient fine-tuning of language models with zero-init attention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.905132Z"},"links":{"cited_paper":"/paper/2303.16199","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:7b3f3af7e785077f3e706a540d3a825a883a26162ebec48116501ec3bfd35298","observation_id":"8cade67c-4219-4b95-8e56-1e8d3efe7e3d","resolution":{"observed_at":"2026-08-11T22:10:42.905132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03407","last_updated":"2025-07-25T09:10:48Z","snapshot_observed_at":"2026-08-13T04:47:52.336174Z","submitted_at":"2024-01-07T07:56:47Z","title":"Bilateral Reference for High-Resolution Dichotomous Image Segmentation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03407","snapshot_observed_at":"2026-08-11T22:10:42.910379Z","title":"Bilateral refer- ence for high-resolution dichotomous image segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.910379Z"},"links":{"cited_paper":"/paper/2401.03407","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:30f097095cc1be467ac3a3181422a980ea0e5cbac5b2f360e004911d98c0a6a4","observation_id":"ac9680e8-a071-4807-bee6-c62fdf0252f9","resolution":{"observed_at":"2026-08-11T22:10:42.910379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.559085Z","title":"Beta-tuned timestep diffu- sion model","venue":null,"work_id":"792b0452-58eb-4bae-911e-0750e209f4a0","year":2024},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.915569Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:dc94455d23c74c7a3ce3ccef7dc3a97eae2e6f747287bbc8fd5c669b473f9593","observation_id":"83f38bab-c9eb-4589-88e6-08593b7d06d5","resolution":{"observed_at":"2026-08-11T22:10:43.564404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03594","last_updated":"2024-07-23T11:48:57Z","snapshot_observed_at":"2026-08-13T05:08:38.821368Z","submitted_at":"2023-12-06T16:34:46Z","title":"A Task is Worth One Word: Learning with Task Prompts for High-Quality Versatile Image Inpainting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03594","snapshot_observed_at":"2026-08-11T22:10:42.920216Z","title":"A task is worth one word: Learning with task prompts for high-quality versatile image inpainting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.920216Z"},"links":{"cited_paper":"/paper/2312.03594","citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:256ef7ec57542b41350b2a428c27c5560a9ac47eb155ffebcf3f6102750a3f22","observation_id":"2265efe4-49dc-4b7b-a396-dbec4c5a0992","resolution":{"observed_at":"2026-08-11T22:10:42.920216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.544447Z","title":null,"venue":null,"work_id":"49e88a97-c591-483e-9780-5b249d33696d","year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.925406Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:15e96ead2017245ca477247142bf4902d2ea81aca5b0c72eb0aed59ab888a80f","observation_id":"5bdc42c4-f849-4c5c-b902-c96c18fd7eb9","resolution":{"observed_at":"2026-08-11T22:10:43.549075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.527706Z","title":"Determine whether the is placed in a physically impossible position, such as floating","venue":null,"work_id":"eeebb5da-1c35-42a0-9d9d-6633bfcdc455","year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.930190Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:4963b0ffcd00b7803fec06c5055f51292a3869f26912ca84195a9d54f8d533ae","observation_id":"205b80c0-7014-4d36-92e3-f12424ab94f4","resolution":{"observed_at":"2026-08-11T22:10:43.532940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.509755Z","title":null,"venue":null,"work_id":"f10b94cb-6ab2-4bd5-a68c-0cbce018c14c","year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.935731Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:24d74dd47cdba1f00ce49aabbd24c2cc1e9a2fa38c367d4363bc914fe8475bf3","observation_id":"811737f2-3930-470d-93a9-4185bd66260b","resolution":{"observed_at":"2026-08-11T22:10:43.514385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.494735Z","title":"## Rating Criteria: - 1 point: Obvious errors, inconsistent with the real world","venue":null,"work_id":"e1a0c1fa-79bd-4b6f-90a4-92abf1324d38","year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.941026Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:087df0c81126f79214da68ea50336520daec26a5aefb8428edf32111541b367e","observation_id":"a7999887-2cd5-48ea-a68b-9c5fe3c29342","resolution":{"observed_at":"2026-08-11T22:10:43.499629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.478945Z","title":"The bag is situated on the same level as the sitting dog, and it does not appear to be floating or placed in an unnatural position","venue":null,"work_id":"30d1da6c-6c80-466c-b56e-a38af33360e8","year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.946416Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:f86ab4e2176227b76bed5605f13979f4937a4bf5f838259cbbf6ee8f8a390c12","observation_id":"fc995d35-8a68-43a2-b8d4-d253a71c53df","resolution":{"observed_at":"2026-08-11T22:10:43.484101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.460642Z","title":"The dog food bag is reasonably large, similar to what would be expected for a product of that nature, and it does not appear disproportionately large or small compared to the dog","venue":null,"work_id":"73b85a11-2968-48c7-996c-b43baf7eeefe","year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.951921Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:251c7f49b98bd2b6147f51cc03e1fc8ad4fee3ec47216b49a9bb6165218c9777","observation_id":"a301cb21-a39d-4b9b-80d9-973ead94d7d2","resolution":{"observed_at":"2026-08-11T22:10:43.467432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:43.443755Z","title":"A car on the street at night","venue":null,"work_id":"de86018a-b9e0-4edb-bc87-fa8032ebf172","year":null},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.957049Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:a02f52d72b8ec4017bdc4fb7a575a55717c54fde384691e0aa0630fec3026af7","observation_id":"2192498c-9d9d-4509-8ced-4211ea39c254","resolution":{"observed_at":"2026-08-11T22:10:43.449800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:10:44.045130Z","title":"2, 3, 7, 13","venue":null,"work_id":"5e662170-2e7a-4d3d-8b33-4d82e3332a2c","year":2023},"citing_paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T22:10:42.647767Z"},"links":{"citing_paper":"/paper/2412.03812"},"observation_digest":"sha256:f1c52f251ff05f7aac07af1a446857f6154fdb0b29a42d59afcd71c887838acd","observation_id":"60b88d26-d773-456c-8987-39a96ce76006","resolution":{"observed_at":"2026-08-11T22:10:44.050223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.03812","last_updated":"2025-08-06T09:14:21Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T10:47:36.194799Z","submitted_at":"2024-12-05T02:08:19Z","title":"Pinco: Position-induced Consistent Adapter for Diffusion Transformer in Foreground-conditioned Inpainting"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":35},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 0 inbound Pith citation observations for arXiv:2412.03812."}