{"as_of":"2026-08-17T08:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3c76874a7e3cc9657738fe320da53e77d13fa9b4d69116918b910215f6c2463b","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:45:33.531032Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:13:39.262818Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T19:13:40.710529Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"cited_work":{"arxiv_id":"2412.03150","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03150","snapshot_observed_at":"2026-08-15T19:13:40.710529Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","venue":"cs.CV","work_id":"1a1ea09e-4b53-4a1e-9ffa-d9c2ee1875e1","year":2024},"citing_paper":{"arxiv_id":"2506.17220","last_updated":"2025-06-23T02:14:32Z","snapshot_observed_at":"2026-08-16T13:42:56.567515Z","submitted_at":"2025-06-20T17:59:55Z","title":"Emergent Temporal Correspondences from Video Diffusion Transformers","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T19:13:39.262818Z"},"links":{"cited_paper":"/paper/2412.03150","citing_paper":"/paper/2506.17220"},"observation_digest":"sha256:95faec2511e42c790374ac884452befa6140b200572a702b3e5f13dd50a2aaaa","observation_id":"97805d44-ad69-4e2d-9d20-55c463834da5","resolution":{"observed_at":"2026-08-15T19:13:40.767937Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.03150/citation-record","integrity":"/paper/2412.03150/integrity","json":"/paper/2412.03150/citation-record.json","paper":"/paper/2412.03150"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:37.286329Z","title":"Cross-image attention for zero- shot appearance transfer","venue":null,"work_id":"b4f1cdaf-e9d3-4d11-a151-98b96df80130","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.020018Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:86ebda6169c514aa08e201bef797be014ee7ce1ddb25f65aa7d179ab1e49e2e3","observation_id":"dd7519c4-84ca-449e-a888-63c643065853","resolution":{"observed_at":"2026-08-11T22:45:37.297212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:37.234178Z","title":"Masactrl: Tuning-free mu- tual self-attention control for consistent image synthesis and editing","venue":null,"work_id":"26967699-d8e1-4390-abef-42024a3ab934","year":2023},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.042275Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:43d4d7ea60445108af77daf5cd7b47d42795ea04df74fd23620e2363ab046ece","observation_id":"796bb220-595d-462c-92a0-b36895db3c18","resolution":{"observed_at":"2026-08-11T22:45:37.247906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11904","last_updated":"2024-10-15T14:23:46Z","snapshot_observed_at":"2026-08-16T23:04:28.544810Z","submitted_at":"2024-09-18T12:02:20Z","title":"Finding the Subjective Truth: Collecting 2 Million Votes for Comprehensive Gen-AI Model Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11904","snapshot_observed_at":"2026-08-11T22:45:32.067411Z","title":"Finding the subjective truth: Collecting 2 million votes for comprehensive gen-ai model evaluation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.067411Z"},"links":{"cited_paper":"/paper/2409.11904","citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:5e0fd451b557410a0470a15c2ee3b30738375470a4606e2a5750e01566bcf2d5","observation_id":"e277ac6e-d0e7-44b8-ba0e-b043b3ebf3f2","resolution":{"observed_at":"2026-08-11T22:45:32.067411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:37.185238Z","title":"The cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":"3b03bb06-2c9b-4ed9-8bdb-0fd8373054ea","year":2016},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.095865Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:ccabcd78ac6cd512eb43277c72acbdf29d6a18a6ec1543458821c19b54001a0c","observation_id":"c7fa7e50-d0d0-4f18-83e8-5809d4258850","resolution":{"observed_at":"2026-08-11T22:45:37.200307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:37.133168Z","title":"Diffusion models beat gans on image synthesis, 2021","venue":null,"work_id":"0339f84e-3a53-450a-b206-8b2fce82a38a","year":2021},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.104075Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:61dc5311d65cff237240972e57695d9c1f4898c11f313a5872d5788cc64754c9","observation_id":"911f6084-84af-41ab-aad6-70ca984ca66f","resolution":{"observed_at":"2026-08-11T22:45:37.144397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:37.084559Z","title":"Towards pragmatic semantic image synthesis for ur- ban scenes, 2023","venue":null,"work_id":"344f1689-d7ce-4c09-b9c4-1dba7c95015a","year":2023},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.119366Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:8168f255718f940dec392e180140807bad60c42a49ef483fbae0076d701af318","observation_id":"4566e45d-d824-429b-9b6d-fa956713cdc9","resolution":{"observed_at":"2026-08-11T22:45:37.100924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:37.024743Z","title":"Encoder-based domain tuning for fast personalization of text-to-image models.ACM Transactions on Graphics (TOG), 42(4):1–13, 2023","venue":null,"work_id":"314f9ef9-e3bb-402b-acc5-4d419a8e7459","year":2023},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.150067Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:c2a787fd06a9a5625fd7ad883cd5d6462462a2d3a260c64a50eb0daafde7a390","observation_id":"732800a1-1123-42e8-b02f-409a13af943d","resolution":{"observed_at":"2026-08-11T22:45:37.044738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:36.954741Z","title":"Generative view synthesis: From single- view semantics to novel-view images, 2020","venue":null,"work_id":"b443766d-a1fd-4000-89ff-5e8b7357bbc5","year":2020},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.205617Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:b6d420f1396426dcc5c11ce0baad4f10948cf7fabece67a379addb8c4c442e64","observation_id":"d088cea3-9cc5-474e-8cd2-141b866ecb7f","resolution":{"observed_at":"2026-08-11T22:45:36.975763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:36.848697Z","title":"Classifier-free diffusion guidance, 2022","venue":null,"work_id":"75ad3783-0c52-4d2b-90ad-d5008a903085","year":2022},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.217265Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:3098c0a4cfd7ae415b18cf33d2b520a700ae84f110d91d5e5ca740cf25ea74ad","observation_id":"4c38e3aa-f1a1-4006-8d71-ac7e7996f7d1","resolution":{"observed_at":"2026-08-11T22:45:36.877567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:36.804743Z","title":"Neural matching fields: Implicit representation of matching fields for visual correspondence, 2022","venue":null,"work_id":"fa4078f7-d691-4a36-bac4-7eaf6b4f0397","year":2022},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.228070Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:4855cf100224dce30b12dcb81a2d5573f745a9e08c0e473bb944d2e79483cebd","observation_id":"efe6ba03-c52a-47ac-89db-91175721b636","resolution":{"observed_at":"2026-08-11T22:45:36.815275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:36.750659Z","title":null,"venue":null,"work_id":"d568cc41-4548-4598-95de-42f5e62cd267","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.236719Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:55724b22218d2bb8b18b24ffa02c40c461e4edfa7bdbff9265c5360e6cea67f1","observation_id":"b106143d-7ab7-488a-8b2f-d195e7246502","resolution":{"observed_at":"2026-08-11T22:45:36.770276Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:32.246360Z","title":"Animate anyone: Consistent and controllable image- to-video synthesis for character animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.246360Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:fa2066a438b5c979a30fe037eb2c8e51564efc7214874b0bdfd0347c233dfc2a","observation_id":"bdbe0872-9497-49c3-8df7-a2a502e04404","resolution":{"observed_at":"2026-08-11T22:45:32.246360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:36.565395Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation, 2024","venue":null,"work_id":"eb57c650-a388-4098-b06f-b8dab4689981","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.262416Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:a13420e73062fdd0a7a495f47f03101774ddc629748f85afdcc6e29aa883fa43","observation_id":"0c59fbd0-f0e7-42bd-995d-08036d066b39","resolution":{"observed_at":"2026-08-11T22:45:36.595619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04485","last_updated":"2024-11-11T06:32:24Z","snapshot_observed_at":"2026-08-16T13:45:21.789638Z","submitted_at":"2024-06-06T20:15:42Z","title":"GenAI Arena: An Open Evaluation Platform for Generative Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04485","snapshot_observed_at":"2026-08-11T22:45:32.334529Z","title":"Genai arena: An open evaluation platform for generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.334529Z"},"links":{"cited_paper":"/paper/2406.04485","citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:34cc6df09b2eb9d6c75e2fb2d0606845ba896f642f091bb1e51c77741c39cead","observation_id":"d84d9174-0803-4dc9-8c9c-1f3efe3e985f","resolution":{"observed_at":"2026-08-11T22:45:32.334529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13743","last_updated":"2024-11-03T20:22:32Z","snapshot_observed_at":"2026-08-16T13:41:21.785733Z","submitted_at":"2024-06-19T18:00:07Z","title":"GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13743","snapshot_observed_at":"2026-08-11T22:45:32.398178Z","title":"Genai-bench: Evaluating and improv- ing compositional text-to-visual generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.398178Z"},"links":{"cited_paper":"/paper/2406.13743","citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:730baca0021259cc37d89352e5f84603b49265e49eb5b3e9a4f9262f66eb3430","observation_id":"376e513f-6908-436a-b939-e06b0f8971c1","resolution":{"observed_at":"2026-08-11T22:45:32.398178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:36.456341Z","title":"Controlnet++: Improving conditional controls with efficient consistency feedback","venue":null,"work_id":"b74fd977-5bb0-4733-bcc4-b51fca457277","year":2025},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.428926Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:521456aabce8e0ee238b098783bb7c971d412ef8fde742e78e87ae085fbe7930","observation_id":"7778032f-9e33-4014-b7ce-2adc153df15f","resolution":{"observed_at":"2026-08-11T22:45:36.503714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:36.358719Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":"b30cdb06-3c5b-4dad-a4fe-f9321b176f85","year":2023},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.448091Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:4cf3ccea2260f573b32aca4f5694926845167a84f246beefb44a4fa4db7ef40a","observation_id":"d29cfad6-c9bf-45fc-af72-dfcec042ad7b","resolution":{"observed_at":"2026-08-11T22:45:36.399553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:36.234804Z","title":"Photomaker: Customizing re- alistic human photos via stacked id embedding","venue":null,"work_id":"2926a7b9-5379-45da-804e-12750e1526de","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.496870Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:7c3ec725198119f63b100c8e3e1bf7a54e13e434f3a58b51e97ce3d4f368fb50","observation_id":"891b6d2a-6f0f-439b-a156-2f627a36bb8b","resolution":{"observed_at":"2026-08-11T22:45:36.284742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07540","last_updated":"2024-12-11T06:53:55Z","snapshot_observed_at":"2026-08-16T13:44:03.214903Z","submitted_at":"2024-06-11T17:59:01Z","title":"Ctrl-X: Controlling Structure and Appearance for Text-To-Image Generation Without Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07540","snapshot_observed_at":"2026-08-11T22:45:32.555143Z","title":"Ctrl-x: Controlling structure and appear- ance for text-to-image generation without guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.555143Z"},"links":{"cited_paper":"/paper/2406.07540","citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:a34c57dafa52d158753bf9166e9e39716e847f09e2ab87ceb97cc321ca2370b7","observation_id":"b612a148-9e8b-45d8-aacf-6bbf1a3bfa4c","resolution":{"observed_at":"2026-08-11T22:45:32.555143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:36.075231Z","title":"Evaluating text-to-visual generation with image-to-text gen- eration","venue":null,"work_id":"d9469020-3ae1-4d46-83c6-47b1c34f5215","year":2025},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.576158Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:012b09886dd3d8e0444f74a273424774e10a40b366f1cc681b4403c462373f5d","observation_id":"e21d68eb-6da4-4b7f-9c25-486208e3fad5","resolution":{"observed_at":"2026-08-11T22:45:36.134753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.960372Z","title":"Decoupled weight decay regularization, 2019","venue":null,"work_id":"f07e4269-891f-4934-8190-a94a685e85da","year":2019},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.584224Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:2383a30f5652ee5f713f79d30c604c1787bd2f486131663a8d74a1bbf5b9aee8","observation_id":"69634781-00f7-4604-9f16-f2c647c5ee07","resolution":{"observed_at":"2026-08-11T22:45:35.989751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.837340Z","title":"Siedob: Semantic image editing by disentangling object and background, 2023","venue":null,"work_id":"c590af17-748e-4e15-9da1-b3c4e20801b4","year":2023},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.594011Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:ef1bd224b612411592bc2388ba0aa9da55a70f4ff98239ac44356adb1f2e3f6f","observation_id":"fe0b0733-3c8a-4c81-a5e3-d08e90ce8f40","resolution":{"observed_at":"2026-08-11T22:45:35.862036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.788255Z","title":null,"venue":null,"work_id":"67ef260c-d6b4-4163-b646-eeb3bbf587c0","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.621387Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:880e56579bda0fad0ec0d7268f197488d01adde3d6cbf9c6b22dd90ffc037a81","observation_id":"37b1ef8d-3b23-4391-ae3b-805d2f8d9f74","resolution":{"observed_at":"2026-08-11T22:45:35.794564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.741125Z","title":"Hypercorrela- tion squeeze for few-shot segmentation, 2021","venue":null,"work_id":"a761a12b-9ce0-4809-96fb-bfeecaa2c55e","year":2021},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.637081Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:0096a3bc275009080a46e88629b3d61761a90e64d5201c5097bd72d6ed40bf70","observation_id":"05b70c25-5897-4fae-9162-fb9e2402872e","resolution":{"observed_at":"2026-08-11T22:45:35.763046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.689737Z","title":"Freecontrol: Training-free spatial control of any text-to-image diffusion model with any condition","venue":null,"work_id":"0829b720-8b40-4f43-9676-c0ebefe4d0bb","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.704749Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:1200d6bc370ef6f4a258ae6850b54969981c067ccd02f02d22d171df2701878a","observation_id":"864634df-4366-4817-a05b-d1ad49e43ab4","resolution":{"observed_at":"2026-08-11T22:45:35.725547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.638670Z","title":"Null-text inversion for editing real im- ages using guided diffusion models","venue":null,"work_id":"9eae14be-640e-4906-a36d-6cd7e6f8d6c5","year":2023},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.757442Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:e9628d7c6542c99a0826e3e10caf085a01106671695c6b613a5f3c03ad18bdce","observation_id":"6bca500f-cfc4-4528-900f-07005a63fe66","resolution":{"observed_at":"2026-08-11T22:45:35.653182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.595423Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":"48e94019-c442-4a04-a923-a25cac8eb686","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.783704Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:fcdbed79f3cb20d173125722304ef60a2ed2c703c76add80885298b5c48e8f36","observation_id":"5c8dac34-4eec-4ae7-8f88-3dd54e805490","resolution":{"observed_at":"2026-08-11T22:45:35.614809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.449304Z","title":"Dreammatcher: Appearance matching self-attention for semantically-consistent text-to- image personalization","venue":null,"work_id":"c0eb09a0-43db-4b51-8046-999b3882f5cf","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.795116Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:ee6b14c290151ae2abb825fafeead444ebb15187f1ca35fdd6d6243fbc50a586","observation_id":"5e5b410b-261a-4b2c-960d-3e0c24effec9","resolution":{"observed_at":"2026-08-11T22:45:35.493824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.333485Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"276d8e9b-3956-4698-b1ed-7cd35edee9f9","year":2012},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.805023Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:cbe412a6db961a55aa7e46089fa19ffecdbf124d1ae17950a3f5493aeb79a839","observation_id":"b19ede61-c1a9-46f2-991e-29ef73831032","resolution":{"observed_at":"2026-08-11T22:45:35.394745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:32.822966Z","title":"Semantic image synthesis with spatially-adaptive nor- malization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.822966Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:6fd43bf48f0bebaab7a7702463910b60fb0858cf2c2b6396c9fa6f68683f38da","observation_id":"a776ce3b-ab59-487c-a3b1-3bb7973af577","resolution":{"observed_at":"2026-08-11T22:45:32.822966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.205204Z","title":"One-step image translation with text-to-image models, 2024","venue":null,"work_id":"34286030-eb3b-4ec7-9250-8bd101992f79","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.832687Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:73077c574e58f39ae4250d64d51c6f4f1a567797431a56262d1f0f1b7b2195c5","observation_id":"e52947d8-26e6-4f33-ba8c-5a656d329067","resolution":{"observed_at":"2026-08-11T22:45:35.232229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06070","last_updated":"2025-03-08T08:43:03Z","snapshot_observed_at":"2026-08-16T13:27:03.453194Z","submitted_at":"2024-08-12T11:41:18Z","title":"ControlNeXt: Powerful and Efficient Control for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06070","snapshot_observed_at":"2026-08-11T22:45:32.882639Z","title":"Controlnext: Powerful and effi- cient control for image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.882639Z"},"links":{"cited_paper":"/paper/2408.06070","citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:d9da96d9da1c6b794984acd69faaed5a9a16190ee1ca2b84ff2fc34e36b53d7d","observation_id":"4be901fc-b036-4041-b9dd-fd7220b6b019","resolution":{"observed_at":"2026-08-11T22:45:32.882639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.133706Z","title":"Portraitbooth: A versatile portrait model for fast identity-preserved personalization","venue":null,"work_id":"98fe8b4a-2d7c-4a1b-af25-238ab0e2b3c3","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.959504Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:de9b3b3cfbd20a3f5c6dac663ea744024e26e16752e9614d02547e05b942b463","observation_id":"53d02ddf-b9be-40db-a3d1-f9f83a47948b","resolution":{"observed_at":"2026-08-11T22:45:35.151823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:35.028271Z","title":"Variational autoencoder for deep learning of images, labels and cap- tions","venue":null,"work_id":"08df2baf-17a3-47b3-b39a-93fb33cf635a","year":2016},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:32.988618Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:6878bc52823d79d5f63b40a4ee55b44e9217f6bb4a1aad7e15b02938aafc0b0d","observation_id":"8e27247a-5f97-4114-828e-7a182cc97d76","resolution":{"observed_at":"2026-08-11T22:45:35.075689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.925504Z","title":"Learning transferable visual models from natural language supervision, 2021","venue":null,"work_id":"7b93a07e-d5f6-42d9-91d1-8fccd7c5247c","year":2021},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.023325Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:746330bb1d835624ef29f19671a8102e352d222da5cae7e671ddcacd86a2f6ee","observation_id":"46aabb65-7273-4195-aafe-927202fe3917","resolution":{"observed_at":"2026-08-11T22:45:34.953756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:33.041268Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.041268Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:6d475fb73dbdec2486cc450bc3ffec3878d993ebc379f236a4cca0bdf96448d0","observation_id":"0b0f19fe-8c7a-41a1-adb9-edc0c6517783","resolution":{"observed_at":"2026-08-11T22:45:33.041268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-11T22:45:33.060792Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.060792Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:22a1d6a56a250cff3ccc10a5de7a0ae31bf88d95deeac032346264dabaced7c0","observation_id":"0b71ff74-9232-46bc-baae-577e960cabb0","resolution":{"observed_at":"2026-08-11T22:45:33.060792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.785756Z","title":"Data augmentation using random image cropping and patch- ing for deep cnns","venue":null,"work_id":"c08366e8-0695-41e1-8bdd-ef83a5040490","year":2020},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.070985Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:540c8f3f2bfc417c2d698376123228e033580b0062c86f95440b72a9fdb82df4","observation_id":"3200dad4-f774-4373-9974-bd4ce6908665","resolution":{"observed_at":"2026-08-11T22:45:34.828850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16562","last_updated":"2024-10-10T14:04:07Z","snapshot_observed_at":"2026-08-16T13:40:10.520877Z","submitted_at":"2024-06-24T11:56:15Z","title":"EVALALIGN: Supervised Fine-Tuning Multimodal LLMs with Human-Aligned Data for Evaluating Text-to-Image Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16562","snapshot_observed_at":"2026-08-11T22:45:33.080290Z","title":"Evalalign: Evaluating text- to-image models through precision alignment of multimodal large models with supervised fine-tuning to human annota- tions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.080290Z"},"links":{"cited_paper":"/paper/2406.16562","citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:a66da7836345a9a184d54b3422517626f477b097d58f8a7431ee4c1e2cbfe34b","observation_id":"87acb49c-979b-4710-91e4-1ed0decbf7c2","resolution":{"observed_at":"2026-08-11T22:45:33.080290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.746646Z","title":"Splicing vit features for semantic appearance transfer,","venue":null,"work_id":"4bfb1073-c424-4c8a-82d8-10cd0edef84d","year":null},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.112458Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:d009ecedf31c89bd336098757ad6991c8885b133e5327d945a4e83084e8e9740","observation_id":"c38ca6c1-b9fc-4593-a09e-4c6fec484156","resolution":{"observed_at":"2026-08-11T22:45:34.754150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:33.152353Z","title":"Seman- tic image synthesis via diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.152353Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:1efd5cd61bace008ccfe637c85629a6243f495370be2ef0758536514a2c8dd54","observation_id":"a052ccc3-2bd5-474a-9550-bd9623d8f99f","resolution":{"observed_at":"2026-08-11T22:45:33.152353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.668415Z","title":"Fastcomposer: Tuning-free multi- subject image generation with localized attention","venue":null,"work_id":"1230aabb-1ed8-4368-89c1-9d5f4e24eeb0","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.167241Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:35a8102697db0f7f566b3ed97addae48318c01a215eceb07d181ec492e846673","observation_id":"836ba818-c2fa-4626-8065-1f2bb3e21eec","resolution":{"observed_at":"2026-08-11T22:45:34.727403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.567874Z","title":"Freestyle layout-to-image synthesis, 2023","venue":null,"work_id":"fbf32ddf-ea96-49ff-95c6-55e8d52b94c1","year":2023},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.214829Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:85654941896ef40ec22bef94e9c8eafbc9f18592d033a37b0be20da4f0f24e85","observation_id":"eecad05a-3124-4af8-b870-271f5ebf7378","resolution":{"observed_at":"2026-08-11T22:45:34.604748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-11T22:45:33.277334Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.277334Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:e26615b5626c5b20a9672d1d0523cf2f27f4bf6f55f8fb7e54ae4e2245f719ab","observation_id":"3339a7ec-7212-4724-80c0-c02619202be4","resolution":{"observed_at":"2026-08-11T22:45:33.277334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.329148Z","title":"Bdd100k: A diverse driving dataset for heterogeneous multitask learning","venue":null,"work_id":"e3af68fb-16b1-4a26-9d08-551c8653c7b7","year":2020},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.374829Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:773ef0edb353b5b05d22c99cb41554a8c357da20b6402be9eea063fb8198f422","observation_id":"724afe0e-2665-4eee-9eb3-e72571790322","resolution":{"observed_at":"2026-08-11T22:45:34.349693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.261284Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"bf372f0e-30f1-43b1-b126-5d23398cbddf","year":2023},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.402114Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:781359b808ec18d5b0e1e1d5a27b8b105c16a75ab40037ae627c21a9e76caf5a","observation_id":"755f0aa3-e3b3-42e1-85c4-bd5de562e5da","resolution":{"observed_at":"2026-08-11T22:45:34.293309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.225632Z","title":"Uni-controlnet: All-in-one control to text-to-image diffusion models","venue":null,"work_id":"5c22e1e8-be41-4825-82dc-15df45d783fb","year":2024},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.500855Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:46dda0235579580c1f521fbe027b64e763afb84cc0f1ed108a01a8ee2647c498","observation_id":"1ec85bd8-4125-498f-9bc7-3a2369449f3d","resolution":{"observed_at":"2026-08-11T22:45:34.233009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.106899Z","title":"Flipda: Effective and robust data augmentation for few-shot learning, 2022","venue":null,"work_id":"2574f771-4a83-439d-b792-c482a205f293","year":2022},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.512898Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:f6fc3295a098cd95761362a5d9c1f4658dd1e133d6b3b01196a04ef1f27ff6c4","observation_id":"b91827e8-e869-4518-a5c1-c4626ac07ebe","resolution":{"observed_at":"2026-08-11T22:45:34.182657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.021158Z","title":null,"venue":null,"work_id":"0c377702-ef84-4508-a4d2-39581453a8f8","year":2023},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.531032Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:30534466cfe66f3d124dbcd642c3e39afba9834f45147d61b2edc24a2e7198d4","observation_id":"97f23fcb-14d9-46f5-a1d8-b2e0881c3855","resolution":{"observed_at":"2026-08-11T22:45:34.049229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T22:45:34.420146Z","title":null,"venue":null,"work_id":"2c4c66d8-7a70-47be-9405-9d371e142050","year":null},"citing_paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T22:45:33.324882Z"},"links":{"citing_paper":"/paper/2412.03150"},"observation_digest":"sha256:ab4b3ac3dc79b8bb0e9d074f19a495c8e10fd67b6417a8f0233dd03306f1eb7e","observation_id":"6416281d-b746-49f2-8436-22ed7ea29b79","resolution":{"observed_at":"2026-08-11T22:45:34.474760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.03150","last_updated":"2025-03-18T07:31:49Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T04:35:28.437141Z","submitted_at":"2024-12-04T09:17:47Z","title":"Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":34},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 1 inbound Pith citation observation for arXiv:2412.03150."}