{"as_of":"2026-08-08T06:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5f229eda934a8bf06fbd4e0d7a56b3810d17e7622cc0217287367902132b89d6","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:14:52.788211Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.22360/citation-record","integrity":"/paper/2505.22360/integrity","json":"/paper/2505.22360/citation-record.json","paper":"/paper/2505.22360"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:15:00.773778Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":"e1b76878-4eb4-44a2-99a9-178cecb92784","year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:45.689146Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:8508a815ef5af58ca0d33cde4fc25489b64bae064ce044c23e89ff646ed9732f","observation_id":"91f153a5-8045-4133-b3aa-ee83675e5305","resolution":{"observed_at":"2026-08-07T13:15:00.832237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-07T13:14:45.731108Z","title":"ediff-i: Text-to-image dif- fusion models with an ensemble of expert denoisers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:45.731108Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:6041f921fd66786c3c49c459ed59e63e691def0a6e5323f0080b344636e30377","observation_id":"cfaec9be-ac44-4d80-b2ff-1bec1a79e8d8","resolution":{"observed_at":"2026-08-07T13:14:45.731108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:15:00.585658Z","title":"Multimodal garment designer: Human-centric latent diffusion models for fashion image editing","venue":null,"work_id":"a419e181-dabd-483f-ae99-0ca66e90982a","year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:45.807165Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:856bf3a138affcc93699ea28c8739684f0d4bb2784f968b83017c155dcd69a45","observation_id":"d295b597-6b91-4490-8afa-1e9c8dc1f0ea","resolution":{"observed_at":"2026-08-07T13:15:00.686806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:15:00.365783Z","title":"Text2live: Text-driven layered image and video editing","venue":null,"work_id":"50f60697-3c20-4ba6-82ee-fe9977a8b663","year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:45.880109Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:b1194e3e607c10cc5bc9eea61e66e33a5de02bfc882fdf130fc31d197aa3b654","observation_id":"6289ad92-d421-4a6a-b98f-a6c758cb26fc","resolution":{"observed_at":"2026-08-07T13:15:00.452555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:46.034524Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:46.034524Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:b6508aa8bfac39c34ac473d26981bec9f81d080dd83bb4a2d67bdf60281bf84c","observation_id":"a3f358c2-b535-4d28-b8b0-6b5eea127ce5","resolution":{"observed_at":"2026-08-07T13:14:46.034524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06204","last_updated":"2025-04-09T13:54:59Z","snapshot_observed_at":"2026-08-07T19:39:57.333135Z","submitted_at":"2024-06-26T16:34:33Z","title":"A Survey on Mixture of Experts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06204","snapshot_observed_at":"2026-08-07T13:14:46.169244Z","title":"A survey on mixture of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:46.169244Z"},"links":{"cited_paper":"/paper/2407.06204","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:13c6f568298886fa5c3674441d62a8828229668534f64fbe8fa5d6c9bb8574c6","observation_id":"b6896941-d1f3-4312-a371-d24c8911b994","resolution":{"observed_at":"2026-08-07T13:14:46.169244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:15:00.155702Z","title":"Decoupled textual embeddings for cus- tomized image generation","venue":null,"work_id":"b3ea30b2-9879-448d-b325-89f098ceb582","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:46.252024Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:775e16826b1a2fb5c27e43fd9b911af7d0dbcc04b2bbcc4b1c3ef77d3db2a108","observation_id":"2568ddde-47cc-48ee-b1f2-06cb6513e3a8","resolution":{"observed_at":"2026-08-07T13:15:00.256175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:15:00.011062Z","title":"Disenbooth: Identity- preserving disentangled tuning for subject-driven text-to- image generation","venue":null,"work_id":"7fe25a53-6fe0-4b5d-8b2d-80a382d500b7","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:46.393361Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:8cf53df243a552c4c4a920f42735b2c7f393bbddf1db2c2a3587393764b9d540","observation_id":"6760e80c-ec47-4da6-bf95-6dc42728e98b","resolution":{"observed_at":"2026-08-07T13:15:00.086135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:59.851011Z","title":"Towards aligned layout generation via diffusion model with aesthetic constraints","venue":null,"work_id":"aa6a9fe7-14fd-432f-ad2d-b0be7cf48afb","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:46.541344Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:3f380cb21d32eebb3410c12785931f2eff288b426d15a44307da32a04c5a66d6","observation_id":"a486bef7-b04b-4cf4-b483-7c65298f1a12","resolution":{"observed_at":"2026-08-07T13:14:59.932175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:59.680754Z","title":"Anydoor: Zero-shot object-level im- age customization","venue":null,"work_id":"55e1828b-64f3-4dba-8686-1c95e036259f","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:46.640876Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:578176d365bf5d1c0887961157f641bbe31bd591f562f3dd221b629053e430c7","observation_id":"d8c9d8b7-7bcc-41cb-9851-e5ce35be6257","resolution":{"observed_at":"2026-08-07T13:14:59.756195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:59.516210Z","title":"Diffu- sion models beat gans on image synthesis","venue":null,"work_id":"5be93728-c015-4e9b-a998-000db9cda757","year":2021},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:46.738323Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:63c9651e5bebcff556040e995979fcf6ac4479bcf7bf00aa4eb65800b8418c19","observation_id":"0b57095c-eba2-4f69-93e5-f6b831194511","resolution":{"observed_at":"2026-08-07T13:14:59.588725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:59.363112Z","title":"Dai, Simon Tong, Dmitry Lepikhin, Yuanzhong Xu, Maxim Krikun, Yanqi Zhou, Adams Wei Yu, Orhan Firat, Barret Zoph, Liam Fe- dus, Maarten P","venue":null,"work_id":"23aeaf59-c562-450a-8b32-245fe6d3713a","year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:46.807127Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:48d4c84ba2db6065d405972ca490b329e134b9be85607c6773c52cc67507db0b","observation_id":"d61d9400-97ae-4b27-aa54-fae79a5fcf75","resolution":{"observed_at":"2026-08-07T13:14:59.434058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:59.210357Z","title":"Learning factored representations in a deep mixture of ex- perts","venue":null,"work_id":"ac4acab5-e506-4353-beae-fb99c5148327","year":2014},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:46.931450Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:42882fb408729fa179fb8e17b332499d92dffdec6368507adce28279d265f6cf","observation_id":"fc8939df-58a5-4bce-81ae-25eb1c3edb83","resolution":{"observed_at":"2026-08-07T13:14:59.278240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:47.076520Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.076520Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:1988869a406f112359d755e66ec49392ebd0482b07b27ae2a5f5e3166fbde958","observation_id":"81a3ff12-6790-469e-b853-9d85b4b38903","resolution":{"observed_at":"2026-08-07T13:14:47.076520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:59.000080Z","title":"Switch transformers: Scaling to trillion parameter models with sim- ple and efficient sparsity","venue":null,"work_id":"e446f334-067e-478b-8ac3-5cdf6a7f369e","year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.194412Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:e2e592f7c65e205e7be6471617be66ce4cc4e6570542c321f9eb150b2a374153","observation_id":"f5a6de1e-2908-4ae9-99fd-c2717485da75","resolution":{"observed_at":"2026-08-07T13:14:59.083709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:58.772036Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion","venue":null,"work_id":"7b9912ce-e9fc-4501-8d15-cb03d97b3770","year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.249414Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:c19d34147f50332e2b9e590e722eca5f633a459049d3a933b0cec21de2b47dca","observation_id":"3378e527-43c9-4f0e-8e60-eb56c58b947c","resolution":{"observed_at":"2026-08-07T13:14:58.838260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:47.359836Z","title":"Generative adversarial networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.359836Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:76c852dbb4e7ca29939aa4522993f550d3ded8a8db09b2c2cef0801e0e0875f7","observation_id":"23d1482e-8114-4d85-a2e4-8ad3b9a64c97","resolution":{"observed_at":"2026-08-07T13:14:47.359836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:58.527521Z","title":"Svdiff: Compact param- eter space for diffusion fine-tuning","venue":null,"work_id":"b2888cf6-ce55-4347-8d4f-8e2965317ad5","year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.449256Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:67a2e03f452ea63ca95aef9b8422fde7aefbeb4c8a243799ea72947f601eb32d","observation_id":"3ee30907-a957-4a41-856a-01f6c73c026a","resolution":{"observed_at":"2026-08-07T13:14:58.607425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:58.301917Z","title":"Fastermoe: modeling and optimizing training of large-scale dynamic pre-trained mod- els","venue":null,"work_id":"44df6776-1f56-4279-b4f2-becd48dd2602","year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.530267Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:dd5c344566d62816d19e3126d4b0c893747523fc0e027847553b7d02a0422046","observation_id":"27cdb942-70aa-41bd-b7fa-2cfdb0bcbc15","resolution":{"observed_at":"2026-08-07T13:14:58.398674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09503","last_updated":"2025-05-01T09:16:20Z","snapshot_observed_at":"2026-07-06T20:21:55.366596Z","submitted_at":"2025-01-16T12:28:39Z","title":"AnyStory: Towards Unified Single and Multiple Subject Personalization in Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09503","snapshot_observed_at":"2026-08-07T13:14:47.572921Z","title":"Anystory: Towards unified single and multiple subject personalization in text-to-image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.572921Z"},"links":{"cited_paper":"/paper/2501.09503","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:f5a12aa178e31c8f6cfe28a4aabb47377775129f1f3d1f607e24ba0435c58223","observation_id":"6d3c1e6e-b379-4370-8240-7b33af9e986d","resolution":{"observed_at":"2026-08-07T13:14:47.572921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:47.639845Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.639845Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:1348c788f1d0b595e3565f500f673e1a4bf507da321210ad7e0ddb8505930a46","observation_id":"2040f434-9a46-44e6-8ff4-fc22deb57afe","resolution":{"observed_at":"2026-08-07T13:14:47.639845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:58.091957Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen- Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":"bf0ec983-82a1-40b9-8a58-6feb573174fb","year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.692419Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:6673e3f9357c7fee8680725e9c13882f5aebd01dc317f6096b5ade5517cf41ba","observation_id":"8b4679e4-11b2-42de-b810-7a294fbb74b2","resolution":{"observed_at":"2026-08-07T13:14:58.178344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06168","last_updated":"2024-08-21T11:35:15Z","snapshot_observed_at":"2026-07-06T17:42:12.463902Z","submitted_at":"2024-03-10T10:39:32Z","title":"DiffuMatting: Synthesizing Arbitrary Objects with Matting-level Annotation","version":2},"cited_work":{"arxiv_id":"2403.06168","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.06168","snapshot_observed_at":"2026-08-07T13:14:53.390735Z","title":"DiffuMatting: Synthesizing Arbitrary Objects with Matting-level Annotation","venue":"cs.CV","work_id":"6551d884-b8de-4304-a99c-6c55b617b654","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.786713Z"},"links":{"cited_paper":"/paper/2403.06168","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:3b71c147203d31418b53e611f25e31d9cc793aa94490ba02064a8c7855288f78","observation_id":"15485768-7d66-4dc6-bdc5-576bd4787f7d","resolution":{"observed_at":"2026-08-07T13:14:53.453172Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16771","last_updated":"2024-12-28T17:42:44Z","snapshot_observed_at":"2026-08-07T05:22:26.276397Z","submitted_at":"2024-04-25T17:23:43Z","title":"ConsistentID: Portrait Generation with Multimodal Fine-Grained Identity Preserving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16771","snapshot_observed_at":"2026-08-07T13:14:47.905023Z","title":"Consistentid: Portrait genera- tion with multimodal fine-grained identity preserving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.905023Z"},"links":{"cited_paper":"/paper/2404.16771","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:ee554f1dec9abac88970dc4b55c39d1ad1f734447071d9abdccfc7e25d524343","observation_id":"f412bfe7-a6d3-4d2f-9b41-a2465d543ebe","resolution":{"observed_at":"2026-08-07T13:14:47.905023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:47.988552Z","title":"Adaptive mixtures of local experts.Neu- ral computation, 3(1):79–87, 1991","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:47.988552Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:be6ac3c866b74cc7c2bf0ecc7c69f273fc1ccfd8bb225a79b1a660630d101c6c","observation_id":"856ba131-bf8f-4a55-9ef1-0d19c9e446b4","resolution":{"observed_at":"2026-08-07T13:14:47.988552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:48.059792Z","title":"Stableviton: Learning semantic correspon- dence with latent diffusion model for virtual try-on","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.059792Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:42cfbeb92bfa7a5435444d44dac54e2941b9ecd34a71d522434adca8c233eaf3","observation_id":"33e8dc0f-fd59-4efe-92fd-76846f63f79b","resolution":{"observed_at":"2026-08-07T13:14:48.059792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:57.932637Z","title":"Stylemc: Multi-channel based fast text-guided im- age generation and manipulation","venue":null,"work_id":"5b829321-44b3-40a0-9425-9be196d602b8","year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.191097Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:dae1ffd0c7e14ed96121169be72f209cd9eaf66f3043a5ff955bad5e608186fd","observation_id":"25d4a27c-6c70-4739-bafa-77e5eb022a65","resolution":{"observed_at":"2026-08-07T13:14:57.987237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11643","last_updated":"2024-11-22T09:31:14Z","snapshot_observed_at":"2026-08-04T10:53:37.300310Z","submitted_at":"2024-06-17T15:26:22Z","title":"CustAny: Customizing Anything from A Single Example","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11643","snapshot_observed_at":"2026-08-07T13:14:48.317554Z","title":"Anymaker: Zero-shot gen- eral object customization via decoupled dual-level ID injec- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.317554Z"},"links":{"cited_paper":"/paper/2406.11643","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:feb0a3d8e1214196e25a52c5abccdc8cebb09ef85db8ca91e5bb335a6357455c","observation_id":"c5a40d3c-e0dd-471b-8296-cb4962d30ff5","resolution":{"observed_at":"2026-08-07T13:14:48.317554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:57.666930Z","title":"Omg: Occlusion-friendly personalized multi-concept generation in diffusion models","venue":null,"work_id":"450de9da-8bdb-4a71-8906-a2d972296862","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.413755Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:a136429be138c2de0dea132464aee4a8d1e6338d5d6be18dbbe547b301cf1ed6","observation_id":"42907d6f-9077-42ca-b06a-48fa9649c10a","resolution":{"observed_at":"2026-08-07T13:14:57.814046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:57.400401Z","title":"Multi-concept customiza- tion of text-to-image diffusion","venue":null,"work_id":"0121a126-46bf-4404-957e-d8f053dd5392","year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.475590Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:d32e7ed1063a0c7314beb286c3ecb2ef44ca43d60c22c299dc33c54a601b51a6","observation_id":"aa0ad955-d3f0-4407-9cea-9de3f6f298c6","resolution":{"observed_at":"2026-08-07T13:14:57.514572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:48.534763Z","title":"Generating multi-image synthetic data for text-to-image customization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.534763Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:40a82abde92cd2351d805e2bb5086431a294e5384bd069c4a7d3c2991ea7cc2e","observation_id":"5ea52d0e-f476-4da6-bd43-1c1498d0d9da","resolution":{"observed_at":"2026-08-07T13:14:48.534763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:57.162170Z","title":"Gshard: Scaling giant models with conditional computation and automatic sharding","venue":null,"work_id":"25570d93-856f-4037-b426-75638cbfde68","year":2021},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.608852Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:dd81632538326e0ffa36bb778c56f94a33af22f56b5df5ba65725acc226e5a3a","observation_id":"89136eb0-9974-43b8-a507-a0a4289ed19c","resolution":{"observed_at":"2026-08-07T13:14:57.259459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:48.666099Z","title":"Blip-diffusion: Pre- trained subject representation for controllable text-to-image generation and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.666099Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:f8980c0b209b32b77392d6d4ef2faba8cd0719d1204050c39d562032de766ee4","observation_id":"5eefbc42-99fd-4700-afe1-1aabdf690ba2","resolution":{"observed_at":"2026-08-07T13:14:48.666099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:48.732672Z","title":"Subject- diffusion: Open domain personalized text-to-image genera- tion without test-time fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.732672Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:f70f9f49b612c4f6ef0de3fb4024a8cdd5fb3fc29fb21d1325fd8abb667166d2","observation_id":"522e9416-de3b-4318-b745-2774a2314b36","resolution":{"observed_at":"2026-08-07T13:14:48.732672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:56.929814Z","title":"Ladi-vton: Latent diffusion textual-inversion enhanced virtual try-on","venue":null,"work_id":"88abc328-5f11-4e54-950f-acaa47ef97b7","year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.830925Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:890149ea7365ab0b445203e679b8e8fde9fe473ef8314b6956b7888f76840514","observation_id":"bbb41754-12d7-4aef-8ba5-c711cffc7dc8","resolution":{"observed_at":"2026-08-07T13:14:57.014951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-07T13:14:48.914829Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:48.914829Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:5697d5094661bb4f6a39568234a9d8bf0656faeb1fd7b92f4a259341f140c055","observation_id":"d4250a06-efb1-48c5-a1ce-3fd4e0fae72b","resolution":{"observed_at":"2026-08-07T13:14:48.914829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:56.707433Z","title":null,"venue":null,"work_id":"42797f25-b6da-4cd8-914b-19108683cef8","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:49.019122Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:85a1ea2c9eca55ff853156c0d6b847190828f7e5503a824583096431919dfbd9","observation_id":"301595a6-a236-47c3-b730-7d2c28c72f1e","resolution":{"observed_at":"2026-08-07T13:14:56.810240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:56.458243Z","title":"Attndreambooth: To- wards text-aligned personalized text-to-image generation","venue":null,"work_id":"dc85d237-fa26-4eae-82eb-9f084152d61b","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:49.098019Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:32bae4af9346a90585e29411e61e8fc68480f273aef656763d74de535aca271f","observation_id":"bb325955-1f02-43a1-8b64-82f3b4941485","resolution":{"observed_at":"2026-08-07T13:14:56.556845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08248","last_updated":"2026-05-19T07:22:47Z","snapshot_observed_at":"2026-08-01T17:09:07.344749Z","submitted_at":"2024-09-12T17:47:51Z","title":"TextBoost: Boosting Text Encoder for Personalized Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08248","snapshot_observed_at":"2026-08-07T13:14:49.189713Z","title":"Text- boost: Towards one-shot personalization of text-to-image models via fine-tuning text encoder","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:49.189713Z"},"links":{"cited_paper":"/paper/2409.08248","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:bdfd4f4a1198023ded4d80585f0b67b084ee455eccf6e20f90142c6ce381149a","observation_id":"48a4a79c-75a2-471a-b343-a5467a518b84","resolution":{"observed_at":"2026-08-07T13:14:49.189713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:49.285012Z","title":"Styleclip: Text-driven manipulation of stylegan imagery","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:49.285012Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:fbcb88d1da393ba0414d57e1ae3260cfafb6d4402abc857803389d49f28e8cdf","observation_id":"f68c1134-8934-406f-9587-711919b491ed","resolution":{"observed_at":"2026-08-07T13:14:49.285012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:49.361226Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:49.361226Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:c84120ecd553707dd9d1b37c4b4f413137b5999ae46f54f786c37f49026413f3","observation_id":"8fc49497-ac4d-4668-b69e-14f29d276d0f","resolution":{"observed_at":"2026-08-07T13:14:49.361226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T13:14:49.472916Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:49.472916Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:cb6317bf2e35dd77b38a6f67d382c58c1e7951734ff526c2a97a022ede14046c","observation_id":"a14b2a9c-8fcc-46c2-83a4-b69f4e98c481","resolution":{"observed_at":"2026-08-07T13:14:49.472916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:49.582131Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:49.582131Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:8bbb7f98d466dcb675152f69fab0dd3e4ed8c48b99cc41a9648170c8ad8b3e3e","observation_id":"496d7f47-bba0-44be-a6d1-3c2d834748a3","resolution":{"observed_at":"2026-08-07T13:14:49.582131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:56.186708Z","title":"Dreamblend: Advancing person- 10 alized fine-tuning of text-to-image diffusion models","venue":null,"work_id":"20f44099-e7b0-4224-b905-7956636fa3b7","year":2025},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:49.668974Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:e9f1657d23bef8d518ed60ec8016de51c2ff76bef06dce3c8dcf88e2ee234625","observation_id":"3e6be9b4-a0db-4d88-8467-4e073360681d","resolution":{"observed_at":"2026-08-07T13:14:56.275935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T13:14:49.810378Z","title":"Hierarchical text-conditional image gener- ation with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:49.810378Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:124a1ac989e04e4dd189043fee96555c8c9a44573d77e829294a90f059b36ddd","observation_id":"ccaa6263-ed81-4a7b-89a3-90ed4eeda8d3","resolution":{"observed_at":"2026-08-07T13:14:49.810378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:55.985924Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"50b39950-2336-4787-9242-91e824462a60","year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:49.996976Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:73d417d846f65146a74a0bb4ab2c583978546f8f5a39c95a3264484096dc7981","observation_id":"f536b44d-8477-4030-b0b4-accedbdf82fe","resolution":{"observed_at":"2026-08-07T13:14:56.049974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:50.231088Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:50.231088Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:d24807d1fdd735b0b225c8827fee3ea2720616f20d16bf2a77a1f2dd22926d38","observation_id":"2493ce32-ebb7-4262-ba98-5bfca5e8f35d","resolution":{"observed_at":"2026-08-07T13:14:50.231088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:50.301139Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:50.301139Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:89aa8f0023cc9ebe2be496a5369a0837b143d9b04961b8ff933b052679575ef9","observation_id":"7b825b96-e864-416f-9738-b0f770be4b24","resolution":{"observed_at":"2026-08-07T13:14:50.301139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:55.699985Z","title":"Visual layout composer: Image-vector dual diffusion model for de- sign layout generation","venue":null,"work_id":"f1a87e92-841e-437c-a91e-9e30fc4fede0","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:50.417283Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:7538b7987c9eca863d49bc13909a3497fedbd946a453c8123e3d3b52f4e7371b","observation_id":"ff0c62ba-2a03-4b7e-b81d-1070661ec529","resolution":{"observed_at":"2026-08-07T13:14:55.819288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:55.563291Z","title":"Ziplora: Any subject in any style by effectively merging loras","venue":null,"work_id":"08c66f39-8931-4862-8b14-63af002292fc","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:50.555443Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:c24011b6cb492cbcd806539cccc01d2d41e79d4f3522b0d281425b41c5a95435","observation_id":"b00c52de-f573-484e-ac97-7dd0ca65d64a","resolution":{"observed_at":"2026-08-07T13:14:55.623200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:55.350753Z","title":"Le, Geoffrey E","venue":null,"work_id":"00a6c905-06de-48d3-be87-7e626c87cabd","year":2017},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:50.675698Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:8f8f9479a8b9a85c491c28e2c0b13f8f03f4069035ba8f247ec2d4b98074dabd","observation_id":"c6005e95-d8e6-42b2-a47f-39ad402decf3","resolution":{"observed_at":"2026-08-07T13:14:55.491682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:55.083404Z","title":"Scaling vision-language models with sparse mixture of experts","venue":null,"work_id":"369cb4a4-de6f-4950-aece-83ae79bbdc3d","year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:50.818848Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:a0fcf24ab8ecb6b6b03e79300c634755e994b0f860bc70b2338221271172ac34","observation_id":"9175290a-c651-4c57-9009-325622cf9e1d","resolution":{"observed_at":"2026-08-07T13:14:55.209712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:54.857895Z","title":"Zhao, Hongkun Yu, Kurt Keutzer, Trevor Darrell, and Denny Zhou","venue":null,"work_id":"6f661112-3c39-417a-8795-cedd72697ab7","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:50.900870Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:092b3843e34cb9ca201f8b71016e97d02c4a0f8e9bbcd91d643a152dc3af0394","observation_id":"3046fb00-df50-404f-ae31-8802db3d5df9","resolution":{"observed_at":"2026-08-07T13:14:54.956851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:50.973970Z","title":"In- stantbooth: Personalized text-to-image generation without test-time finetuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:50.973970Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:521368b85f5fd1ca7063add2fffea13736937f429ae8039e0dd9198efeb83105","observation_id":"c8278f25-3567-443b-a47b-26c76904f3ed","resolution":{"observed_at":"2026-08-07T13:14:50.973970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23280","last_updated":"2025-04-05T14:15:09Z","snapshot_observed_at":"2026-07-06T19:42:25.742756Z","submitted_at":"2024-10-30T17:57:21Z","title":"DreamRelation: Bridging Customization and Relation Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23280","snapshot_observed_at":"2026-08-07T13:14:51.087857Z","title":"Rela- tionbooth: Towards relation-aware customized object gen- eration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:51.087857Z"},"links":{"cited_paper":"/paper/2410.23280","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:3cb18a115ad8c01f508eac696b4f1c93c310c2f1dc6b32a6cd6634e130262015","observation_id":"dee78fcd-56ae-4ef3-8076-e7516770b811","resolution":{"observed_at":"2026-08-07T13:14:51.087857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:54.611324Z","title":"Moma: Multimodal llm adapter for fast personalized image generation","venue":null,"work_id":"30d1bb45-9e95-4d07-a56a-b7489bde330e","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:51.282867Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:bc016cea02b61d7dd6d568be531c411981a325715620ca72b94b972674037424","observation_id":"0c043180-7b38-4167-bc84-088069cf6ba1","resolution":{"observed_at":"2026-08-07T13:14:54.742823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:51.413086Z","title":"Resolution-robust large mask inpainting with fourier convolutions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:51.413086Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:303c7b4528dc611ea10fc54aa10cdedbd96a7b96300517c9d5694454965541f0","observation_id":"e080e8f9-0206-4919-9388-9fa4c7ba9e4e","resolution":{"observed_at":"2026-08-07T13:14:51.413086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07519","last_updated":"2024-02-02T16:15:22Z","snapshot_observed_at":"2026-08-06T23:08:20.817133Z","submitted_at":"2024-01-15T07:50:18Z","title":"InstantID: Zero-shot Identity-Preserving Generation in Seconds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07519","snapshot_observed_at":"2026-08-07T13:14:51.539668Z","title":"Instantid: Zero-shot identity-preserving gener- ation in seconds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:51.539668Z"},"links":{"cited_paper":"/paper/2401.07519","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:5b98d1fd47f3b006d3ad249a6f9fe0a75906e55708eff9258a2b61591121d1eb","observation_id":"71e755bb-cf1e-4ebc-94ee-3e54b1d5fae9","resolution":{"observed_at":"2026-08-07T13:14:51.539668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07209","last_updated":"2025-03-04T06:21:26Z","snapshot_observed_at":"2026-07-06T18:28:51.180903Z","submitted_at":"2024-06-11T12:32:53Z","title":"MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07209","snapshot_observed_at":"2026-08-07T13:14:51.605547Z","title":"Ms-diffusion: Multi-subject zero-shot im- age personalization with layout guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:51.605547Z"},"links":{"cited_paper":"/paper/2406.07209","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:46e88fcf9f3414b743937f4a7c786cb6cd082428897c2b5e8fe751b92c6c3bda","observation_id":"450ed4af-5e58-40fc-8b51-702408054b51","resolution":{"observed_at":"2026-08-07T13:14:51.605547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:54.435581Z","title":"Dolfin: Diffusion layout transformers without autoencoder","venue":null,"work_id":"7f0be667-c3f4-4c84-9601-ee3f35c61ede","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:51.721175Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:36589dba1610a6cf67a0f987d4e7cd52ca9ec5bed6d0317879d32e284cd06900","observation_id":"401e7903-bfb7-4b17-8621-b140dc64ab2c","resolution":{"observed_at":"2026-08-07T13:14:54.498330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08520","last_updated":"2025-03-16T04:31:33Z","snapshot_observed_at":"2026-07-06T19:14:42.638034Z","submitted_at":"2024-09-13T03:40:58Z","title":"GroundingBooth: Grounding Text-to-Image Customization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08520","snapshot_observed_at":"2026-08-07T13:14:51.859590Z","title":"Groundingbooth: Grounding text- to-image customization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:51.859590Z"},"links":{"cited_paper":"/paper/2409.08520","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:617303d6931381c1f4ed00bd555d4e040e62442aba26d6cd69929e8d11ca20c1","observation_id":"ec456f7c-0d71-41a5-b0c9-79103be2e37d","resolution":{"observed_at":"2026-08-07T13:14:51.859590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:54.201457Z","title":"Predict, prevent, and evaluate: Disentangled text-driven im- age manipulation empowered by pre-trained vision-language model","venue":null,"work_id":"796a596b-e384-4664-96d7-52a48f7af6f1","year":2022},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:51.942936Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:a4154efb6a6dcf844d51bf6c3ce70cefa972a86ca9b568dceb69034d6a0a2ac9","observation_id":"56931266-a238-4597-afa2-c37ee332064f","resolution":{"observed_at":"2026-08-07T13:14:54.316082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:52.023601Z","title":"Dreammix: Decoupling object attributes for enhanced ed- itability in customized image inpainting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:52.023601Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:8bb89831ee1894e100aca54fd2cd1ce642e6f517c38166c0bb6066bb803e18b0","observation_id":"ac8e711b-6d80-4a30-ad05-d5ca9c78687b","resolution":{"observed_at":"2026-08-07T13:14:52.023601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-07T13:14:52.135812Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:52.135812Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:81be573664e5357f5bb343cdbea740a8cf568ff8c7d18e7f7e2f343e30df8a8c","observation_id":"6d9edf0c-8042-454f-b031-cd2c2c579d7d","resolution":{"observed_at":"2026-08-07T13:14:52.135812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06790","last_updated":"2023-04-13T19:23:52Z","snapshot_observed_at":"2026-08-05T23:54:40.289344Z","submitted_at":"2023-04-13T19:23:52Z","title":"Inpaint Anything: Segment Anything Meets Image Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06790","snapshot_observed_at":"2026-08-07T13:14:52.264580Z","title":"Inpaint anything: 11 Segment anything meets image inpainting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:52.264580Z"},"links":{"cited_paper":"/paper/2304.06790","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:93fa688b25babe34464aaa8bba60cfb960ab2debf1979ecfc3d5f44b3973de2b","observation_id":"3bf683d3-39ef-42c1-b306-20f03ac1fd9a","resolution":{"observed_at":"2026-08-07T13:14:52.264580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:53.972397Z","title":"Cat-dm: Controllable acceler- ated virtual try-on with diffusion model","venue":null,"work_id":"259f6496-4d6b-4687-a8b5-3df77245f827","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:52.399818Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:0f5470642ba1ad9151980fab2cd2d546da005ed99b4cc019c3695b6e5c82c64c","observation_id":"4de2f01a-4c0d-44a9-be6f-095465dff920","resolution":{"observed_at":"2026-08-07T13:14:54.066232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:53.828755Z","title":"Ssr-encoder: Encoding selective subject representation for subject-driven generation","venue":null,"work_id":"1bfa8563-54af-42ed-83aa-043730a53dab","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:52.514686Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:b1e92d8d488c5d7fa8651c24533b32cf78b853759b99adda383cd6129f480cb7","observation_id":"c871684d-cfe4-4b77-a4ff-5a12c285483c","resolution":{"observed_at":"2026-08-07T13:14:53.906203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:14:53.602110Z","title":"Efficientvit-sam: Accelerated segment anything model without performance loss","venue":null,"work_id":"a830c824-2abe-4999-a233-1cfd1f4c4122","year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:52.674449Z"},"links":{"citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:d737a9de3d31bb70dac31a75cef230d0b68be013ad7672b887a8015f1241e566","observation_id":"8123a8b4-4763-4429-8454-e25a6fc166b3","resolution":{"observed_at":"2026-08-07T13:14:53.719288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14239","last_updated":"2025-03-31T06:30:53Z","snapshot_observed_at":"2026-08-06T05:57:44.169307Z","submitted_at":"2024-04-22T14:47:54Z","title":"MultiBooth: Towards Generating All Your Concepts in an Image from Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14239","snapshot_observed_at":"2026-08-07T13:14:52.788211Z","title":"Multibooth: Towards generating all your concepts in an im- age from text","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:52.788211Z"},"links":{"cited_paper":"/paper/2404.14239","citing_paper":"/paper/2505.22360"},"observation_digest":"sha256:2f40d984ed2d545eb0c4f508b918abf7d714eb67f58a9b4331f6023082ecffc9","observation_id":"1dd107db-fb9d-4a60-b1f8-a8bf233e242e","resolution":{"observed_at":"2026-08-07T13:14:52.788211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22360","last_updated":"2025-05-28T13:40:46Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T05:21:31.444480Z","submitted_at":"2025-05-28T13:40:46Z","title":"Identity-Preserving Text-to-Image Generation via Dual-Level Feature Decoupling and Expert-Guided Fusion"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2505.22360."}