{"as_of":"2026-08-05T14:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:84e624746c376bafc25f2b52c8511ee7a5f8b680330557e0179ca3bdb139348d","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T21:56:10.499014Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.10127/citation-record","integrity":"/paper/2605.10127/integrity","json":"/paper/2605.10127/citation-record.json","paper":"/paper/2605.10127"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.07009","doi":"10.48550/arxiv.2408.07009","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagen 3","venue":"arXiv (Cornell University)","work_id":"a1dd317f-8300-4a79-a1d0-92ddd93fa983","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:52fa18ea394496682c9415bae3cbaacda3303b4d7fa5cf2553f4ac672c74589e","observation_id":"57e31fd1-d44e-4177-a459-f7e67ed92021","resolution":{"observed_at":"2026-05-14T21:58:03.388042Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:30.169107+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:30.169107+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa7a7de8-fa76-4cb7-b22b-af6dd830cdaa","year":null},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:0a558fa0e5e98d69f7e8b8799d88ef34e906919e8d1b62ae24f119a7dd2b0a8b","observation_id":"03c4f93d-a498-4e9e-b985-79887facd909","resolution":{"observed_at":"2026-05-14T23:09:35.460013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":"1809.11096","doi":"10.48550/arxiv.1809.11096","metadata_source":"pith","pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","venue":"cs.LG","work_id":"244e6f06-bad2-4f34-8186-ff370286427f","year":2018},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:d6a769233897abd243bc8634dfa284eadff29692fc7bd1da73ca6f56d9bd974b","observation_id":"ab56b149-cbfe-4f19-8051-8425c50eb46f","resolution":{"observed_at":"2026-05-14T21:58:03.411175Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-02T12:08:12.712369+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T12:08:12.712369+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":"2310.00426","doi":"10.48550/arxiv.2310.00426","metadata_source":"pith","pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","venue":"cs.CV","work_id":"77157568-e4be-4041-bb20-388177fc59d0","year":2023},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:595b3ed677984831f026e8ff93d46c02bd07ad97f41e287b10c7f877a54bc34d","observation_id":"85af0f9a-2663-461c-9397-381156ed02ba","resolution":{"observed_at":"2026-05-14T21:58:03.367081Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:58.428012+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:58.428012+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magic clothing: Controllable garment-driven image synthesis","venue":null,"work_id":"7f355d8e-6c51-4d65-b091-a216bf1dd39a","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:73553c48832a4dcddf832550c8a59e852ca48abc26212cb090d69f87f0e16e1e","observation_id":"be9abc3e-3aec-4179-9f1b-6c16bc4e1785","resolution":{"observed_at":"2026-05-14T23:09:35.438625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Viton-hd: High-resolution virtual try-on via misalignment-aware normalization","venue":null,"work_id":"a4ca97ee-0c69-4177-80d3-d9d3a37bdfe2","year":2021},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:56a4521fd3c17c3f902f591f4516763fa6d45af8a8b58715933a2be1f99f6580","observation_id":"2ebd6d81-417c-4f59-88c3-9e3309bcb478","resolution":{"observed_at":"2026-05-14T23:09:35.394949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving diffusion models for vir- tual try-on.arXiv e-prints, pages arXiv–2403","venue":null,"work_id":"56a7eb3e-9f46-4c8f-ab73-146c1c89d25c","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:2d595f9f6bcacee8cc490c74b28f8b2971f96d31425f3fe5f9b7eab392e03179","observation_id":"413b4146-0df0-4ba6-a7a1-39cf08c196dd","resolution":{"observed_at":"2026-05-14T23:09:35.480849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards multi-pose guided virtual try-on network","venue":null,"work_id":"868f8f93-5190-4254-9c23-ccaf5f5f01e0","year":2019},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:8b3ec6d0651b785c4c6ccff2abc6d3bc3d101f830a857a3dccd00fb2b7695142","observation_id":"f372ccd9-eb02-4c7c-869b-01c3b4af0a00","resolution":{"observed_at":"2026-05-14T23:09:35.446480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2403.03206","doi":"10.48550/arxiv.2403.03206","metadata_source":"pith","pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"4dc55d76-271e-42dd-878f-c20546599c69","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:8f653b591936d00913566eca04d0674c5aa63a44621f7045faf44526ebc4e81b","observation_id":"dc289e18-e6b9-45a8-aa01-f2e9d5bacba7","resolution":{"observed_at":"2026-05-14T21:58:03.417835Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:19:49.764146+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:19:49.764146+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative adversarial nets.Advances in neural information processing systems, 27","venue":null,"work_id":"760eb4a6-f5c8-4496-822e-5ecb46b0048c","year":2014},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:9723adaa7e0288a506410944a6d5ac7e47c9ea33e5038d8b388ec0530861dbbe","observation_id":"104bb071-6eb2-416a-9b6f-f56286ab0b53","resolution":{"observed_at":"2026-05-14T23:09:35.383649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Any2anytryon: Leveraging adaptive position embeddings for versatile virtual clothing tasks","venue":null,"work_id":"c16f09a8-4ddf-48be-b3da-a87731ca71c5","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:771fb96e1adabb93b2d5cbb9b92368b7bba329b949de1df86054627a3b99ea86","observation_id":"1312b019-d95a-456c-a125-812730d65937","resolution":{"observed_at":"2026-05-14T23:09:35.492070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pulid: Pure and lightning id customization via contrastive alignment.Advances in neural information pro- cessing systems, 37:36777–36804","venue":null,"work_id":"e3943377-8648-4019-85f3-abf19f2ea47d","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:80b289a11266c15ad7b41cdbd7d218efff11370c7adff1542ecdeabbffae98f9","observation_id":"24befd01-afa7-42c9-8e80-e72d687f392b","resolution":{"observed_at":"2026-05-14T23:09:35.407581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Viton: An image-based virtual try-on network","venue":null,"work_id":"68927813-1fbb-43b2-9e3c-0a1816bcbbe8","year":2018},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:8fc7f2e4116a4d08063edeef2fa0633bc6ed54be8ebd51b8d6bbb84a9a8c831c","observation_id":"b52414dd-f9ff-4b94-80c0-e89b8386300a","resolution":{"observed_at":"2026-05-14T23:09:35.439877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09162","last_updated":"2024-06-13T14:26:43Z","snapshot_observed_at":"2026-07-06T18:30:19.486766Z","submitted_at":"2024-06-13T14:26:43Z","title":"EMMA: Your Text-to-Image Diffusion Model Can Secretly Accept Multi-Modal Prompts","version":1},"cited_work":{"arxiv_id":"2406.09162","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.09162","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emma: Your text-to-image diffusion model can secretly accept multi-modal prompts","venue":null,"work_id":"dfcce9d3-ead8-4172-b238-d755512e4e6d","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2406.09162","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:2a59039371325bba435cfbd7e4f4221e61bfd9fc22d7d584151c4e5ae9863523","observation_id":"da1331c7-faeb-4974-bba4-a959ca14ec52","resolution":{"observed_at":"2026-05-14T21:58:03.360545Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:32:56.450074Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851","venue":null,"work_id":"45e032a6-e71b-4525-83cc-6d1e7dd474d8","year":2020},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:b07d1f47db4d611bab17c35f14400b83d21abd8eff1cb7ad79f630864a22564b","observation_id":"a799edd9-bcd9-4553-8851-e83fb41e5328","resolution":{"observed_at":"2026-05-14T23:09:35.403075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.02070","doi":"10.48550/arxiv.2506.02070","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to flow matching and diffusion models","venue":"ArXiv.org","work_id":"02cc21d4-d194-42aa-ac2d-a31e3b85dc4a","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:bd623ed61962eb0bd27c9641585b9048a6d7e39b9c2d45b5d7b8fc3c4dfeddb0","observation_id":"f25eacb7-4509-412f-972f-28d95d441d3b","resolution":{"observed_at":"2026-05-14T21:58:03.354208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fashionon: Semantic-guided image-based virtual try-on with detailed human and clothing information","venue":null,"work_id":"79a3e852-998c-4017-a0e8-d8d3b87a07eb","year":2019},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:617bc35de963609442fcb9211a22507f09992ea3a1536fe273f0bf8be30c126b","observation_id":"d3765546-654a-4348-81e6-eff1542f74b6","resolution":{"observed_at":"2026-05-14T23:09:35.375495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 1(2):3","venue":null,"work_id":"2a4c9260-71cf-4cb9-bd47-8f4380f85444","year":2022},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:6afecb410a4136dec15e593da0becec8b88710e5a121df23905882a80d8ce902","observation_id":"227f69f3-2da7-413b-9b1b-9d2bc71bb404","resolution":{"observed_at":"2026-05-14T23:09:35.345247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kolors: Effective training of diffusion model for photorealistic text-to-image synthesis","venue":null,"work_id":"39ba56fb-1beb-4f0d-adc3-bb1047c8d72e","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:deb1416b1ccda36c347e81a45c9ffe42cc6f1de599d6009ae3e528edd955e669","observation_id":"e7ac6ff9-2226-457d-a1b0-341e324ebd47","resolution":{"observed_at":"2026-05-14T23:09:35.499379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":"4c95331b-c3fc-47fb-87af-95f8e57861ff","year":2019},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:a20d8811b058a6518a8b8cff8a83c941db73273256e654a2806ed0c7ec526635","observation_id":"a5ec61c5-a2a1-47e5-bea1-599ffc06cbfa","resolution":{"observed_at":"2026-05-14T23:09:35.464912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Are these the same apple? comparing images based on object intrinsics.Advances in Neural Information Processing Systems, 36:40853–40871","venue":null,"work_id":"41dddcd4-f47b-4640-adc7-b6ab30d0cdd1","year":2023},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:63cb51be49f980315e56a6da90008712c5963ace7938317ff99c494b8830600e","observation_id":"f8a1b5b0-05fb-41f9-a231-f8f1cc83bef2","resolution":{"observed_at":"2026-05-14T23:09:35.411883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tryongan: Body-aware try-on via layered interpolation.ACM Transactions on Graphics (TOG), 40(4):1–10","venue":null,"work_id":"06ecbb4f-9401-4e06-afb9-304879fff0fc","year":2021},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:08f7bc216f5d0a017247094207b79998d99847cec5a6387587e55fcda29a83b2","observation_id":"f3307c36-68f5-4a0a-9c7f-114697af9d6c","resolution":{"observed_at":"2026-05-14T23:09:35.430877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toward accurate and realistic outfits visualization with atten- tion to details","venue":null,"work_id":"fb66a38b-c3c2-47b6-a421-840b53e22435","year":2021},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:f74eeb2a7cead175fb897a9683ffdf1373dd729a13b7c9f832449f7ad6ce9546","observation_id":"e0ceeabb-3757-47bc-aec7-878da27b424c","resolution":{"observed_at":"2026-05-14T23:09:35.388416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18172","last_updated":"2024-05-28T13:33:08Z","snapshot_observed_at":"2026-07-06T18:21:18.150567Z","submitted_at":"2024-05-28T13:33:08Z","title":"AnyFit: Controllable Virtual Try-on for Any Combination of Attire Across Any Scenario","version":1},"cited_work":{"arxiv_id":"2405.18172","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.18172","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anyfit: Controllable virtual try-on for any combination of attire across any scenario.arXiv preprint arXiv:2405.18172","venue":null,"work_id":"eb7e1ec9-197e-4bdb-9054-aac8995b6fbd","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2405.18172","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:0475ad50a9f7c7f1be6808a3277040b81cdb1aa30f5ef692141e0eea0f074678","observation_id":"d0d883d4-6108-438a-a5a9-85adc4570e47","resolution":{"observed_at":"2026-05-14T21:58:03.335509Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08748","last_updated":"2024-05-14T16:33:25Z","snapshot_observed_at":"2026-07-06T18:14:16.386835Z","submitted_at":"2024-05-14T16:33:25Z","title":"Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding","version":1},"cited_work":{"arxiv_id":"2405.08748","doi":"10.48550/arxiv.2405.08748","metadata_source":"pith","pith_arxiv_id":"2405.08748","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding","venue":"cs.CV","work_id":"fde63b0b-25e7-43d9-9867-7d6a2ba6d710","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2405.08748","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:265b8a4e32ffd1de0c3341fa71db36f8ea29ba04590fb39212904c1f244a8760","observation_id":"48430f21-1021-4096-b0ec-2ca5c20ff89a","resolution":{"observed_at":"2026-05-16T14:58:37.566044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dual diffusion for unified image generation and understanding","venue":null,"work_id":"964b7823-d86e-4049-8dfe-2b90acc1d56a","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:4818b3b0c69bd395fbe9666eabbecd2bc2a76eb9b01bff1172c67f1c7cc6538b","observation_id":"b1466ec7-aba9-4606-9c4f-da43d8762994","resolution":{"observed_at":"2026-05-14T23:09:35.379643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mind the gap: Understanding the modality gap in multi-modal contrastive representation learning.Advances in Neural Information Processing Sys- tems, 35:17612–17625","venue":null,"work_id":"a7c953cd-8d30-4396-8df8-f29f50f82749","year":2022},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:f98d7b7ba2acf7a97567c8feaebafb52291261d94551eb13a1529130511c97c0","observation_id":"4d0abb9d-b5b3-4927-833a-590fc704596e","resolution":{"observed_at":"2026-05-14T23:09:35.433134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:fc8a9def4c96f2b7c718293fc1243dc681f29999f417501a7d1d1ff6b089aad1","observation_id":"555a0def-572c-4bf3-bc89-803a52ccb23b","resolution":{"observed_at":"2026-05-14T21:58:03.310424Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":"2209.03003","doi":"10.48550/arxiv.2209.03003","metadata_source":"pith","pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","venue":"cs.LG","work_id":"a1989e1b-d66d-4533-be3a-fb9c5fd62290","year":2022},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:df2c723aaa2b39ce0dcfe565706754256b8851e7247d0f2c3a95c5f8e73e4ceb","observation_id":"6b24045f-01c0-4346-87da-947e0dbd9bdd","resolution":{"observed_at":"2026-05-14T21:58:03.341653Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T22:49:29.244251+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepfashion: Powering robust clothes recognition and retrieval with rich annotations","venue":null,"work_id":"8215f066-a3a9-4961-a723-2a33207e4c66","year":2016},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:9b1d2741526d66f5ac181c77b73cdd397f7fe8899eda1987906edd6fb60e5a73","observation_id":"33e0b79f-9fc4-4928-906d-affa4a8648c0","resolution":{"observed_at":"2026-05-14T23:09:35.448613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02487","last_updated":"2025-01-15T13:07:56Z","snapshot_observed_at":"2026-07-06T20:16:40.311377Z","submitted_at":"2025-01-05T09:40:58Z","title":"ACE++: Instruction-Based Image Creation and Editing via Context-Aware Content Filling","version":3},"cited_work":{"arxiv_id":"2501.02487","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.02487","snapshot_observed_at":"2026-07-02T07:36:45.141025Z","title":"ACE++: Instruction-Based Image Creation and Editing via Context- Aware Content Filling","venue":null,"work_id":"10083b73-2d3a-4a03-8741-520fe2e6f71a","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2501.02487","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:b056d54bd9cc7de3c517a7af710a1e1d129af2d120bd1d71b1781a942f1ebd64","observation_id":"8cc823f6-9c69-4c03-81df-7969dc392195","resolution":{"observed_at":"2026-05-14T21:58:03.329481Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dress code: High- resolution multi-category virtual try-on","venue":null,"work_id":"84875ef7-955f-47d3-8554-0d1cdc3c8852","year":2022},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:4e6d829cb65bf13ad335e61b23dbda6f743e10e3d3989241b61bc0c8b490f05b","observation_id":"9199f44d-72c6-443f-8eeb-b2de1ea48704","resolution":{"observed_at":"2026-05-14T23:09:35.503953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.16915","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:08:42.932279Z","title":"Dreamo: A unified framework for image customization","venue":null,"work_id":"61f22b4a-7358-4c63-8711-da33ac2bde1d","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:246b543d5ff8102966a8826a439281c14715f87b8feee031577e2ef98c106555","observation_id":"4993f05d-a5cd-4be6-8b76-6d41c46da333","resolution":{"observed_at":"2026-05-14T21:58:03.297383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Image based virtual try-on network from unpaired data","venue":null,"work_id":"159ffe19-44a8-4aa5-b391-6314b7141420","year":2020},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:14a917a5ac81fb171a0f597750699132bc2260a121209d5af59812bd815a0506","observation_id":"1003794c-09ab-43f3-9502-dad7886353ed","resolution":{"observed_at":"2026-05-14T23:09:35.418935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":"2304.07193","doi":"10.48550/arxiv.2304.07193","metadata_source":"pith","pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv2: Learning Robust Visual Features without Supervision","venue":"cs.CV","work_id":"26b304e5-b54a-4f26-be7e-83299eca52e4","year":2023},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:c52154e9f266607af265400c3440cc694b3620b386eba3f70f9ad8092978a2a8","observation_id":"7fb0abc2-525b-4796-b3ce-c3a59b22b909","resolution":{"observed_at":"2026-05-14T21:58:03.348340Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:14:35.715460Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"292e4202-5927-473f-b73e-1d6883498f14","year":null},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:bd32c907ab6335c0838dfdfc69f2678f36534e2f01c936cb7038b751c3a21d65","observation_id":"fe713c6c-6f39-442d-8310-95c1f95e9192","resolution":{"observed_at":"2026-05-14T23:09:35.393626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2307.01952","doi":"10.48500/arxiv.2307.01952","metadata_source":"pith","pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"8034c587-fba6-4941-87ba-c98f2ac962cb","year":2023},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:d03398d7c49e569c3a4811e2272168cd1f27829757ad7a9cfd73f9cc94a3a90e","observation_id":"cee1954b-b5b4-4d00-9df7-939f47e46eb1","resolution":{"observed_at":"2026-05-14T21:58:03.437152Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21758","last_updated":"2025-03-27T17:57:07Z","snapshot_observed_at":"2026-08-05T11:15:36.366240Z","submitted_at":"2025-03-27T17:57:07Z","title":"Lumina-Image 2.0: A Unified and Efficient Image Generative Framework","version":1},"cited_work":{"arxiv_id":"2503.21758","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.21758","snapshot_observed_at":"2026-07-03T17:18:43.730046Z","title":"Lumina-image 2.0: A unified and efficient image generative framework","venue":null,"work_id":"4336fecf-1790-4c0a-ad5d-b2bde933d2b6","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2503.21758","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:7fac9ca5aedb0a45b9de2eb7450c35aab174eb3fe2a9f56d182e05f059fa2327","observation_id":"7fd49c5c-3fcc-4cce-a469-347646180f21","resolution":{"observed_at":"2026-05-14T21:58:03.303843Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accept the modality gap: An exploration in the hyperbolic space","venue":null,"work_id":"3c302aba-85d4-4fdb-a554-cab9b409693a","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:96de4575155be5c5be82e32977445ec674a3fff6d2b2a325fc7d61223efb7861","observation_id":"04f43030-7404-4fb3-a4a9-b199c0effcbf","resolution":{"observed_at":"2026-05-14T23:09:35.443992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":"2204.06125","doi":"10.48550/arxiv.2204.06125","metadata_source":"pith","pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","venue":"cs.CV","work_id":"0c6a768b-70b8-4242-bb0e-459f1008c9fc","year":2022},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:4730d37f1a19f8242c86b7125a829eae17ff67749efb212881d1db276fc3d686","observation_id":"39cc4640-435a-4065-8c4e-518c81c40143","resolution":{"observed_at":"2026-05-14T21:58:03.430882Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"b096b2b6-2721-4f21-9f1d-baedb1f201c4","year":2022},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:3ff4ac72973fa3ffdf0b59d1b5373a7be0c4465f60630b37b2df92c1e474934d","observation_id":"8539288a-4ddf-474d-b815-d2f21f644a61","resolution":{"observed_at":"2026-05-14T23:09:35.436478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"dc471bbc-4907-46b7-9f3d-c1decfda3394","year":2023},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:bf3c963de08a1d05313af23de3e36d7c3a08b2a3999b68f475b47fb906d278cb","observation_id":"bdc55f60-a9f7-48ad-b173-e82b69cba36e","resolution":{"observed_at":"2026-05-14T23:09:35.428575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T06:40:46.062579Z","title":"Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural information processing systems, 35:36479–36494","venue":null,"work_id":"271cb104-9bce-4478-8e63-2b1884940c89","year":2022},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:356891da2ad8915e226362885bb0f0707d3108f1196faf8fa829355762c0dc4c","observation_id":"66d5676d-bcb2-4bc2-8af3-f71084a50b35","resolution":{"observed_at":"2026-05-14T23:09:35.384548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":"2010.02502","doi":"10.48550/arxiv.2010.02502","metadata_source":"pith","pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Denoising Diffusion Implicit Models","venue":"cs.LG","work_id":"8fa2128b-d18c-405c-ac92-0e669cf89ac0","year":2020},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:3320ce1ebd3f531b4e26c79e3bb045f654f9184ee721552a4bded6ce9d3fc8aa","observation_id":"a4812a10-c773-45ae-bc28-db88760b0426","resolution":{"observed_at":"2026-05-14T21:58:03.290604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15098","last_updated":"2025-07-07T17:33:23Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T17:55:15Z","title":"OminiControl: Minimal and Universal Control for Diffusion Transformer","version":6},"cited_work":{"arxiv_id":"2411.15098","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.15098","snapshot_observed_at":"2026-07-04T16:49:57.596854Z","title":"OminiControl: Minimal and Universal Control for Diffusion Transformer","venue":null,"work_id":"b17213d7-e829-487b-9268-7f440614c456","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2411.15098","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:bffbbc9ccc54d0c365f7c3252147856245eac88e214b0d639e9c6338333aad77","observation_id":"ab2ebec5-8783-404d-854e-39b331e23f37","resolution":{"observed_at":"2026-05-14T21:58:03.373977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mv-vton: Multi-view virtual try-on with diffusion models","venue":null,"work_id":"09cc4d60-80c4-40c0-84c2-a7c08d382722","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:21d5ad1c30f6b9d5d2f9c895919dd54b6e72df99428d5a515cb27e6d6fe7292c","observation_id":"311fbb66-52b1-49bf-a0dd-94402c2de8b3","resolution":{"observed_at":"2026-05-14T23:09:35.455939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10783","last_updated":"2024-03-16T03:05:07Z","snapshot_observed_at":"2026-07-06T17:45:35.519457Z","submitted_at":"2024-03-16T03:05:07Z","title":"StableGarment: Garment-Centric Generation via Stable Diffusion","version":1},"cited_work":{"arxiv_id":"2403.10783","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.10783","snapshot_observed_at":"2026-07-02T03:06:30.328292Z","title":"arXiv preprint arXiv:2403.10783 , year=","venue":null,"work_id":"8adea791-b411-47e7-97c8-47e4a3feae66","year":2024},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2403.10783","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:b58ef458aa50c550930955a35aa26f2f02b204a85d63c01d0d5c9c42acda63a9","observation_id":"17f868aa-cbdf-41eb-9fd3-26385de38f52","resolution":{"observed_at":"2026-05-14T21:58:03.381000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:ecd393d3c3f907a6ce45479b49326679d60119ee8f26a78f36bf03d620fb7e2b","observation_id":"e67f7521-470c-43d5-af98-9dd5cce2a6f9","resolution":{"observed_at":"2026-05-14T21:58:03.399254Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18871","last_updated":"2026-04-21T17:32:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-23T17:38:54Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","version":4},"cited_work":{"arxiv_id":"2506.18871","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18871","snapshot_observed_at":"2026-07-10T01:46:41.215139Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","venue":"cs.CV","work_id":"d3153e5f-b6e2-4ab3-9f41-e24e24d64496","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2506.18871","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:6e95e99ef396c152b6c5cb13a7db89dd39bbe834b1e8d61602aa11f737760a91","observation_id":"c729739c-b642-4803-9bbc-15de28edd2e2","resolution":{"observed_at":"2026-05-14T21:58:03.393608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18966","last_updated":"2025-08-26T12:10:24Z","snapshot_observed_at":"2026-07-06T22:18:49.969283Z","submitted_at":"2025-08-26T12:10:24Z","title":"USO: Unified Style and Subject-Driven Generation via Disentangled and Reward Learning","version":1},"cited_work":{"arxiv_id":"2508.18966","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.18966","snapshot_observed_at":"2026-07-04T13:39:50.260429Z","title":"Uso: Unified style and subject-driven generation via disentangled and reward learning.arXivpreprint","venue":null,"work_id":"d7e22d09-fbcc-4ec6-ae6d-7df421c05d24","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2508.18966","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:77ebbb28ffed15a9f7594b2ab0db2d7eb3a2ae28cfa3eea625b79b4014af680c","observation_id":"7d859d78-5852-48be-8ed0-398e0075acd3","resolution":{"observed_at":"2026-05-14T21:58:03.425154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02160","last_updated":"2025-04-02T22:20:21Z","snapshot_observed_at":"2026-07-06T21:03:21.406634Z","submitted_at":"2025-04-02T22:20:21Z","title":"Less-to-More Generalization: Unlocking More Controllability by In-Context Generation","version":1},"cited_work":{"arxiv_id":"2504.02160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.02160","snapshot_observed_at":"2026-07-03T19:08:50.368542Z","title":"Less-to-more generalization: Unlocking more controllability by in-context generation","venue":null,"work_id":"6b8f8775-caa4-4cbe-a072-d62224e57d05","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2504.02160","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:92f6e68c04efac937bdf544ff48d76fc26d9b4f51ff427bae827e244bf2129d2","observation_id":"782ebfba-ac51-4bef-8a25-91509d0b5ad7","resolution":{"observed_at":"2026-05-14T21:58:03.316628Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnigen: Unified image genera- tion","venue":null,"work_id":"323d4ead-6d64-406e-8b8b-5c3c8ddeac76","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:4d7c8d4cdc1d402dcee4045dc08b8b9dab85e83932c8f229ddebc4b97b79b7b2","observation_id":"3a5086dc-0a69-41f4-9521-678f6a2593a5","resolution":{"observed_at":"2026-05-14T23:09:35.412175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ootd- iffusion: Outfitting fusion based latent diffusion for control- lable virtual try-on","venue":null,"work_id":"f43d441a-045f-46b3-9111-cb8950921f3a","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:ac1534d36fe0f449b6643d5d0168de4b9d751a1c8d13640b35a7ab7146c624a3","observation_id":"3411492e-d4a3-4381-8216-317a521d47e9","resolution":{"observed_at":"2026-05-14T23:09:35.485704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":"2308.06721","doi":"10.48550/arxiv.2308.06721","metadata_source":"pith","pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"98e51b10-54bd-4251-8a2d-f79bd6215c19","year":2023},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:2fd7454cd0685cc58c5ca943bdc59f15a69e2e9df791be81452e5abad3b32d89","observation_id":"f57cb858-f118-4ff1-bd15-88e5b49ce136","resolution":{"observed_at":"2026-05-14T21:58:03.405494Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generating high-resolution fashion model images wearing custom outfits","venue":null,"work_id":"caaa35e8-256d-476a-897b-3c7d1b75d3bd","year":2019},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:5158464e5c988e1bc5d352f0a6b254530c91a6377b4d9e46a539bcf005c6acaf","observation_id":"685f8ec1-752b-488e-b6e9-9bbb7f88cd55","resolution":{"observed_at":"2026-05-14T23:09:35.471612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pixel-level domain transfer","venue":null,"work_id":"16035b48-64e6-4001-b160-d7a48165a36e","year":2016},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:1370e783db244e2138437e4dff7870b35d26888749ec0b6c7584213c652db1bf","observation_id":"d28cfaff-25fe-4b5b-9ade-1909133ba0d5","resolution":{"observed_at":"2026-05-14T23:09:35.495742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:15:58.030192Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"a1b1bbd9-f486-4890-97fd-9338b7f32312","year":2018},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:38dbabccf81860bf80b7579022dd0d046378453b6f648feb0df7c0fd2d0a8356","observation_id":"caa36803-4cc9-478d-bb0d-c0ad5fac5972","resolution":{"observed_at":"2026-05-14T23:09:35.424354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Virtually trying on new clothing with arbitrary poses","venue":null,"work_id":"0532cf91-7c93-435c-a41c-f13a8d5a1271","year":2019},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:9a30a383317126559e8f4c7c4a65d0f71f4aba27cefba81fc0e7f2579d25497d","observation_id":"b5fa08ae-9018-49e7-99be-a4c3e4463bb8","resolution":{"observed_at":"2026-05-14T23:09:35.475784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning flow fields in attention for controllable person image generation","venue":null,"work_id":"08782a43-21f9-4516-b3eb-81e1df7f3345","year":2025},"citing_paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:10.499014Z"},"links":{"citing_paper":"/paper/2605.10127"},"observation_digest":"sha256:9fcba8e5d99ffa8033ea635b1b7748ddf175f01f0b5bd0e5390cf748499215a5","observation_id":"6b119ebc-16b6-4614-bbcc-c6083852a0d7","resolution":{"observed_at":"2026-05-14T23:09:35.442279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.10127","last_updated":"2026-05-13T05:54:11Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:22:08.560919Z","submitted_at":"2026-05-11T07:40:03Z","title":"Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":1,"verified_exact":23,"verified_fuzzy":34},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2605.10127."}