A fine-tuned vision-language model trained on a new FashionRec dataset outperforms off-the-shelf VLMs on held-out dialogue similarity metrics for fashion recommendation.
Assembled or unassembled? different types of outfit coordination presentations in online fashion retailing,
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CV 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
FashionM3: Multimodal, Multitask, and Multiround Fashion Assistant based on Unified Vision-Language Model
A fine-tuned vision-language model trained on a new FashionRec dataset outperforms off-the-shelf VLMs on held-out dialogue similarity metrics for fashion recommendation.