Fine-tuning a LLaMA model with GRPO on live search-engine feedback yields query expansions that retrieve more relevant and diverse product results in e-commerce search.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.IR 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
LESER: Learning to Expand via Search Engine-feedback Reinforcement in e-Commerce
Fine-tuning a LLaMA model with GRPO on live search-engine feedback yields query expansions that retrieve more relevant and diverse product results in e-commerce search.