A generative-reward-model-based simulated user that scores and critiques recommendations lets LLM conversational recommenders improve via beam-search interaction, surpassing prior methods on ReDial and INSPIRED.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.IR 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Search-Based Interaction For Conversation Recommendation via Generative Reward Model Based Simulated User
A generative-reward-model-based simulated user that scores and critiques recommendations lets LLM conversational recommenders improve via beam-search interaction, surpassing prior methods on ReDial and INSPIRED.