SUIT uses counterfactual turn replacements to select high-quality subgoal training samples and iteratively retrains task-oriented dialog models, reaching a COMBINED score of 105.02 on MultiWOZ 2.2.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CL 1years
2024 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Learning from Relevant Subgoals in Successful Dialogs using Iterative Training for Task-oriented Dialog Systems
SUIT uses counterfactual turn replacements to select high-quality subgoal training samples and iteratively retrains task-oriented dialog models, reaching a COMBINED score of 105.02 on MultiWOZ 2.2.