HPDT improves few-shot policy generalization in offline meta-RL by adding a global task-level prompt and retrieval-based adaptive prompts to a decision transformer.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.LG 1years
2024 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Hierarchical Prompt Decision Transformer: Improving Few-Shot Policy Generalization with Global and Adaptive Guidance
HPDT improves few-shot policy generalization in offline meta-RL by adding a global task-level prompt and retrieval-based adaptive prompts to a decision transformer.