A new null-counterfactual interaction detector (NCII) and a hindsight-filtering method (HInt) improve goal-conditioned RL sample efficiency in object-centric domains.
f-policy gradients: A general framework for goal-conditioned rl using f-divergences
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.LG 1years
2025 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning
A new null-counterfactual interaction detector (NCII) and a hindsight-filtering method (HInt) improve goal-conditioned RL sample efficiency in object-centric domains.