Pith. sign in

arXiv preprint arXiv:2012.05909 , year=

2 Pith papers cite this work. Polarity classification is still indexing.

2 Pith papers citing it

years

2026 2

verdicts

UNVERDICTED 2

representative citing papers

MODIP: Efficient Model-Based Optimization for Diffusion Policies

cs.LG · 2026-06-09 · unverdicted · novelty 6.0

MODIP fine-tunes diffusion policies offline-to-online by training a world model, running MPC with terminal state values inside it to create targets, and using policy-independent TD critics, yielding gains over BC on D4RL and RoboMimic tasks.

citing papers explorer

Showing 2 of 2 citing papers.

  • Solving Markov Decision Processes with Future Information via MPC eess.SY · 2026-06-23 · unverdicted · none · ref 72

    Parameterized MPC exactly represents optimal policies for MDPs with future information under identified structural conditions and parameters can be learned via RL.

  • MODIP: Efficient Model-Based Optimization for Diffusion Policies cs.LG · 2026-06-09 · unverdicted · none · ref 28

    MODIP fine-tunes diffusion policies offline-to-online by training a world model, running MPC with terminal state values inside it to create targets, and using policy-independent TD critics, yielding gains over BC on D4RL and RoboMimic tasks.