Pith. sign in

Investigating the parameters of the beta distribution

1 Pith paper cite this work. Polarity classification is still indexing.

1 Pith paper citing it

citation-role summary

method 1

citation-polarity summary

fields

cs.LG 1

years

2025 1

verdicts

CONDITIONAL 1

roles

method 1

polarities

support 1

representative citing papers

Distributionally Robust Deep Q-Learning

cs.LG · 2025-05-25 · conditional · novelty 5.0

Sinkhorn-ball robust Bellman equation for continuous-state MDPs is implemented as a Robust DQN that learns policies robust to transition-model misspecification.

citing papers explorer

Showing 1 of 1 citing paper.

  • Distributionally Robust Deep Q-Learning cs.LG · 2025-05-25 · conditional · none · ref 1

    Sinkhorn-ball robust Bellman equation for continuous-state MDPs is implemented as a Robust DQN that learns policies robust to transition-model misspecification.