Pith. sign in

← back to paper

Review history

arxiv: 2603.08287 · 2 revisions

Posterior Sampling Reinforcement Learning with Gaussian Processes for Continuous Control: Sublinear Regret Bounds for Unbounded State Spaces

  1. 2026-08-02 CONDITIONAL MODERATE v1.3.0-alltime-deepseek novelty 6.0
    152171 ms 39589 in 16510 out 2026-08-02T18:32:50.241337+00:00
  2. 2026-07-15 UNVERDICTED LOW v1.1.0-grok45 novelty 6.0
    22273 ms 8487 in 2388 out 2026-07-15T12:42:58.841751+00:00