Pith. sign in

← back to paper

Review history

arxiv: 2607.17823 · 2 revisions

Theoretical Foundations of $\max$@$k$ Reinforcement Learning

  1. 2026-08-15 CONDITIONAL MODERATE v1.4.0-alltime-deepseek-medium novelty 7.0
    327142 ms 36981 in 40933 out 2026-08-15T15:37:00.170438+00:00
  2. 2026-08-01 CONDITIONAL MODERATE v1.3.0-alltime-deepseek novelty 7.0
    165524 ms 3700 in 4317 out 2026-08-01T16:54:01.839973+00:00