Pith. sign in

← back to paper

Review history

arxiv: 2510.24515 · 2 revisions

Learning Ordinal Response Policies in Rank-Based Stochastic Prize-Collecting Games

  1. 2026-08-15 REJECT MODERATE v1.4.0-alltime-deepseek-medium novelty 6.0
    148731 ms 12364 in 15989 out 2026-08-15T15:41:10.330630+00:00
  2. 2026-08-04 CONDITIONAL HIGH v1.3.0-alltime-deepseek novelty 6.0
    166424 ms 12356 in 16375 out 2026-08-04T07:41:44.254048+00:00