Pith. sign in

← back to paper

Review history

arxiv: 2506.17919 · 2 revisions

Permutation Equivariant Model-based Offline Reinforcement Learning for Auto-bidding

  1. 2026-08-15 CONDITIONAL MODERATE v1.4.0-alltime-deepseek-medium novelty 5.0
    267162 ms 22442 in 31051 out 2026-08-15T19:00:01.520177+00:00
  2. 2026-08-06 CONDITIONAL MODERATE v1.4.0-alltime-deepseek-medium novelty 6.0
    170287 ms 22433 in 17657 out 2026-08-06T23:24:01.776596+00:00