Pith. sign in

← back to paper

Review history

arxiv: 2607.12924 · 2 revisions

Knowledge- and Gradient-Guided Reinforcement Learning for Parametrized Action Markov Decision Processes

  1. 2026-08-02 CONDITIONAL MODERATE v1.3.0-alltime-deepseek novelty 6.0
    171558 ms 15277 in 11550 out 2026-08-02T06:11:43.631442+00:00
  2. 2026-07-15 UNVERDICTED LOW v1.1.0-grok45 novelty 5.0
    28013 ms 6150 in 2507 out 2026-07-15T02:17:03.282455+00:00