Pith. sign in

Title resolution pending

1 Pith paper cite this work. Polarity classification is still indexing.

1 Pith paper citing it

fields

cs.CL 1

years

2026 1

verdicts

UNVERDICTED 1

representative citing papers

Better, Faster: Harnessing Self-Improvement in Large Reasoning Models

cs.CL · 2026-05-24 · unverdicted · novelty 6.0

HSIR improves self-improvement for LRMs via verify-then-exit sampling and intrinsic diversity scoring, delivering up to 10.9% performance gains and 42.4% lower inference overhead across post-training methods including H-GRPO.

citing papers explorer

Showing 1 of 1 citing paper.

  • Better, Faster: Harnessing Self-Improvement in Large Reasoning Models cs.CL · 2026-05-24 · unverdicted · none · ref 4

    HSIR improves self-improvement for LRMs via verify-then-exit sampling and intrinsic diversity scoring, delivering up to 10.9% performance gains and 42.4% lower inference overhead across post-training methods including H-GRPO.