Pith. sign in

Reward design with language models

12 Pith papers cite this work. Polarity classification is still indexing.

12 Pith papers citing it

citation-role summary

background 4

citation-polarity summary

verdicts

UNVERDICTED 12

roles

background 4

polarities

background 4

representative citing papers

What Is Preference Optimization Doing, and Why?

cs.LG · 2025-11-30 · unverdicted · novelty 5.0

Gradient analysis and ablations show DPO and PPO have different target directions and component roles in preference optimization for LLMs.

citing papers explorer

Showing 12 of 12 citing papers.