Pith. sign in

Baldro: A distributionally robust optimization based framework for large language model unlearning

3 Pith papers cite this work. Polarity classification is still indexing.

3 Pith papers citing it

citation-role summary

background 1

citation-polarity summary

fields

cs.LG 2 cs.CV 1

years

2026 3

roles

background 1

polarities

background 1

representative citing papers

Mitigating Error Amplification in Fast Adversarial Training

cs.LG · 2026-04-27 · unverdicted · novelty 6.0

DDG dynamically adjusts perturbation magnitude and supervision strength in fast adversarial training according to sample confidence at the ground-truth class, mitigating catastrophic overfitting and the robustness-accuracy trade-off.

citing papers explorer

Showing 3 of 3 citing papers.