Pith. sign in

arXiv preprint arXiv:2305.11812 , year=

3 Pith papers cite this work. Polarity classification is still indexing.

3 Pith papers citing it

citation-role summary

background 1

citation-polarity summary

years

2026 3

verdicts

UNVERDICTED 3

roles

background 1

polarities

background 1

representative citing papers

Wasserstein Policy Learning for Distributional Outcomes

stat.ME · 2026-06-17 · unverdicted · novelty 7.0

Establishes finite-sample regret bounds of order sqrt(N-dim(Π)/N) for IPW and DR estimators in Wasserstein policy learning with distributional outcomes, plus a matching minimax lower bound.

Logging Policy Design for Off-Policy Evaluation

stat.ML · 2026-05-14 · unverdicted · novelty 5.0 · 2 refs

Derives optimal logging policies for minimizing off-policy evaluation error under known, unknown, and partially known target policies and reward distributions.

citing papers explorer

Showing 3 of 3 citing papers.

  • Triage Score: A Counterfactual Risk Assessment Instrument stat.AP · 2026-06-19 · unverdicted · none · ref 32

    Triage scores extend risk scores via additive counterfactual utilities to incorporate intervention effects in high-stakes decisions.

  • Wasserstein Policy Learning for Distributional Outcomes stat.ME · 2026-06-17 · unverdicted · none · ref 18

    Establishes finite-sample regret bounds of order sqrt(N-dim(Π)/N) for IPW and DR estimators in Wasserstein policy learning with distributional outcomes, plus a matching minimax lower bound.

  • Logging Policy Design for Off-Policy Evaluation stat.ML · 2026-05-14 · unverdicted · none · ref 6 · 2 links

    Derives optimal logging policies for minimizing off-policy evaluation error under known, unknown, and partially known target policies and reward distributions.