Pith. sign in

Guardreasoner: Towards reasoning-based llm safeguards

13 Pith papers cite this work, alongside 2 external citations. Polarity classification is still indexing.

13 Pith papers citing it
2 external citations · external index

citation-role summary

dataset 1

citation-polarity summary

years

2026 12 2025 1

roles

dataset 1

polarities

use dataset 1

representative citing papers

Robust and Efficient Guardrails with Latent Reasoning

cs.AI · 2026-05-27 · unverdicted · novelty 7.0

COLAGUARD matches explicit-reasoning guardrail performance on safety benchmarks while delivering 12.9X speedup and 22.4X token reduction by propagating hidden states instead of generating text.

citing papers explorer

Showing 13 of 13 citing papers.