Research questionHow can deployable LLM guardrails maintain robust safety moderation without explicit reasoning’s latency and token overhead?Reasoning-based moderation can improve safety judgments but generates extra tokens and increases query latency. This tradeoff makes strong moderation difficult to deploy at high throughput.