Research questionHow can text generation retain consensus-decoding quality without repeated candidate sampling and utility scoring at inference time?Consensus-based decoding can improve generated text by comparing several sampled candidates under a utility function. Repeating both candidate generation and utility scoring at inference time is costly, while amortizing that work may require gold references or preference-labeled data.