Research questionHow do pause tokens affect reasoning adaptation while preserving previously learned capabilities during LLM fine-tuning?Fine-tuning language models for reasoning can overwrite previously learned distributions and abilities. The training-dynamics role of pause tokens is less understood than their use as additional computation steps.