LLMs1 min read
Pause token fine-tuning improves reasoning model training dynamics
Research shows that pause tokens, when used as a training intervention, enhance reasoning capabilities in large language models without compromising language understanding.
From arXiv cs.CL