模型在简单任务上投入不必要推理计算的现象。
一道 2+2,它却像考场上写满草稿纸:明明要答案,偏把简单题推演成大题。
会拉长回答、抬高成本;推理模型和在线服务常需给它设上限。
Reasoning effort思考强度设得过高,可能让模型在简单题上想得太久。
Test-time compute过度思考会在推理阶段消耗额外的计算预算。
Token Efficiency冗长推理会增加不必要的输出 token,降低使用效率。