模型在生成答案时额外投入的计算资源。
这就像下棋时肯不肯多停几手:不是棋手突然变强了,而是愿意多算几步后手,少来点拍脑袋落子。
常见于推理、代码和数学题;算得更久,通常更稳,但也更慢更贵。
Reasoning effort它常通过“思考更多”这类档位被直接调节。
Inference它发生在出答案阶段,不是训练阶段加算力。
Reasoning-model推理模型常靠临场多算几步,换更稳的答案。
Compute-race如果大家都让模型临场多算,算力压力也会更大。