控制模型为回答投入多少推理计算的设置。
同样一道题,让它脱口秒答,还是关进书房多盘两轮,答得稳不稳,常常差着段位。
复杂任务里多想通常更稳,但也更慢、更费算力。
Reasoning-model推理模型更常提供这类“多想一点”的控制选项。
Chain-of-thought它会影响中间思考过程展开得多深多细。
Inference推理力度越高,通常延迟越长、成本越高。
Token它往往伴随更多 token 消耗,尤其在复杂任务里。