接新模型第一件事:查 reasoning token

多家模型的思考链是默认开着的。不关的话,典型症状是:一次调用几十秒、 max_tokens 全烧在思考上、content 返回空字符串——看着像模型罢工,其实是配置问题。

关掉的参数各家不一样

参数
豆包(火山方舟) thinking: {"type": "disabled"}
DeepSeek 官方 API reasoning_effort: "none"
OpenRouter 转发 reasoning: {"effort": "low"}

怎么确认真关掉了

usage:关掉后连 reasoning_tokens 这个字段都不该再出现。只看响应时间会误判。

所以接任何新模型,第一件事就是打一次 usage 看 reasoning token——比读文档快,也比读文档准。