接新模型第一件事:查 reasoning token
多家模型的思考链是默认开着的。不关的话,典型症状是:一次调用几十秒、
max_tokens 全烧在思考上、content 返回空字符串——看着像模型罢工,其实是配置问题。
关掉的参数各家不一样
| 家 | 参数 |
|---|---|
| 豆包(火山方舟) | thinking: {"type": "disabled"} |
| DeepSeek 官方 API | reasoning_effort: "none" |
| OpenRouter 转发 | reasoning: {"effort": "low"} |
怎么确认真关掉了
看 usage:关掉后连 reasoning_tokens 这个字段都不该再出现。只看响应时间会误判。
所以接任何新模型,第一件事就是打一次 usage 看 reasoning token——比读文档快,也比读文档准。