思考模式与思考强度
本文档仅针对 DeepSeek说明,模型支持思考模式:在输出最终回答之前,模型会先输出一段思维链内容,以提升最终答案的准确性。
思考模式开关与思考强度控制
| 控制参数(OpenAI 格式) | 控制参数(Anthropic 格式) | 控制参数(Responses API 格式) | |
| 思考模式开关 | {"thinking": {"type": "enabled/disabled"}} | {"reasoning": {"effort": "none/low/high/max"}}(none 表示关闭思考模式) | |
| 思考强度控制 | {"reasoning_effort": "low/high/max"} | {"output_config": {"effort": "low/high/max"}} | |
- 思考模式默认打开,且 effort 默认为
high
配置方式
请求体配置
- cURL
- Python
curl -X POST 'https://api.taiha.cn/v1/chat/completions' \
-H 'Content-Type: application/json' \
-H 'Authorization: Bearer <API Key>' \
-d '{
"model": "<Model ID>",
"messages": [{
"role": "user",
"content": "hello"
}],
"reasoning_effort": "high",
"extra_body": {"thinking": {"type": "enabled"}}
}'
import requests
url = "https://api.taiha.cn/v1/chat/completions"
headers = {
"Content-Type": "application/json",
"Authorization": "Bearer <API Key>",
}
payload = {
"model": "<Model ID>",
"messages": [{
"role": "user",
"content": "hello"
}],
"reasoning_effort": "high",
"extra_body": {"thinking": {"type": "enabled"}}
}
response = requests.post(url, headers=headers, json=payload, timeout=30)
response.raise_for_status()
result = response.json()
print(result)
if "choices" in result:
print("Assistant:", result["choices"][0]["message"]["content"])
模型名称配置
针对于某些Agent客户端不支持自定义请求体的情况,可通过在模型名称追加后缀的方式控制。
如请求 deepseek-v4-flash,可在客户端软件中将模型名称配置为:deepseek-v4-flash-none,从而控制关闭模型的思维链,以及控制模型思考强度的需求。
支持的后缀
- deepseek-v4-flash-none
- deepseek-v4-flash-low
- deepseek-v4-flash-max
输入输出参数
思考模式不支持 temperature、top_p、presence_penalty、frequency_penalty 参数。请注意,为了兼容已有软件,设置参数不会报错,但也不会生效。
在思考模式下,思维链内容通过 reasoning_content 参数返回,与 content 同级。在后续的轮次的拼接中,可以选择性地返回 reasoning_content 给 API:
- 在两个
user消息之间,如果请求 未携带tools参数 ,则中间assistant的reasoning_content无需参与上下文拼接,在后续轮次中将其传入 API 会被忽略。 - 在两个
user消息之间,如果请求 携带了tools参数 ,则中间assistant的reasoning_content需参与上下文拼接,在后续所有 user 交互轮次中必须 回传给 API ——即使该轮模型未实际进行工具调用,否则 API 会返回400错误。