跳到主要内容

思考模式与思考强度

本文档仅针对 DeepSeek说明,模型支持思考模式:在输出最终回答之前,模型会先输出一段思维链内容,以提升最终答案的准确性。

思考模式开关与思考强度控制

控制参数(OpenAI 格式)控制参数(Anthropic 格式)控制参数(Responses API 格式)
思考模式开关{"thinking": {"type": "enabled/disabled"}}{"reasoning": {"effort": "none/low/high/max"}}
(none 表示关闭思考模式)
思考强度控制{"reasoning_effort": "low/high/max"}{"output_config": {"effort": "low/high/max"}}
  • 思考模式默认打开,且 effort 默认为 high

配置方式

请求体配置

curl -X POST 'https://api.taiha.cn/v1/chat/completions' \
-H 'Content-Type: application/json' \
-H 'Authorization: Bearer <API Key>' \
-d '{
"model": "<Model ID>",
"messages": [{
"role": "user",
"content": "hello"
}],
"reasoning_effort": "high",
"extra_body": {"thinking": {"type": "enabled"}}
}'

模型名称配置

针对于某些Agent客户端不支持自定义请求体的情况,可通过在模型名称追加后缀的方式控制。

如请求 deepseek-v4-flash,可在客户端软件中将模型名称配置为:deepseek-v4-flash-none,从而控制关闭模型的思维链,以及控制模型思考强度的需求。

支持的后缀

  • deepseek-v4-flash-none
  • deepseek-v4-flash-low
  • deepseek-v4-flash-max

输入输出参数

思考模式不支持 temperaturetop_ppresence_penaltyfrequency_penalty 参数。请注意,为了兼容已有软件,设置参数不会报错,但也不会生效。

在思考模式下,思维链内容通过 reasoning_content 参数返回,与 content 同级。在后续的轮次的拼接中,可以选择性地返回 reasoning_content 给 API:

  • 在两个 user 消息之间,如果请求 未携带 tools 参数 ,则中间 assistantreasoning_content 无需参与上下文拼接,在后续轮次中将其传入 API 会被忽略。
  • 在两个 user 消息之间,如果请求 携带了 tools 参数 ,则中间 assistantreasoning_content 需参与上下文拼接,在后续所有 user 交互轮次中必须 回传给 API ——即使该轮模型未实际进行工具调用,否则 API 会返回 400 错误。