- Date: 2026-08-19
- Type: feature
- Scope:
types,claude5,deepseek_v4,gemini3_7,tests - PR: #176
ThinkingLevel在XHIGH之上新增MAX:两种语言的档位现为NONE、LOW、MEDIUM、HIGH、XHIGH、MAX。各 client 将其映射到自家服务方所接受的最深档位,遇到没有对应档位的 服务方则静默降级,因此不会有 client 因为思考档位而抛错。deepseek_v4按 DeepSeek 当前的取值重排了映射:该服务接受low/high/max,并在服务端把medium与xhigh映射为high。因此LOW现在发送low(此前发送high),XHIGH现在发送high(此前发送max),MAX发送max。gemini3_7改为在「没有从 chunk 中读出任何内容」时(无内容项、无用量、无结束原因)把事件标记为unused,而不再依据原始 chunk 上缺少 candidates 与 usage 来推断这是网关心跳。不返回用量的流在 两种写法下都不受影响。- playground 的思考档位选择器新增
Max选项,XHigh的描述也相应改为扩展档而非最高档。 gemini3_7记录了thinking_summary在哪些模型上真的会返回思考摘要:2026-08-19 实测,gemini-2.5-flash与gemini-3.1-pro-preview会返回 thought part,而gemini-3.5-flash、gemini-3.6-flash、gemini-3.7-flash都不返回。请求本就带上了include_thoughts, client 无需改动。
| AgentHub | OpenAI Responses | Claude 4.6+ | Gemini | DeepSeek V4 | GLM-5.3 | GLM-5.2 | Kimi K3 | MiniMax M3 |
|---|---|---|---|---|---|---|---|---|
NONE |
none |
不发送 thinking | minimal |
关闭思考 | low |
关闭思考 | low |
none |
LOW |
low |
low |
low |
low |
low |
low |
low |
low |
MEDIUM |
medium |
medium |
medium |
high |
high |
medium |
high |
medium |
HIGH |
high |
high |
high |
high |
high |
high |
high |
high |
XHIGH |
xhigh |
xhigh(4.6 上为 high) |
high |
high |
max |
xhigh |
max |
high |
MAX |
max |
max |
high |
max |
max |
max |
max |
high |
Gemini 的档位随后还会钳制到目标模型支持的集合;GLM-5.3 与 Kimi K3 无法关闭思考,因此 NONE 落在
它们最轻的档位上。
llmsdk_docs/deepseek_v4/docs/thinking-mode.md依据 https://api-docs.deepseek.com/guides/thinking_mode 重新同步:reasoning_effort接受low/high/max,兼容映射把medium与xhigh归入high。