Skip to content

推理设置

本页面所有说明均适用于 OpenAI SDK,在 Claude / Gemini 原生 API 中无效。

Claude

Claude 3.7 模型开启 thinking

在请求时,将模型名称后面添加 #thinking 可以开启 thinking 模式。

例如:

bash
curl -X POST https://your-capkii-domain.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer sk-proj-1234567890" \
  -d '{
    "model": "claude-3-7-sonnet-20250219#thinking",
    "messages": [{"role": "user", "content": "你好"}]
  }'

自定义 Claude 3-7 模型推理参数

可使用以下参数控制请求中的推理标记 reasoning:

json
{
  "model": "claude-3-7-sonnet-2025021",
  "messages": [],
  "reasoning": {
    "effort": "high", // 强度参数 (可选)
    "max_tokens": 2000 // 推理最大tokens,目前特指budget_tokens (可选)
  }
}

开启推理

直接传入 "reasoning": {} 时,效果与 claude-3-7-sonnet-20250219#thinking 一致,无需再更改模型名称。

强度参数

effort 参数可以设置为 highmediumlow

  • high:将分配80%max_tokens作为budget_tokens
  • medium:将分配50%max_tokens作为budget_tokens
  • low:将分配20%max_tokens作为budget_tokens

推理最大 tokens

reasoning.max_tokens 参数可以设置为具体的数值,表示推理最大 tokens,目前特指 budget_tokens。

WARNING

reasoning.max_tokens 参数需大于 max_tokens,且不能低于 1024

优先级

若同时在 reasoning 中传入 effortmax_tokens,优先级如下:

  • max_tokens > effort

Gemini

自定义 Gemini 模型推理参数

Gemini 的推理参数与 Claude 不同。gemini 2.5 默认开启推理,如需关闭则需传入 reasoning 参数。

json
{
  "model": "gemini-2.5-flash-preview-04-17",
  "messages": [],
  "reasoning": {
    "max_tokens": 2000 // 推理最大tokens,目前特指budget_tokens (可选)
  }
}

WARNING

reasoning.max_tokens 为 0 时关闭推理。 仅传入 "reasoning": {} 时,默认关闭推理。

Capkii 产品文档