Skip to content

推理 (推理模式)

现代模型能够在答案之前思考,产生内部推理链,这显著提高了复杂任务 (数学,代码,多步逻辑) 的质量,但花费了更多的代币. NordRouter透明地通过了所有标准的推理控制参数,没有必要特别调整任何东西.

这如何影响票价?

规则一: 理性代码作为普通结论代码被定价 以模型的出口价格从目录.

  • 答案是,它们已经在usage.completion_tokens中被包含.
  • 单独可以在usage.completion_tokens_details.reasoning_tokens查看.
json
"usage": {
  "prompt_tokens": 179,
  "completion_tokens": 545,          // всего вывода — это и биллится
  "completion_tokens_details": {
    "reasoning_tokens": 445          // из них на рассуждения
  }
}

智能模式比看起来更昂贵.

根据DeepSeek R1,Grok,GLM等推理模型的默认方式,一个简单的问题可以花费510倍的代币,比视觉文字更高.比较不仅是代币价,而是实际的成本在usage.

如何管理

通过查询器体中的物体 reasoning (经典的 OpenAI-variant reasoning_effort: "low" | "medium" | "high") 运行:

bash
curl https://nordrouter.com/v1/chat/completions \
  -H "Authorization: Bearer sk-nr-ВАШ-КЛЮЧ" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "anthropic/claude-sonnet-5",
    "max_tokens": 4000,
    "reasoning": { "effort": "high" },
    "messages": [{ "role": "user", "content": "Сложная задача…" }]
  }'
设置什么是
推理深度: "low" /reasoning.effort
reasoning.max_tokens投资金用于 टोकन讨论 (风格) Anthropic应该是小的. max_tokens 查询
reasoning.enabled: false排除推理 (模型支持)
reasoning.exclude: true隐藏答案中的推理文字. 不省钱 模型仍然认为,代币被收取.

推理文本 (如果没有隐藏) 将返回message.reasoning / message.reasoning_details.

模型的特点

通过NordRouter::通过现场查询验证.

模型行为
anthropic/claude-sonnet-5默认不进行推理. effortmax_tokens 包含思考, enabled: false 诚实地排除了
anthropic/claude-fable-5认为是适应性的** 自己决定了多少. reasoning.* 的参数不支持 (将是400);深度控制 output_config: { "effort": "low" | "medium" | "high" }
openai/gpt-5.4, gpt-5.5默认推理; reasoning_effort 扩展了深度的规模
x-ai/grok-4.3默认和随意 (数百个代币) 进行推理; effort: "low" 显著缩短
deepseek/deepseek-r1, z-ai/glm-5.x他们总是认为: 例外只是隐藏了文字,推理符号仍然被收取费用

如何节省钱

  1. 请在GPT/Grok 的简单任务上查 effort: "low",质量不会受到影响,成本会减少一倍.
  2. 不要在无需的情况下考虑克劳德 sonnet-5默认地回答,没有推理,而且更便宜.
  3. 限制max_tokens 这个坚固的限度,让我们全部得出结论,包括推理.
  4. 不要使用 exclude为节省 它只是隐藏文字,不退钱.
  5. 为了选取不合理的模式 (deepseek-chat-v3.1, gemini-3.5-flash),请查看实际的 usage,而不是仅仅是价格.