推理 (推理模式)
现代模型能够在答案之前思考,产生内部推理链,这显著提高了复杂任务 (数学,代码,多步逻辑) 的质量,但花费了更多的代币. NordRouter透明地通过了所有标准的推理控制参数,没有必要特别调整任何东西.
这如何影响票价?
规则一: 理性代码作为普通结论代码被定价 以模型的出口价格从目录.
- 答案是,它们已经在
usage.completion_tokens中被包含. - 单独可以在
usage.completion_tokens_details.reasoning_tokens查看.
json
"usage": {
"prompt_tokens": 179,
"completion_tokens": 545, // всего вывода — это и биллится
"completion_tokens_details": {
"reasoning_tokens": 445 // из них на рассуждения
}
}智能模式比看起来更昂贵.
根据DeepSeek R1,Grok,GLM等推理模型的默认方式,一个简单的问题可以花费510倍的代币,比视觉文字更高.比较不仅是代币价,而是实际的成本在usage.
如何管理
通过查询器体中的物体 reasoning (经典的 OpenAI-variant reasoning_effort: "low" | "medium" | "high") 运行:
bash
curl https://nordrouter.com/v1/chat/completions \
-H "Authorization: Bearer sk-nr-ВАШ-КЛЮЧ" \
-H "Content-Type: application/json" \
-d '{
"model": "anthropic/claude-sonnet-5",
"max_tokens": 4000,
"reasoning": { "effort": "high" },
"messages": [{ "role": "user", "content": "Сложная задача…" }]
}'| 设置 | 什么是 |
|---|---|
推理深度: "low" / | reasoning.effort |
reasoning.max_tokens | 投资金用于 टोकन讨论 (风格) Anthropic应该是小的. max_tokens 查询 |
reasoning.enabled: false | 排除推理 (模型支持) |
reasoning.exclude: true | 隐藏答案中的推理文字. 不省钱 模型仍然认为,代币被收取. |
推理文本 (如果没有隐藏) 将返回message.reasoning / message.reasoning_details.
模型的特点
通过NordRouter::通过现场查询验证.
| 模型 | 行为 |
|---|---|
anthropic/claude-sonnet-5 | 默认不进行推理. effort 和 max_tokens 包含思考, enabled: false 诚实地排除了 |
anthropic/claude-fable-5 | 认为是适应性的** 自己决定了多少. reasoning.* 的参数不支持 (将是400);深度控制 output_config: { "effort": "low" | "medium" | "high" } |
openai/gpt-5.4, gpt-5.5 | 默认推理; reasoning_effort 扩展了深度的规模 |
x-ai/grok-4.3 | 默认和随意 (数百个代币) 进行推理; effort: "low" 显著缩短 |
deepseek/deepseek-r1, z-ai/glm-5.x | 他们总是认为: 例外只是隐藏了文字,推理符号仍然被收取费用 |
如何节省钱
- 请在GPT/Grok 的简单任务上查
effort: "low",质量不会受到影响,成本会减少一倍. - 不要在无需的情况下考虑克劳德 sonnet-5默认地回答,没有推理,而且更便宜.
- 限制
max_tokens这个坚固的限度,让我们全部得出结论,包括推理. - 不要使用
exclude为节省 它只是隐藏文字,不退钱. - 为了选取不合理的模式 (
deepseek-chat-v3.1,gemini-3.5-flash),请查看实际的usage,而不是仅仅是价格.