Skip to content

Fikrlash (fikrlash)

Zamonaviy modellar javob berishdan oldin o'ylashni o'rganishadi, chunki ular o'zlarining ichki fikrlash zanjirini yaratadi (ma'rifat).Bu murakkab vazifalarda (matematika, kod, ko'p bosqichli mantiqa) sifatni sezilarli darajada oshiradi, ammo qo'shimcha tokenlarni sarflaydi. NordRouter barcha standart fikrlash parametrlarini o'tkazadi.

Bu pul to'lovlariga qanday ta'sir qiladi?

Birinchidan, **Reasoning-tokenlar oddiy xulosa-tokomonlar sifatida ** modelning dan chiqishi narxi bo'yicha tariflanadi.Katalog.

  • Javobda ular allaqachon usage.completion_tokens ga kiritilgan.
  • Ularni alohida-alohida usage.completion_tokens_details.reasoning_tokensda ko'rish mumkin.
json
"usage": {
  "prompt_tokens": 179,
  "completion_tokens": 545,          // всего вывода — это и биллится
  "completion_tokens_details": {
    "reasoning_tokens": 445          // из них на рассуждения
  }
}

Fikrlash modellari ko'rinishidan ko'ra qimmatroq.

DeepSeek R1, Grok, GLM va boshqa asoslanish modellari andoza ravishda o'ylaydilar sodda savolga javob ko'rinadigan matnning 510 baravar ko'proq tokeniga teng bo'lishi mumkin. usage.

Qanday boshqarishni

So'rov tanasida reasoning ob'ekti orqali (klassik OpenAI-variant reasoning_effort: "low" | "medium" | "high") ishlaydi):

bash
curl https://nordrouter.com/v1/chat/completions \
  -H "Authorization: Bearer sk-nr-ВАШ-КЛЮЧ" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "anthropic/claude-sonnet-5",
    "max_tokens": 4000,
    "reasoning": { "effort": "high" },
    "messages": [{ "role": "user", "content": "Сложная задача…" }]
  }'
OʻrnatishNima qiladi
reasoning.effortFikrlash chuqurligi: "low" / "medium" / "high". Kamroq harakat kamroq sabab berish-to'konlar va arzonroq javob
reasoning.max_tokensTo'kinning fikrlash uchun byudjet (stili ) Anthropic) kamroq bo'lishi kerak. max_tokens so'rovni so'rash
reasoning.enabled: falseFikrlarni o'chirib tashlash (agar model uni qo'llab-quvvatlasa)
reasoning.exclude: trueJavobdan fikrlar matnini yashirish. Qimmatni tejashmaydi Model hali ham o'ylaydi, tokenlar tariflanadi

Fikrlarning matni (agar yashirin bo'lmasa) message.reasoning / message.reasoning_detailsga qaytariladi.

Modellarning xususiyatlari

Bu erda NordRouter: orqali jonli so'rovlar bilan tasdiqlangan.

ModellariXatti-harakatlar
anthropic/claude-sonnet-5Andoza ravishda fikr yuritmaydi. effort va max_tokens o'ylashni o'z ichiga oladi, enabled: false esa odil ravishda
anthropic/claude-fable-5O'zi qaror qiladi, qancha. reasoning.* parametrlari qo'llab-quvvatlanmaydi (400 bo'ladi); chuqurlik boshqarilmoqda output_config: { "effort": "low" | "medium" | "high" }
openai/gpt-5.4, gpt-5.5Andoza ravishda fikrlash; reasoning_effort chuqurlikni ko'paytiradi
x-ai/grok-4.3Andoza va xohish bilan fikrlaydi (sotadan ko'p tokenlar); effort: "low"
deepseek/deepseek-r1, z-ai/glm-5.xHar doim shunday deb o'ylashadi: izovdan tashqari faqat matnni yashiradi, sabablash-tokomonlari hali ham tariflanadi

Qanday qilib tejash mumkin

  1. GPT/Grok uchun oddiy vazifalarga effort: "low" qo'ying, sifat zarar ko'rmaydi, xarajatlar ko'payadi.
  2. ** Claude haqida o'ylashni bekorga qo'ymang** sonet-5 andoza ravishda fikrlashsiz va arzonroq javob beradi.
  3. ** max_tokens** bu qattiq cheklovni butun xulosa, shu jumladan, fikrlash uchun cheklang.
  4. **Qo'ldan foydalanmang exclude * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * *
  5. Oddiy ravishda o'zlashtirilmaydigan modellarni olish uchun (deepseek-chat-v3.1, gemini-3.5-flash) faqat narx emas, balki haqiqiy usage ni ko'ring.