Skip to content

Fabel 5 - Konteks Ringkas

anthropic/claude-fable-5-compressed-context - mode eksperimental Claude Fable 5. Ini adalah model yang sama dengan harga per token yang sama, tetapi konteks panjang diproses dengan lebih ringkas: dalam dialog besar, token input yang dikenakan biaya jauh lebih sedikit.

Eksperimental - semua risiko ada pada Anda

Modusnya masih dalam tahap percobaan. Pada sebagian besar soal, jawabannya tidak berbeda dari Fabel 5 biasanya, tetapi pada soal dengan reproduksi kata demi kata yang sangat presisi dari dokumen berukuran besar, perbedaan mungkin terjadi. Gunakan dengan risiko Anda sendiri; untuk skenario kritis, ambil anthropic/claude-fable-5 biasa.

Berapa penghematannya?

Harga per token sama persis dengan Fable 5 biasa ($1,548 masuk / $7,74 keluar per 1 juta). Penghematan terjadi karena konteks panjang dihitung sebagai token yang lebih sedikit. Pengukuran langsung melalui NordRouter - perintah sistem yang sama ~24 KB:

prompt_tokensBiaya masuk
claude-fable-55 053~$0.0078
claude-fable-5-compressed-context1 287~$0.0020

−75% token masukan dalam contoh ini. Semakin panjang konteksnya, semakin nyata manfaatnya: dalam pengkodean agen dan obrolan panjang, di mana cerita dikirimkan di setiap langkah, anggaran dihemat hingga 70% atau lebih. Untuk pertanyaan singkat hampir tidak ada perbedaan.

Hanya Anthropic-format

Mode ini berfungsi hanya melalui Anthropic-titik akhir yang kompatibel /v1/messages:

  • ✅ Claude Code
  • ✅ Anthropic SDK (Python / TypeScript)
  • ✅ Klien mana pun dengan ANTHROPIC_BASE_URL
  • ❌ OpenAI-format /v1/chat/completions - tidak didukung untuk mode ini

Bagaimana cara mencoba

Claude Code

Di ~/.claude/settings.json masukkan model (konfigurasi lengkap di sini):

json
"ANTHROPIC_MODEL": "anthropic/claude-fable-5-compressed-context"

Anthropic SDK / curl

bash
curl https://nordrouter.com/v1/messages \
  -H "x-api-key: sk-nr-ВАШ-КЛЮЧ" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "anthropic/claude-fable-5-compressed-context",
    "max_tokens": 1024,
    "messages": [{ "role": "user", "content": "Привет!" }]
  }'
python
from anthropic import Anthropic

client = Anthropic(base_url="https://nordrouter.com", api_key="sk-nr-ВАШ-КЛЮЧ")

resp = client.messages.create(
    model="anthropic/claude-fable-5-compressed-context",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.content[0].text)

cache

Cache yang cepatbekerja dalam mode ini (kecepatan yang sama: tulis ×1,25, baca ×0,1). Nuansanya: kecocokan dengan cache bisa bersifat parsial - bagian dari konteks berulang terkadang datang dengan harga masuk yang biasa. Mempertimbangkan fakta bahwa input itu sendiri dianggap beberapa kali lebih kecil, biaya akhir masih lebih rendah dibandingkan Fable 5 biasa dengan cache yang ideal.

Kapan harus memilih apa

SkenarioModel
Pengkodean berbasis agen, obrolan panjang, dokumen besar dalam konteksclaude-fable-5-compressed-context - penghematan maksimum
Kutipan kata demi kata/audit teks besar, jalur produksi pentingclaude-fable-5 - mode normal
Permintaan singkat tanpa konteks panjangTidak ada perbedaan - ambil