Claude Sonnet 5.5 Fiyatlandırması: Kapsamlı Maliyet Dökümü (API, Önbellekleme, Toplu İşlem ve Planlar)

Claude Sonnet 5.5 fiyatlandırması: milyon token başına 2$/10$, 0,20$ önbellek okuması, toplu işlemler yarı fiyatına. Hesaplanan maliyet örnekleri, çaba maliyetleri ve plan fiyatları.

Ashley Goolam

Ashley Goolam

29 September 2026

Claude Sonnet 5.5 Fiyatlandırması: Kapsamlı Maliyet Dökümü (API, Önbellekleme, Toplu İşlem ve Planlar)

Kurumsal İçin Apidog

Şirket İçi (On-Premises) Dağıtım

SSO ve RBAC

SOC 2 Uyumlu

Apidog Enterprise'ı Keşfedin

Claude Sonnet 5.5, Claude API'de Sonnet 5 ile aynı şekilde, milyon giriş tokenı başına 2$ ve milyon çıkış tokenı başına 10$ maliyetindedir. Önbellek okumaları milyon başına 0,20$ tutarındadır, Batch API her iki oranı da 1$ ve 5$'a düşürür, tam 1M bağlam penceresi standart tarifeden faturalandırılır ve hızlı mod sunulmamaktadır. Sonnet 5'in 1 Eylül'de 3$/15$ olarak planlanan zam iptal edildi, bu nedenle 2$/10$ şimdi standart fiyattır.

Bu kılavuz, Claude Sonnet 5.5 fiyatlandırmasının her kalemini listeler, gösterilen aritmetikle üç maliyet örneğini inceler ve harcanan çabanın faturanızı token başına orandan daha fazla neden etkilediğini açıklar. Modele yeni mi başladınız? Claude Sonnet 5.5 nedir ile başlayın veya Claude Sonnet 5.5'i ücretsiz nasıl kullanacağınızı okuyun. Kendi trafiğinize göre sayıları kontrol etmek için isteği Apidog'dan gönderin ve her yanıttaki usage bloğunu okuyun.

Claude Sonnet 5.5 API fiyatlandırma tablosu

Milyon token (MTok) başına fiyatlar, Anthropic'in fiyatlandırma belgelerinden:

Kalem MTok başına fiyat
Giriş 2,00$
5 dakikalık önbellek yazma 2,50$
1 saatlik önbellek yazma 4,00$
Önbellek okuma 0,20$
Çıkış 10,00$
Toplu giriş 1,00$
Toplu çıkış 5,00$

Ödediğiniz miktarı değiştiren üç detay:

Sonnet 5.5'in liste fiyatı karşılaştırması

Model Giriş Çıkış Notlar
Claude Sonnet 5.5 2$ 10$ Önbellek okuma 0,20$; 1M bağlam; hızlı mod yok
Claude Sonnet 5 2$ 10$ Önbellek okuma 0,20$; 3$/15$ zam iptal edildi
Claude Opus 5.5 4$ 20$ Önbellek okuma 0,20$; hızlı mod 8$/40$
Claude Haiku 4.5 1$ 5$ 200 bin bağlam
GPT-6 Sol 2$ 10$ Önbelleğe alınmış girişte %90 indirim; 872 bin bağlam
GPT-6 Luna 0,10$ 0,50$ 1M bağlam

Sonnet 5.5, giriş, çıkış ve önbellek yazma maliyetlerinde Opus 5.5'in yarısı kadardır. GPT-6 Sol ile tam olarak 2$/10$ liste fiyatını paylaşır, bu nedenle ikisi arasında seçim yapmak görev başına sonuçlara bağlıdır. Arka plan için Claude Sonnet 5 fiyatlandırmasına, Eylül 2026 fiyat savaşına ve GPT-6 Sol fiyatlandırmasına bakın.

Çalışılmış örnekler: gerçek istekler ne kadara mal olur

Her satır için formül: tokenlar ÷ 1.000.000 × MTok başına fiyat. Her kalemi fiyatlandırın, ardından toplayın.

Örnek 1: tek bir sohbet tarzı istek

3.000 giriş tokenı, 800 çıkış tokenı, önbellekleme yok.

Bunlardan bin tanesi 14$ tutarındadır. Çıkış, tokenların %21'ini oluştururken faturanın %57'sini oluşturur, bu nedenle çıkış uzunluğu, istem uzunluğundan daha önemlidir.

Örnek 2: bir aracı 50.000 tokenlık bir öneki yeniden okuyor

Bir aracı döngüsü, 20 çağrıda aynı 50.000 tokenlık öneki (sistem istemi, araçlar, repo bağlamı) gönderir. Burada yalnızca önek fiyatlandırılır.

Önbelleksiz: 20 × 50.000 = 1.000.000 token; 1.000.000 ÷ 1.000.000 × 2$ = 2,00$

5 dakikalık yazma ile önbelleğe alınmış:

Bu, 1,685$ yani yaklaşık %84 tasarruf sağlar. 5 dakikalık yazma, yalnızca çağrılar pencere içine düştüğünde kendini amorti eder; daha yavaş döngüler için, 1 saatlik bir yazma 50.000 ÷ 1.000.000 × 4$ = 0,20$ tutarındadır, bu nedenle toplam 0,20$ + 0,19$ = 0,39$'dır, bu da önbelleksizden hala yaklaşık %80 daha düşüktür. Aynı mantık Opus için istem önbellekleme maliyet matematiğimizde de işlenmiştir; 0,20$'lık okuma oranı aynıdır.

Örnek 3: 10.000 isteklik bir toplu iş

Örnek 1 ile aynı biçimde, Batch API üzerinden gönderildi.

Toplu iş ayrıca, output-300k-2026-03-24 beta sürümü ile çıkış sınırını 128K'dan 300K tokena yükseltir.

Token başına değil, görev başına maliyet

Tarife kartı size bir tokenın ne kadara mal olduğunu söyler, ancak görevinizin kaç token tükettiğini söylemez. Bu ikinci sayı, modeller arasındaki herhangi bir oran farkından çok daha fazla çabayla değişir.

Anthropic, testlerinde Sonnet 5.5'in "öncülüne göre görev başına %30'a kadar daha az maliyetli" olduğunu belirtiyor. Lansman gönderisi ayrıca her çaba düzeyindeki maliyeti de gösterir. Terminal-Bench 4.0 çalıştırmaları Anthropic'e ait, FrontierCode Cognition tarafından çalıştırıldı ve indeks maliyetleri Artificial Analysis'ten alınmıştır:

Çaba Terminal-Bench 4.0 (puan, deneme başına $) FrontierCode v1.1 (puan, görev başına $) AA indeksi (puan, çalıştırma maliyeti)
düşük %20,0, 0,76$ %29,3, 0,19$ 35,8, 544$
orta %28,8, 0,83$ %36,5, 0,24$ 40,7, 701$
yüksek %43,0, 1,94$ %49,4, 0,42$ 46,7, 1.176$
xhigh %61,5, 5,30$ %52,1, 1,59$ 51,9, 2.738$
maks %70,6, 12,54$ %46,2, 20,78$ 56,0, 8.977$

Öne çıkanlar:

Maksimumda laf kalabalığı diğer bir tuzaktır. OfficeChai'nin Artificial Analysis verileri hakkındaki yazısı, Sonnet 5.5'i maksimumda indeks görevi başına yaklaşık 193.000 çıkış tokenında ve görev başına maliyeti Sonnet 5'ten yaklaşık %50 daha yüksek olarak belirtiyor. Simon Willison, Hacker News'te maksimum çaba gerektiren bir çalıştırmanın 128.000 düşünme tokenını tükettiğini ve cevabı üretmeden bittiğini bildirdi.

Faturayı düşüren altı kaldıraç

  1. Çabayı bilerek ayarlayın. API varsayılan olarak high; Claude Code ve Claude uygulamaları varsayılan olarak medium'dur. Anthropic'in istem kılavuzu, sohbet için medium veya low ve yalnızca ölçülen kalite kazanımları için xhigh veya max önermektedir. Sonnet 5 ayarlarını aktarmayın; ölçek yeniden kalibre edildi.
  2. Düşünme kapalıyken between_tools kullanın. thinking: {"type": "disabled"} şimdi 400 döndürüyor; {"type": "between_tools"} bunu low, medium ve high seviyelerinde değiştirir.
  3. Yeniden kullanılan her şeyi önbelleğe alın. Minimum önbelleğe alınabilir istem 512 tokendır (Sonnet 5'te 1.024). İstekler arasında üst düzey effort değiştirmek önbelleği geçersiz kılar, bu yüzden sabit tutun.
  4. Bekleyebilecekleri toplu işleyin. Giriş ve çıkışta yarı fiyat.
  5. max_tokens'ı dürüst tutun. Anthropic'in kılavuzu stop_reason: "max_tokens"'ı başarısız bir yanıt olarak ele alır, bu nedenle kısaltılmış bir cevap, gönderilecek hiçbir şey olmadan harcanmış demektir.
  6. İstenmeyen işi kesin. Sonnet 5.5, istemediğiniz testleri, belgeleri ve dosyaları ekler ve xhigh ve max seviyelerinde ek inceleme turları başlatır. Anthropic'in önerdiği sistem istemi paragrafı, kalite değişmeden maksimumda oturum maliyetini yaklaşık üçte bir oranında azalttı.

Sonnet 5.5 için başka nerelerde ödeme yaparsınız

Bunun yerine kredi mi arıyorsunuz? Ücretsiz bir Claude Sonnet 5.5 API'si var mı bölümüne bakın.

Apidog'da istek başına maliyeti izleyin

Her Mesajlar yanıtı, input_tokens, output_tokens ve önbellek sayılarını içeren bir usage nesnesi taşır. Bu, Apidog'daki herhangi bir çağrıyı fiyatlandırmak için yeterlidir:

  1. Anahtarınızı bir ANTHROPIC_API_KEY ortam değişkeni olarak saklayın.
  2. Bu isteği her çaba düzeyi (low, medium, high) için aynı istemle bir kez kaydedin:
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "between_tools"},
    "output_config": {"effort": "medium"},
    "messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
  }'
  1. Çağrıyı fiyatlandıran ve kesme durumunda başarısız olan bir post-processor ekleyin:
const body = pm.response.json();
const u = body.usage;
const cost = (u.input_tokens * 2 + u.output_tokens * 10) / 1e6;
pm.environment.set("last_call_usd", cost.toFixed(5));
pm.test("not truncated", () => pm.expect(body.stop_reason).to.not.eql("max_tokens"));
  1. Üçünü de çalıştırın ve usage.output_tokens ile maliyeti yan yana karşılaştırın. Önbellek kullanıyorsanız, önbellek sayılarını kendi oranlarında ekleyin.

İsteğin tam incelemesi Claude Sonnet 5.5 API'sini nasıl kullanacağınız bölümündedir.

SSS

Claude Sonnet 5.5'in milyon token başına maliyeti ne kadar? Claude API'de 2$ giriş ve 10$ çıkış. Önbellek okumaları 0,20$ tutarındadır; Batch API 1$ ve 5$ ücret alır.

Sonnet 5.5, Sonnet 5'ten daha mı pahalı? Hayır. Token başına fiyat aynıdır ve Anthropic, testlerinde Sonnet 5.5'in görev başına %30'a kadar daha az maliyetli olduğunu belirtiyor.

200 bin tokenın üzerinde ek ücret var mı? Hayır. Tam 1M penceresi standart fiyattan faturalandırılır.

Sonnet 5.5'te hızlı mod var mı? Hayır. Hızlı mod yalnızca Opus 5.5, Opus 5 ve Opus 4.8'de mevcuttur.

Claude Sonnet 5.5 ücretsiz mi? Claude sohbet uygulamasında evet: herkes Ücretsiz planda onunla sohbet edebilir. API ön ödemeli kredilerle çalışır; ücretsiz API kılavuzu kredi programlarını kapsar.

Sonraki adım: kendi iş yükünüzü fiyatlandırın

En yaygın üç istek biçiminizi alın, her birini iki çaba düzeyinde çalıştırın ve usage sayılarını yukarıdaki tabloyla çarpın. medium'un kalite çubuğunuzu tutup tutmadığını veya high'ın ekstra tokenlarını hak edip etmediğini hızlıca göreceksiniz. Bu istekleri ve maliyet betiğini yan yana tutmak için Apidog'u indirin.

API Tasarım-Öncelikli Yaklaşımı Apidog'da Uygulayın

API'leri oluşturmanın ve kullanmanın daha kolay yolunu keşfedin