Claude Sonnet 5.5, Claude API'de Sonnet 5 ile aynı şekilde, milyon giriş tokenı başına 2$ ve milyon çıkış tokenı başına 10$ maliyetindedir. Önbellek okumaları milyon başına 0,20$ tutarındadır, Batch API her iki oranı da 1$ ve 5$'a düşürür, tam 1M bağlam penceresi standart tarifeden faturalandırılır ve hızlı mod sunulmamaktadır. Sonnet 5'in 1 Eylül'de 3$/15$ olarak planlanan zam iptal edildi, bu nedenle 2$/10$ şimdi standart fiyattır.
Bu kılavuz, Claude Sonnet 5.5 fiyatlandırmasının her kalemini listeler, gösterilen aritmetikle üç maliyet örneğini inceler ve harcanan çabanın faturanızı token başına orandan daha fazla neden etkilediğini açıklar. Modele yeni mi başladınız? Claude Sonnet 5.5 nedir ile başlayın veya Claude Sonnet 5.5'i ücretsiz nasıl kullanacağınızı okuyun. Kendi trafiğinize göre sayıları kontrol etmek için isteği Apidog'dan gönderin ve her yanıttaki usage bloğunu okuyun.
Claude Sonnet 5.5 API fiyatlandırma tablosu
Milyon token (MTok) başına fiyatlar, Anthropic'in fiyatlandırma belgelerinden:
| Kalem | MTok başına fiyat |
|---|---|
| Giriş | 2,00$ |
| 5 dakikalık önbellek yazma | 2,50$ |
| 1 saatlik önbellek yazma | 4,00$ |
| Önbellek okuma | 0,20$ |
| Çıkış | 10,00$ |
| Toplu giriş | 1,00$ |
| Toplu çıkış | 5,00$ |
Ödediğiniz miktarı değiştiren üç detay:
- Yalnızca ABD çıkarımı.
inference_geo: "us", Claude API ve AWS üzerindeki Claude Platformu'ndaki her token kategorisinde 1.1 kat daha fazla maliyetlidir (2,20$ giriş, 11$ çıkış, 0,22$ önbellek okuma). Foundry'nin ABD Veri Bölgesi dağıtımı da aynı 1.1 katı taşır; Bedrock ve Google Cloud ayrı ayrı fiyatlandırır. - Uzun bağlam primi yok. 900 bin tokenlık bir istek, token başına 9 bin tokenlık bir istekle aynı maliyettedir.
- Sonnet 5 ile aynı tokenleştirici. Token sayılarınız değişmeden aktarılır.
Sonnet 5.5'in liste fiyatı karşılaştırması
| Model | Giriş | Çıkış | Notlar |
|---|---|---|---|
| Claude Sonnet 5.5 | 2$ | 10$ | Önbellek okuma 0,20$; 1M bağlam; hızlı mod yok |
| Claude Sonnet 5 | 2$ | 10$ | Önbellek okuma 0,20$; 3$/15$ zam iptal edildi |
| Claude Opus 5.5 | 4$ | 20$ | Önbellek okuma 0,20$; hızlı mod 8$/40$ |
| Claude Haiku 4.5 | 1$ | 5$ | 200 bin bağlam |
| GPT-6 Sol | 2$ | 10$ | Önbelleğe alınmış girişte %90 indirim; 872 bin bağlam |
| GPT-6 Luna | 0,10$ | 0,50$ | 1M bağlam |
Sonnet 5.5, giriş, çıkış ve önbellek yazma maliyetlerinde Opus 5.5'in yarısı kadardır. GPT-6 Sol ile tam olarak 2$/10$ liste fiyatını paylaşır, bu nedenle ikisi arasında seçim yapmak görev başına sonuçlara bağlıdır. Arka plan için Claude Sonnet 5 fiyatlandırmasına, Eylül 2026 fiyat savaşına ve GPT-6 Sol fiyatlandırmasına bakın.
Çalışılmış örnekler: gerçek istekler ne kadara mal olur
Her satır için formül: tokenlar ÷ 1.000.000 × MTok başına fiyat. Her kalemi fiyatlandırın, ardından toplayın.
Örnek 1: tek bir sohbet tarzı istek
3.000 giriş tokenı, 800 çıkış tokenı, önbellekleme yok.
- Giriş: 3.000 ÷ 1.000.000 × 2$ = 0,006$
- Çıkış: 800 ÷ 1.000.000 × 10$ = 0,008$
- Toplam: 0,006$ + 0,008$ = 0,014$
Bunlardan bin tanesi 14$ tutarındadır. Çıkış, tokenların %21'ini oluştururken faturanın %57'sini oluşturur, bu nedenle çıkış uzunluğu, istem uzunluğundan daha önemlidir.
Örnek 2: bir aracı 50.000 tokenlık bir öneki yeniden okuyor
Bir aracı döngüsü, 20 çağrıda aynı 50.000 tokenlık öneki (sistem istemi, araçlar, repo bağlamı) gönderir. Burada yalnızca önek fiyatlandırılır.
Önbelleksiz: 20 × 50.000 = 1.000.000 token; 1.000.000 ÷ 1.000.000 × 2$ = 2,00$
5 dakikalık yazma ile önbelleğe alınmış:
- Çağrı 1 önbelleği yazar: 50.000 ÷ 1.000.000 × 2,50$ = 0,125$
- Çağrılar 2'den 20'ye kadar okur: 19 × 50.000 = 950.000 token; 950.000 ÷ 1.000.000 × 0,20$ = 0,19$
- Toplam: 0,125$ + 0,19$ = 0,315$
Bu, 1,685$ yani yaklaşık %84 tasarruf sağlar. 5 dakikalık yazma, yalnızca çağrılar pencere içine düştüğünde kendini amorti eder; daha yavaş döngüler için, 1 saatlik bir yazma 50.000 ÷ 1.000.000 × 4$ = 0,20$ tutarındadır, bu nedenle toplam 0,20$ + 0,19$ = 0,39$'dır, bu da önbelleksizden hala yaklaşık %80 daha düşüktür. Aynı mantık Opus için istem önbellekleme maliyet matematiğimizde de işlenmiştir; 0,20$'lık okuma oranı aynıdır.
Örnek 3: 10.000 isteklik bir toplu iş
Örnek 1 ile aynı biçimde, Batch API üzerinden gönderildi.
- Giriş: 10.000 × 3.000 = 30.000.000 token; 30 × 1$ = 30$
- Çıkış: 10.000 × 800 = 8.000.000 token; 8 × 5$ = 40$
- Toplu toplam: 70$, standart oranlarla 30 × 2$ + 8 × 10$ = 140$'a karşı
Toplu iş ayrıca, output-300k-2026-03-24 beta sürümü ile çıkış sınırını 128K'dan 300K tokena yükseltir.
Token başına değil, görev başına maliyet
Tarife kartı size bir tokenın ne kadara mal olduğunu söyler, ancak görevinizin kaç token tükettiğini söylemez. Bu ikinci sayı, modeller arasındaki herhangi bir oran farkından çok daha fazla çabayla değişir.
Anthropic, testlerinde Sonnet 5.5'in "öncülüne göre görev başına %30'a kadar daha az maliyetli" olduğunu belirtiyor. Lansman gönderisi ayrıca her çaba düzeyindeki maliyeti de gösterir. Terminal-Bench 4.0 çalıştırmaları Anthropic'e ait, FrontierCode Cognition tarafından çalıştırıldı ve indeks maliyetleri Artificial Analysis'ten alınmıştır:
| Çaba | Terminal-Bench 4.0 (puan, deneme başına $) | FrontierCode v1.1 (puan, görev başına $) | AA indeksi (puan, çalıştırma maliyeti) |
|---|---|---|---|
| düşük | %20,0, 0,76$ | %29,3, 0,19$ | 35,8, 544$ |
| orta | %28,8, 0,83$ | %36,5, 0,24$ | 40,7, 701$ |
| yüksek | %43,0, 1,94$ | %49,4, 0,42$ | 46,7, 1.176$ |
| xhigh | %61,5, 5,30$ | %52,1, 1,59$ | 51,9, 2.738$ |
| maks | %70,6, 12,54$ | %46,2, 20,78$ | 56,0, 8.977$ |
Öne çıkanlar:
- Maksimum, Terminal-Bench'te yaklaşık 6.5 kat yüksek maliyetlidir (12,54$ ÷ 1,94$ = 6.46). Artificial Analysis'in indeksi, maksimumda çalıştırmak için düşüğe göre yaklaşık 16.5 kat daha fazla maliyetlidir (8.977$ ÷ 544$).
- Daha fazla çaba her zaman daha iyi değildir. FrontierCode, xhigh'da %52.1'den maksimumda %46.2'ye düşerken, görev başına maliyet 13 kat artar (20,78$ ÷ 1,59$). Anthropic'in dipnotu, maksimumda modelin daha sık alt ajanları yayan bir inceleme becerisi çalıştırdığını ve bunun Cognition tarafından incelenen durumlarda zaman aşımı veya kapsam dışı düzenlemelere neden olduğunu belirtiyor.
- Daha düşük çabada Opus rekabet ediyor. Orta çabada Opus 5.5, Terminal-Bench'te 2,94$ karşılığında %57.6 puan alırken, Sonnet 5.5 yüksek çabada 1,94$ karşılığında %43.0 puan aldı. Sonnet 5.5 ve Opus 5.5 karşılaştırmamız bu dengeyi inceler.
Maksimumda laf kalabalığı diğer bir tuzaktır. OfficeChai'nin Artificial Analysis verileri hakkındaki yazısı, Sonnet 5.5'i maksimumda indeks görevi başına yaklaşık 193.000 çıkış tokenında ve görev başına maliyeti Sonnet 5'ten yaklaşık %50 daha yüksek olarak belirtiyor. Simon Willison, Hacker News'te maksimum çaba gerektiren bir çalıştırmanın 128.000 düşünme tokenını tükettiğini ve cevabı üretmeden bittiğini bildirdi.
Faturayı düşüren altı kaldıraç
- Çabayı bilerek ayarlayın. API varsayılan olarak
high; Claude Code ve Claude uygulamaları varsayılan olarakmedium'dur. Anthropic'in istem kılavuzu, sohbet içinmediumveyalowve yalnızca ölçülen kalite kazanımları içinxhighveyamaxönermektedir. Sonnet 5 ayarlarını aktarmayın; ölçek yeniden kalibre edildi. - Düşünme kapalıyken
between_toolskullanın.thinking: {"type": "disabled"}şimdi 400 döndürüyor;{"type": "between_tools"}bunulow,mediumvehighseviyelerinde değiştirir. - Yeniden kullanılan her şeyi önbelleğe alın. Minimum önbelleğe alınabilir istem 512 tokendır (Sonnet 5'te 1.024). İstekler arasında üst düzey
effortdeğiştirmek önbelleği geçersiz kılar, bu yüzden sabit tutun. - Bekleyebilecekleri toplu işleyin. Giriş ve çıkışta yarı fiyat.
max_tokens'ı dürüst tutun. Anthropic'in kılavuzustop_reason: "max_tokens"'ı başarısız bir yanıt olarak ele alır, bu nedenle kısaltılmış bir cevap, gönderilecek hiçbir şey olmadan harcanmış demektir.- İstenmeyen işi kesin. Sonnet 5.5, istemediğiniz testleri, belgeleri ve dosyaları ekler ve
xhighvemaxseviyelerinde ek inceleme turları başlatır. Anthropic'in önerdiği sistem istemi paragrafı, kalite değişmeden maksimumda oturum maliyetini yaklaşık üçte bir oranında azalttı.
Sonnet 5.5 için başka nerelerde ödeme yaparsınız
- Claude planları (claude.com/pricing): Ücretsiz plan 0$ olup, sohbet içinde Sonnet'i içerir, Claude Kodu yoktur. Pro, yıllık faturalandırıldığında ayda 17$ veya aylık 20$'dır. Max ayda 100$'dan başlar. Takım koltukları 20$/25$ (standart) veya 100$/125$ (premium), yıllık/aylıktır. Bunların hiçbiri API erişimi içermez.
- GitHub Copilot: Pro (aylık 10$), Pro+, Max, Business ve Enterprise, sağlayıcı liste fiyatından faturalandırılır. Copilot Pro, ayda her biri 0,01$ değerinde 1.500 yapay zeka kredisi, yaklaşık 15$ değerinde token veya kabaca 1.070 Örnek 1 isteği (15$ ÷ 0,014$) içerir. Copilot Ücretsiz ve Öğrenci planları bunu seçemez.
- Cursor: Diğer Modeller havuzundan (Pro, Pro Plus ve Ultra) aynı oranlar, ayrıca yalnızca ABD uç noktaları için %10 ek ücret (2,20$/11$).
- OpenRouter: 2$/10$ veya
:batchvaryantında 1$/5$.:freevaryantı yoktur. - Vercel AI Gateway: 2$/10$, 0,20$ önbellek okuma ile. 5$ ücretsiz kredi Sonnet 5.5'i kapsamaz.
- Bedrock, Google Cloud, Foundry: her bulutun kendi fiyat sayfası. Bedrock yalnızca Standart katmanı destekler, Batch yoktur.
Bunun yerine kredi mi arıyorsunuz? Ücretsiz bir Claude Sonnet 5.5 API'si var mı bölümüne bakın.
Apidog'da istek başına maliyeti izleyin
Her Mesajlar yanıtı, input_tokens, output_tokens ve önbellek sayılarını içeren bir usage nesnesi taşır. Bu, Apidog'daki herhangi bir çağrıyı fiyatlandırmak için yeterlidir:

- Anahtarınızı bir
ANTHROPIC_API_KEYortam değişkeni olarak saklayın. - Bu isteği her çaba düzeyi (
low,medium,high) için aynı istemle bir kez kaydedin:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 4000,
"thinking": {"type": "between_tools"},
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
}'
- Çağrıyı fiyatlandıran ve kesme durumunda başarısız olan bir post-processor ekleyin:
const body = pm.response.json();
const u = body.usage;
const cost = (u.input_tokens * 2 + u.output_tokens * 10) / 1e6;
pm.environment.set("last_call_usd", cost.toFixed(5));
pm.test("not truncated", () => pm.expect(body.stop_reason).to.not.eql("max_tokens"));
- Üçünü de çalıştırın ve
usage.output_tokensile maliyeti yan yana karşılaştırın. Önbellek kullanıyorsanız, önbellek sayılarını kendi oranlarında ekleyin.
İsteğin tam incelemesi Claude Sonnet 5.5 API'sini nasıl kullanacağınız bölümündedir.
SSS
Claude Sonnet 5.5'in milyon token başına maliyeti ne kadar? Claude API'de 2$ giriş ve 10$ çıkış. Önbellek okumaları 0,20$ tutarındadır; Batch API 1$ ve 5$ ücret alır.
Sonnet 5.5, Sonnet 5'ten daha mı pahalı? Hayır. Token başına fiyat aynıdır ve Anthropic, testlerinde Sonnet 5.5'in görev başına %30'a kadar daha az maliyetli olduğunu belirtiyor.
200 bin tokenın üzerinde ek ücret var mı? Hayır. Tam 1M penceresi standart fiyattan faturalandırılır.
Sonnet 5.5'te hızlı mod var mı? Hayır. Hızlı mod yalnızca Opus 5.5, Opus 5 ve Opus 4.8'de mevcuttur.
Claude Sonnet 5.5 ücretsiz mi? Claude sohbet uygulamasında evet: herkes Ücretsiz planda onunla sohbet edebilir. API ön ödemeli kredilerle çalışır; ücretsiz API kılavuzu kredi programlarını kapsar.
Sonraki adım: kendi iş yükünüzü fiyatlandırın
En yaygın üç istek biçiminizi alın, her birini iki çaba düzeyinde çalıştırın ve usage sayılarını yukarıdaki tabloyla çarpın. medium'un kalite çubuğunuzu tutup tutmadığını veya high'ın ekstra tokenlarını hak edip etmediğini hızlıca göreceksiniz. Bu istekleri ve maliyet betiğini yan yana tutmak için Apidog'u indirin.
