Claude Sonnet 5.5 vs Sonnet 5: Neler Değişti, Geçiş Öncesi Kırıcı Değişiklikler

Sonnet 5.5 ile Sonnet 5: aynı 2$/10$ fiyat, çok daha yüksek puanlar ve 400'ler döndüren beş uyumsuz değişiklik. Tam hatalar ve öncesi/sonrası JSON düzeltmeleri.

Medy Evrard

29 September 2026

Claude Sonnet 5.5 vs Sonnet 5: Neler Değişti, Geçiş Öncesi Kırıcı Değişiklikler

Kurumsal İçin Apidog

Şirket İçi (On-Premises) Dağıtım

SSO ve RBAC

SOC 2 Uyumlu

Apidog Enterprise'ı Keşfedin

Claude Sonnet 5.5 (`claude-sonnet-5-5`, 28 Eylül 2026'da yayınlandı) Sonnet 5 ile aynı fiyata sahip: milyon girdi jetonu başına 2 dolar ve milyon çıktı jetonu başına 10 dolar, ve aynı jetonlaştırıcıyı kullanıyor. Çok daha güçlü ve Anthropic %30'dan daha hızlı olduğunu belirtiyor. Lansman tablosunda, Terminal-Bench 4.0 %10.3'ten %70.6'ya, CursorBench 4.0 %34.1'den %55.5'e ve OSWorld 2.1 %57.0'dan %80.1'e yükseliyor. Buradaki püf nokta ise API. Sonnet 5'te çalışan beş istek şekli şimdi 400 hatası döndürüyor ve bir değişiklik hatasız olarak yanıt şeklini değiştiriyor. Karar: yükseltin, ancak önce bu altı şeyi düzeltin.

Aşağıda: her bozucu değişiklik, kesin hatası ve öncesi/sonrası JSON ile birlikte, ardından bir kontrol listesi. Özellikler için Claude Sonnet 5.5 nedir bölümüne bakın; önceki sıçrama için Claude Sonnet 5 ve Sonnet 4.6 bölümüne bakın. Test yaparken Apidog eski ve yeni istekleri yan yana tutar.

Sonnet 5 ve Sonnet 5.5'e bir bakış

Claude Sonnet 5 Claude Sonnet 5.5
MTok Başına Fiyat (giriş / çıkış / önbellek okuma) $2 / $10 / $0.20 $2 / $10 / $0.20
Bağlam ve çıktı 1M bağlam 1M bağlam, 128K çıktı
Kabul Edilen `thinking.type` `adaptive`, `disabled` `adaptive`, `between_tools`
Varsayılan `display` `omitted` `omitted`
Çaba `low`'dan `max`'a Aynı seviyeler, yeniden kalibre edildi; API varsayılanı `high`
Minimum önbelleğe alınabilir istem 1.024 jeton 512 jeton
Mesaj başına çaba, konuşma ortası sistem mesajları Hayır Evet
Zorlamalı `tool_choice` Destekleniyor 400 hatası
Opus tarzı siber korumalar Hayır Evet; yüksek riskli siber durumlar Sonnet 5'e geri döner
Düşünme blokları Konuşma kontrolü yok Modele, konuşmaya ve hesaba bağlı
Terminal-Bench 4.0 10.3% 70.6%
CursorBench 4.0 34.1% 55.5%
FrontierCode 1.1 (Ana) 42.4% 46.2% (maks), 52.1% (çok yüksek)
GDPval-AA v2.1 (Elo) 1449 1844
OSWorld 2.1 (kısmi) 57.0% 80.1%
HLE (araçlarla) 54.9% 64.5%
Kullanımdan Kaldırma Hala siber yedek olarak hizmet veriyor 28 Eylül 2027'den önce değil

Anthropic Terminal-Bench, HLE ve OSWorld'ü çalıştırdı; Cursor CursorBench, Cognition FrontierCode ve Artificial Analysis GDPval-AA'yı çalıştırdı. Artificial Analysis'in kendi Terminal-Bench testi %14.1'e karşılık %63.6 veriyor, yani fark devam ediyor. FrontierCode'un iki adet 5.5 numarası var çünkü maksimumda daha sık inceleme alt temsilcileri dağıttı ve kıyaslama, kapsam dışı düzenlemeleri cezalandırıyor. Bkz. Claude Sonnet 5.5 kıyaslamaları.

Beş bozucu değişiklik

Her biri, Sonnet 5'te sorunsuz çalışan kod için 400 `invalid_request_error` döndürür.

1. `thinking: disabled` kaldırıldı; `between_tools` gönderin

Sonnet 5.5, `thinking: {"type": "disabled"}`'ı reddeder:

"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

En düşük ayar olan `between_tools`'ü gönderin. Bu ayar, önceden düşünmeyi atlar; araç çağrıları arasındaki ilerleme notları yine de `thinking` blokları olarak gelir ve bunları olduğu gibi geri iletirsiniz. Yalnızca `low`, `medium` veya `high` çaba seviyelerinde çalışır, başka bir alan kabul etmez (`display`, `budget_tokens` veya `block_binding` 400 döndürür) ve konuşma için çabayı kilitler.

// Before (claude-sonnet-5)
{"model": "claude-sonnet-5", "max_tokens": 16000,
 "thinking": {"type": "disabled"},
 "output_config": {"effort": "xhigh"}}

// After (claude-sonnet-5-5)
{"model": "claude-sonnet-5-5", "max_tokens": 16000,
 "thinking": {"type": "between_tools"},
 "output_config": {"effort": "high"}}

xhigh veya max değerlerine ihtiyacınız varsa, adaptif düşünmenin çalışması için `thinking`'i atlayın.

2. Zorlamalı `tool_choice` 400 hatası döndürür

any veya tool tipi `tool_choice` başarısız olur, jeton sayım uç noktası dahil:

tool_choice: type "tool" and "any" are not supported for this model.

`auto` gönderin, aracı `strict: true` olarak işaretleyin (her nesne `additionalProperties: false` gerektirir) ve istemde ne zaman kullanılacağını belirtin. Model artık bunun yerine metinle yanıt verebilir, bu nedenle araç çağrısı olmayan dönüşleri ele alın.

// Before (claude-sonnet-5)
"tool_choice": {"type": "tool", "name": "get_weather"}

// After (claude-sonnet-5-5)
"tools": [{"name": "get_weather",
  "input_schema": {"type": "object",
    "properties": {"location": {"type": "string"}},
    "required": ["location"], "additionalProperties": false},
  "strict": true}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user",
  "content": "What's the weather in Paris? Use the get_weather tool."}]

İstek başına en fazla 20 katı araç kullanılabilir. Amazon Bedrock'ta, Sonnet 5.5 için katı araçlar mevcut değildir: `strict` olmadan `auto` gönderin ve girişi kodunuzda doğrulayın.

3. Düşünme blokları modele, konuşmaya ve hesaba bağlıdır

Her Sonnet 5.5 düşünme bloğu, kendinden önceki her şeyle imzalanır: `system`, `tools` ve önceki mesajlar. 31 Ağustos 2026 (00:00 UTC) tarihinde veya sonrasında oluşturulan hesaplar için, bir düzenlemeden sonra bir bloğu yeniden oynatmak Claude API, Bedrock ve Google Cloud'da 400 hatası döndürür:

messages.1.content.0: Invalid `signature` in `thinking` block. The block is bound to a different conversation. Remove the block, or set `thinking.block_binding.prefix_mismatch_behavior` to "drop_block".

Eski hesaplar bunu varsayılan olarak uygulamaz, bu nedenle eski bir anahtarda temiz bir çalışma hiçbir şeyi kanıtlamaz. Konuşmaları yalnızca eklemeli tutun ve konuşma ortası sistem mesajlarıyla talimatları veya araçları değiştirin. Düzenleme yapmanız gerekiyorsa, `anthropic-beta: thinking-binding-controls-2026-08-01` gönderin ve uyuşmayan blokları bırakın:

"thinking": {"type": "adaptive",
  "block_binding": {"prefix_mismatch_behavior": "drop_block"}}

Bu sadece adaptif düşünme ile çalışır; `between_tools` ile, düzenlenmiş dönüşten itibaren düşünme bloklarını kaldırın. Sonnet 5.5, Sonnet 5, Opus 4.8, Haiku 4.5 ve önceki sürümlerden blokları okur; Opus 5, Opus 5.5, Fable ve Mythos bloklarını ve başka bir hesaptan gelen Sonnet 5.5 bloklarını isteği başarısız etmeden bırakır. Başka hiçbir model bloklarını okumaz. Bkz. Claude Fable 5.1 korunmuş düşünme.

4. `computer_20251124` Claude API ve Google Cloud'da başarısız olur

Orada, bilgisayar kullanımı yeni araç setini gerektirir. Hata şöyle başlar:

'claude-sonnet-5-5' does not support tool types: computer_20251124.
// Before (claude-sonnet-5)
"tools": [{"type": "computer_20251124", ...}]

// After (claude-sonnet-5-5, Claude API and Google Cloud)
"tools": [{"type": "computer_toolset_20260801"}]

Eski bilgisayar kullanım beta başlığını bırakın ve üye `tool_use` blokları, toplu eylemler ve sonuçlardaki `toolset_name` için döngünüzü güncelleyin. Bedrock hala `computer_20251124`'ü kabul eder; `computer_20250124` her yerde başarısız olur.

5. Bazı danışman eşleşmeleri reddedilir

Danışman aracı (beta) ile, bir Sonnet 5.5 yürütücüsü danışman olarak yalnızca Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 veya Mythos 5.1'i kabul eder. Sonnet 5, Opus 4.8 ve Opus 4.7 danışmanları artık 400 hatası döndürüyor. Danışmanlık ayrıca şifreli bir `advisor_redacted_result` bloğu olarak gelir, bu nedenle danışmanlık metnini ayrıştıran kod hiçbir şey elde edemez.

Sessiz değişiklik: araç çağrıları arasındaki metin düşünme bloklarına taşınıyor

Bu hiçbir şeyi başarısız etmez. Sonnet 5'te, araç çağrıları arasındaki notlar `text` olarak geri dönüyordu. Sonnet 5.5'te ise, bir veya iki cümleden uzun her şey, varsayılan `display: "omitted"` altında boş bir ilerleme güncellemesi `thinking` bloğu olarak gelir. Bu notları yayınlayan bir aracı kullanıcı arayüzü, hatasız bir şekilde sessizleşir. Üç düzeltme:

// Header: anthropic-beta: thinking-display-updates-2026-08-18
"thinking": {"type": "adaptive", "display": "updates"}

Kod değişikliği olmayan davranış değişiklikleri

Bunlar istekleri başarısız etmez, ancak çıktıyı ve maliyeti değiştirir. İstem kılavuzu düzeltmeler içerir.

Görev başına maliyet: aynı fiyat, sonuç başına daha az dolar

Anthropic'in lansman gönderisi, testlerinde Sonnet 5.5'in "öncülünden görev başına %30'a kadar daha az maliyetli" olduğunu belirtiyor. Fiyatlar aynı olduğundan, tasarruf daha az jeton ve adımdan kaynaklanıyor. Çaba başına grafikleri, 5.5'teki daha düşük çabanın Sonnet 5'in en iyi performansını geride bıraktığını gösteriyor:

Kıyaslama (Anthropic'in grafikleri) Sonnet 5.5 Sonnet 5, en iyi çalışma
Terminal-Bench 4.0 %28.8 orta seviyede, $0.83 %10.3 maksimumda, $11.62
FrontierCode 1.1 %49.4 yüksek seviyede, $0.42 %42.7 çok yüksek seviyede, $10.07
CursorBench 4.0 %35.8 düşük seviyede, $0.50 %34.1 maksimumda, $7.17

CursorBench maliyetleri, Anthropic'in liste fiyatları üzerinden tahminleridir. Diğer yandan `max` seviyesi var: OfficeChai'nin Artificial Analysis verileri hakkındaki yazısına göre, Sonnet 5.5 maksimumda endeks başına yaklaşık 193.000 çıktı jetonu kullanır ve görev başına maliyet Sonnet 5'in yaklaşık %50 üzerindedir. Tasarruflar `high` ve altı seviyelerde gerçekleşir; bkz. Claude Sonnet 5.5 fiyatlandırması.

Geçiş kontrol listesi

claude-sonnet-5'i claude-sonnet-5-5 ile değiştirin, ardından Anthropic'in geçiş kılavuzundaki altı kontrolü çalıştırın:

  1. `disabled`'ı `between_tools` ile değiştirin, `high` çaba seviyesinde veya altında.
  2. Zorlamalı `tool_choice`'u `auto`, `strict: true` ve bir istem satırı ile değiştirin (Bedrock'ta, kod içinde doğrulayın).
  3. Geçmişi yalnızca eklemeli tutun; değişiklikler için konuşma ortası sistem mesajlarını kullanın.
  4. Bilgisayar kullanımını Claude API ve Google Cloud'da `computer_toolset_20260801`'e taşıyın.
  5. Desteklenen bir danışman seçin ve danışmanlık metnini ayrıştırmayı bırakın.
  6. Kullanıcı arayüzünüz araç çağrıları arasında metin gösteriyorsa `thinking.display`'i ayarlayın.

Ardından çaba taramanızı yeniden çalıştırın. Claude Code geçişi otomatikleştirebilir:

/claude-api migrate this project to claude-sonnet-5-5

Opus eşdeğeri Claude Opus 5.5 ve Opus 5 geçişidir.

Geçişi Apidog'da bir regresyon testine dönüştürün

Apidog'da, `https://api.anthropic.com/v1/messages` adresine üç isteği tek bir projede, hepsi aynı ortamda kaydedin:

  1. Temel: Mevcut Sonnet 5 gövdeniz.
  2. Eski gövde, yeni model: sadece `model`, `claude-sonnet-5-5` olarak değiştirildi. Durumun 400 olduğunu ve `between_tools` veya `tool_choice`'dan bahseden bir hata mesajı olduğunu doğrulayın.
  3. Geçirilmiş: Düzeltilmiş gövde. Durumun 200 olduğunu, `refusal` veya `max_tokens` olmayan bir `stop_reason` olduğunu ve araç istekleri için bir `tool_use` bloğu olduğunu doğrulayın.

`ANTHROPIC_API_KEY`'i ortamda tutun ve `x-api-key` başlığında `{{ANTHROPIC_API_KEY}}` olarak referans alın. Kendi görev başına maliyet numaranız için çaba seviyeleri arasında `usage.output_tokens`'u karşılaştırın. Bir test senaryosu olarak kaydedildiğinde, `disabled`'a bir regresyon üretim yerine çalıştırmayı başarısız eder. İstek temelleri: Claude Sonnet 5.5 API nasıl kullanılır.

Sıkça Sorulan Sorular

Bir Sonraki Adımınız

Sonnet 5 isteğinizi ve onun 5.5 ikizini yan yana kaydedin, 400 hatasını onaylayın, düzeltin ve düzeltme geçtikten sonra trafiği taşıyın. Bu testi oluşturmak için Apidog'u indirin.

API Tasarım-Öncelikli Yaklaşımı Apidog'da Uygulayın

API'leri oluşturmanın ve kullanmanın daha kolay yolunu keşfedin