Anthropic, Claude Sonnet 5'i 30 Haziran 2026'da yayınladı ve bu, Sonnet 4.6'nın doğrudan bir yerine geçmesidir. Model kimliğini değiştirirsiniz ve çoğu durumda kodunuz çalışmaya devam eder. Ancak bu cümlede "çoğu durumda" ifadesi biraz iş görüyor. Sonnet 5, varsayılan olarak açık olan yeni bir tokenlaştırıcı, adaptif düşünme ve artık çalışmak yerine hata döndüren birkaç istek parametresiyle birlikte gelir. Bu makale, tam olarak nelerin değiştiğini, maliyetini ve yükseltmenin iş yükünüz için yapmaya değip değmeyeceğini anlatıyor.
Kısa versiyonu: token başına aynı fiyat, kodlama ve ajansı görevlerde daha iyi puanlar, üç küçük kod değişikliği ve token sayılarınızı ve bütçelerinizi etkileyen, pek de bariz olmayan bir tokenlaştırıcı yakalama noktası. Üretimde anahtarı çevirmeden önce detayları okuyun.

Bir bakışta yükseltme
Sonnet 5 , Sonnet 4.6 ile aynı token başına fiyatlandırmayı korur, bu nedenle token başına faturanızda hiçbir şey değişmez. Araç kullanımı ve kodlama için önemli olan kıyaslama testlerinde iyileşmeler sunar. Ve varsayılan davranışta kör bir değişimin sizi şaşırtabileceği kadar değişiklik yapar.
İşte yan yana karşılaştırma.
| Özellik | Sonnet 4.6 (claude-sonnet-4-6) |
Sonnet 5 (claude-sonnet-5) |
|---|---|---|
| Yayınlanma | Önceki Sürüm | 30 Haziran 2026 |
| Bağlam penceresi | 1M tokene kadar | 1M token (varsayılan ve maksimum) |
| Maksimum çıktı | 128K token | 128K token |
| Varsayılan düşünme | thinking alanı olmadığında kapalı |
Varsayılan olarak adaptif düşünme açık |
Genişletilmiş düşünme (budget_tokens) |
Kullanımdan kaldırıldı | 400 hatası döndürür |
Örnekleme parametreleri (temperature, top_p, top_k) |
Kabul edildi | Varsayılan olmayan değerler 400 döndürür |
| Tokenlaştırıcı | Eski tokenlaştırıcı | Yeni tokenlaştırıcı (metin başına ~%30 daha fazla token) |
| Standart fiyat | M giriş/çıkış başına 3$ / 15$ | M giriş/çıkış başına 3$ / 15$ |
| Tanıtım fiyatı | Yok | 31 Ağustos 2026'ya kadar M başına 2$ / 10$ |
Sonnet 4.6'da çalışan diğer her şey, başka hiçbir kod değişikliği olmaksızın Sonnet 5'te çalışır: yapılandırılmış çıktılar, görsel işleme, istem önbellekleme, araç kullanımı ve toplu işlem hepsi taşınır. Kaybettiğiniz tek platform özelliği, Sonnet 5'te mevcut olmayan Öncelikli Katman'dır.
Neler iyileşti: kıyaslama testleri
Sonnet 5, bugüne kadarki en ajansı Sonnet modeli olarak konumlandırılmıştır ve bildirilen rakamlar, araç yoğun işlerde bunu desteklemektedir. Bunlar Anthropic'in lansman kıyaslama testleridir ve lansman günü yazılarında doğrulanmıştır. Bunları bağımsız test sonuçları olarak değil, bildirilen sayılar olarak kabul edin.
| Kıyaslama Testi | Sonnet 4.6 | Sonnet 5 |
|---|---|---|
| SWE-bench Pro (ajansı kodlama) | %58,1 | %63,2 |
| OSWorld-Verified (bilgisayar kullanımı) | %78,5 | %81,2 |
Bu, Sonnet'in en çok kullanıldığı görevlerde gerçek bir sıçrama: döngüde araçlarla kod yazma ve düzeltme, bir bilgisayarı veya terminali yönetme. Anthropic ayrıca, araçlar devreye girdiğinde Sonnet 5'in Opus 4.8'e yakın performans gösterdiğini, ajansı görevlerde birkaç puan farkla, ancak çok daha az maliyetle çalıştığını bildiriyor. Uygulamanız ajan odaklıysa, bu beklediğiniz yükseltmedir. Premium modelle birebir karşılaştırma için Sonnet 5 vs Opus 4.8'e bakın.

Sonnet 5, Anthropic'in ölçümlerine göre 4.6'dan daha güvenlidir: istenmeyen davranış oranları daha düşük, halüsinasyon ve yağcılık daha az, ve istem enjeksiyonuna karşı daha iyi dirençlidir. Gerçek zamanlı siber güvenlik önlemlerine sahip ilk Sonnet katmanı modelidir. Bilmeniz gereken bir davranış: yasaklanmış bir isteğin reddi, hata olarak değil, `stop_reason: "refusal"` ile başarılı bir HTTP 200 olarak geri döner. Yanıt ayrıştırmanızda bu durdurma nedenini işleyin.
Üç gerçek kod değişikliği
Çoğu geçiş yalnızca bu üç şeye dokunur. Bunları gözden geçirin, gerektiğinde ayarlamalar yapın ve entegrasyonunuzun geri kalanı değişmeden kalır.
1. Adaptif düşünme artık varsayılan olarak açık
Sonnet 4.6'da, `thinking` alanı olmaması düşünme olmadığı anlamına geliyordu. Sonnet 5'te, `thinking` alanı olmayan bir istek, adaptif düşünme açık olarak çalışır. Model, göreve bağlı olarak ne kadar düşüneceğine karar verir ve derinliği efor parametresiyle (`low`, `medium`, `high` veya `xhigh`) yönlendirirsiniz.
Bu önemlidir, çünkü `max_tokens` toplam çıktı üzerinde katı bir sınırdır ve toplam çıktı artık düşünme tokenları ile yanıt metninizi içerir. 4.6'da yalnızca yanıt metni için boyutlandırılmış bir `max_tokens`, şimdi Sonnet 5'te yanıtınızı kesebilir, çünkü düşünme de aynı bütçeden yer.
Eğer bir iş yükü daha önce düşünmeden çalışıyorsa ve bu şekilde kalmasını istiyorsanız, düşünmeyi açıkça kapatın:
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
thinking={"type": "disabled"},
messages=[
{"role": "user", "content": "Return the OpenAPI 3.1 path object for GET /invoices/{id}."}
],
)
print(response.content[0].text)
Kontrollü bir derinlikle adaptif düşünmeyi kullanmak için, devre dışı bırakmak yerine eforu ayarlayın:
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=8192,
thinking={"type": "adaptive"},
effort="medium",
messages=[
{"role": "user", "content": "Draft integration tests for the POST /orders endpoint."}
],
)
Şekle dikkat edin: `thinking={"type": "adaptive"}`, bir token bütçesi değil. Bu bir sonraki değişikliğe yol açar.
2. Manuel genişletilmiş düşünme kaldırıldı
Eski `thinking: {type: "enabled", budget_tokens: N}` deseni, Sonnet 5'te 400 hatası döndürür. Bu, 4.6'da zaten kullanımdan kaldırılmıştı, bu yüzden çoğu mevcut kod bunu kullanmayı bıraktı, ancak yine de kontrol edin. Herhangi bir manuel bütçeyi adaptif düşünme ve efor parametresiyle değiştirin. Zorlu görevler için büyük bir `budget_tokens` ayarlıyorsanız, `effort="high"` veya `effort="xhigh"` yerine geçecek kaldıraçtır.
3. Örnekleme parametreleri artık 400 döndürüyor
`temperature`, `top_p` veya `top_k` parametrelerini varsayılan olmayan bir değere ayarlamak, Sonnet 5'te 400 hatası döndürür. Bunları atlamak veya varsayılan değerlerinde bırakmak sorun teşkil etmez. Bu kısıtlama zaten Opus 4.7 ve sonraki sürümlerde vardı; Sonnet sınıfı için yenidir.
Deterministik hissettiren çıktı için `temperature=0`'a güveniyorsanız, bunu kaldırın ve bunun yerine sistem isteminiz aracılığıyla davranışı yönlendirin. Talimatlarda format, ton ve kısıtlamalar hakkında örnekleme yerine açık olun. Kod tabanınızda bu parametreler için hızlı bir grep çalıştırmak, bir dizi üretim 400 hatasından kurtarır.
4.6'dan değişmeyen bir şey: yardımcı mesaj ön doldurma hala desteklenmiyor ve 400 hatası döndürüyor. Yardımcı konuşmasını önceden doldurarak bir yanıt başlangıcı zorluyorsanız, bunun yerine yapılandırılmış çıktılar veya `output_config.format` veya sistem istemi talimatları kullanın.
Kimsenin sizi uyarmadığı tokenlaştırıcı tuzağı
Sonnet 5 yeni bir tokenlaştırıcı kullanır. Aynı girdi metni, Sonnet 4.6'da ürettiğinden yaklaşık %30 daha fazla token, yani yaklaşık 1.3 kat daha fazla token üretir. Bu bir API değişikliği değildir. İstek, yanıt ve akış şekilleri aynıdır ve bunun için yeni bir kod yazmazsınız. Ancak tokenlarda ölçtüğünüz veya bütçelediğiniz her şeyi değiştirir.
İşte yeniden ölçmeniz gerekenler:
- Token sayıları ve
usagealanları. Aynı istem Sonnet 5 altında daha fazla token bildirir. 4.6 sayılarınızı yeniden kullanmayın. İzlediğiniz herhangi bir istem içinclaude-sonnet-5'e karşı token sayımını yeniden çalıştırın. - 1M bağlam pencereniz daha az metin tutar. Her token artık ortalama olarak daha az metni kapsar, bu nedenle aynı pencere içeriğinizden daha az karakter alır. Eğer bağlamı sınıra yakın paketliyorsanız, hala sığdığından emin olun.
- Beklenen çıktıya yakın boyutlandırılmış
max_tokensbütçeleri kesilebilir. 4.6'da tipik yanıtınızı rahatça tutan bir bütçe, Sonnet 5'te onu kesebilir. Adaptif düşünmenin bu bütçeyi paylaşmasıyla birleştiğinde, bu, bir yükseltmeden sonra beklenenden daha kısa yanıtların en yaygın nedenidir. - Eşdeğer metnin istek başına maliyeti daha yüksek olabilir. Token başına oran değişmez, ancak istek başına daha fazla token, aynı metin için daha fazla ödemeniz gerektiği anlamına gelir.
Bu son nokta üzerinde bir örnek çalışması hak ediyor. Diyelim ki Sonnet 4.6'da bir istem ve yanıt 10.000 tokendi. Aynı metin, Sonnet 5'te yaklaşık 13.000 tokendir. Aynı token başına oranla, fiyat çizelgesi değişmemiş görünse bile bu isteğin maliyeti yaklaşık %30 daha fazladır. Düz bir maliyet eşitliği varsaymadan önce gerçek iş yüklerinizi token sayımı ile modelleyin. Sonnet 5 fiyatlandırma dökümü, tanıtım ve standart fiyatlandırma matematiği ile bu konuyu daha derinlemesine inceler.
Bu değişikliği token sayma uç noktasıyla kendiniz ölçebilirsiniz:
curl https://api.anthropic.com/v1/messages/count_tokens \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-sonnet-5",
"messages": [
{"role": "user", "content": "Summarize the changelog for our billing API v3 release."}
]
}'
Aynı çağrıyı `claude-sonnet-4-6` ile çalıştırın ve sayıları karşılaştırın. Bu fark, gerçek bütçe etkinizdir.
Yükseltmenin maliyeti
Token başına, Sonnet 5, Sonnet 4.6 ile aynı maliyete sahiptir: standart oranlarda milyon girdi tokenı başına 3$ ve milyon çıktı tokenı başına 15$. 31 Ağustos 2026'ya kadar geçerli olan, milyon girdi başına 2$ ve milyon çıktı başına 10$'lık bir tanıtım oranı bulunmaktadır, bu tarihten sonra standart 3$ / 15$'a geçecektir.
Yani tanıtım dönemi boyunca, eşdeğer metin token başına 4.6'nın standart oranından daha ucuzdur, bu da tokenlaştırıcının yaklaşık %30'luk token artışını kısmen dengelemektedir. 31 Ağustos'tan sonra, token başına oranlar tekrar 4.6 ile eşleşecek ve tokenlaştırıcı etkisi, eşdeğer bir isteğin 4.6'daki aynı isteğe göre daha pahalıya mal olabileceği anlamına gelecektir. Bunu gerçek trafiğinize göre modelleyin. Toplu işlem ve istem önbellekleme oranları için, sabit bir indirim varsaymak yerine Anthropic'in fiyatlandırma sayfasını kontrol edin.
Eğer daha eski nesli maliyet açısından da değerlendiriyorsanız, Sonnet 4.6 fiyatlandırma ve Claude API maliyet kılavuzları size karşılaştırma yapabileceğiniz temel referansları sunar.
Yükseltmeli misiniz? Kullanıcıya göre bir karar
Model kimliği değişimi önemsizdir. Bunu yapıp yapmayacağınız, ne çalıştırdığınıza bağlıdır.
Ajanlar, kodlama araçları veya araç yoğun iş akışları geliştiriyorsanız şimdi yükseltin. Bu en açık kazançtır. SWE-bench Pro ve OSWorld kazanımları tam olarak ajansı uygulamaların bulunduğu yere denk gelir ve güvenlik iyileştirmeleri otonom döngülerdeki istenmeyen davranışları azaltır. Üç parametreli incelemeyi yapın, token bütçelerinizi yeniden ölçün ve yayınlayın.

Yüksek hacimli üretim iş yükleri çalıştırıyorsanız yükseltin, ancak dikkatlice test edin. Aynı token başına fiyat iyi bir haber, ancak tokenlaştırıcı, toplam token harcamanızın ve `max_tokens` kesme davranışınızın değişmesi anlamına gelir. Gerçek trafiği yönlendirmeden önce bir token sayma geçişi ve bir regresyon paketi çalıştırın. 31 Ağustos'a kadar geçerli olan tanıtım fiyatlandırması, daha düşük bir oranla doğrulama yapmanız için bir pencere sunar.
`temperature`, `budget_tokens` veya ön doldurmaya bağımlıysanız bilinçli olarak yükseltin. Bunlar artık 400 hatası döndürüyor. Geçiş basittir; determinizmi sistem isteminize taşımak ve bütçeleri eforla değiştirmek, ancak sıfır iş değildir. Değişimi yapmadan önce bunları düzeltin, sonra değil.
Özellikle Öncelik Katmanı'na ihtiyacınız varsa bekleyin. Sonnet 5'te mevcut değildir. SLA'nız buna bağlıysa, gereksinimleriniz değişene kadar bu yollar için 4.6'da kalın.
Çoğu ekip için yanıt yükseltmektir ve yakın zamanda, çünkü aynı ana fiyatla daha iyi ajansı performans elde edersiniz. Bunu Cuma günü yayınladığınız tek karakterlik bir düzenleme olarak değil, bir test geçişiyle gerçek bir geçiş olarak ele alın. Nesilleri daha geniş bir şekilde karşılaştırıyorsanız, Sonnet 4.6 API kılavuzu, ayrıldığınız yüzeyi belgeler.
Apidog'daki kaydedilmiş istek paketi ile regresyonları yakalayın
Yükseltmenin en güvenli yolu, kendi istemleriniz üzerinde Sonnet 5'i Sonnet 4.6 ile karşılaştırmaktır, bir kıyaslama tablosunda değil. Bu, bir API platformunun tam olarak bu tür öncesi ve sonrası testleri için inşa edildiği bir durumdur.
Apidog, hepsi bir arada bir API geliştirme ve test aracıdır. Claude API'yi çağırdığınızda, yetkilendirme başlıkları, bir JSON istek gövdesi ve bir JSON yanıtı ile bir HTTP uç noktasına ulaşırsınız. Apidog, bu isteği bir kez kaydetmenize ve yeniden kullanılabilir bir koleksiyon olarak çalıştırmanıza olanak tanır, bu da bir model geçişini manuel bir yeniden deneme yerine tekrarlanabilir bir teste dönüştürür.

Pratik bir geçiş iş akışı şöyle görünür:
- Üretim Mesajları API isteklerinizi, her temsili istem için bir tane olmak üzere bir Apidog koleksiyonu olarak kaydedin.
ANTHROPIC_API_KEY'inizi bir ortam değişkeni olarak saklayın, böylece onu asla bir istek gövdesine yapıştırmazsınız.- Yalnızca
modeldeğeriyle farklılık gösteren iki ortam kurun:claude-sonnet-4-6veclaude-sonnet-5. - Yanıt şekli ve
usagetoken sayıları üzerinde onaylamalar ekleyin, ardından koleksiyonu her iki ortama karşı çalıştırın. - İki çalıştırmayı karşılaştırın. Token sayım farklılıkları, tokenlaştırıcının istemleriniz üzerindeki gerçek etkisini gösterir ve başarısız olan herhangi bir onaylama, yayınlamadan önce araştırılması gereken bir regresyondur.
Ayrıca, token harcamadan, `stop_reason: "refusal"` yolu da dahil olmak üzere çevresel entegrasyonunuzu oluşturmak ve test etmek için Claude uç noktasını Apidog'da taklit edebilirsiniz. Uygulamanız ajan odaklıysa ve başka araçları çağırıyorsa, bu alt akış API'lerini de Apidog'da test edip taklit edebilirsiniz.
Karşılaştırma paketini oluşturmak için Apidog'u indirin veya bir istekten başlamak için Apidog'u tarayıcınızda açın. Bu amaçla Postman'dan geçiyorsanız, Postman olmadan API testi kılavuzu eşdeğer akışı kapsar.
SSS
Claude Sonnet 5, Sonnet 4.6'nın doğrudan bir yerine geçişi mi? Çoğunlukla. Model kimliğini `claude-sonnet-4-6`'dan `claude-sonnet-5`'e değiştirir, ardından üç şeyi gözden geçirirsiniz: adaptif düşünme artık varsayılan olarak açıktır (`max_tokens`'ı etkiler), `budget_tokens` genişletilmiş düşünme 400 döndürür ve varsayılan olmayan örnekleme parametreleri 400 döndürür. Diğer her şey aktarılır. Tam istek kurulumu için Sonnet 5 API kılavuzuna bakın.
Sonnet 5, Sonnet 4.6'dan daha mı pahalı? Token başına hayır. Her ikisi de standart oranlarda milyon giriş başına 3$ ve milyon çıkış başına 15$'dır. Ancak Sonnet 5'in yeni tokenlaştırıcısı aynı metin için yaklaşık %30 daha fazla token üretir, bu nedenle eşdeğer bir istek, aynı token başına oranla bile daha pahalıya mal olabilir. 31 Ağustos 2026'ya kadar milyon başına 2$ / 10$'lık bir tanıtım oranı bulunmaktadır.
Yükseltmeden sonra yanıtım neden kesiliyor? Sonnet 5'te adaptif düşünme varsayılan olarak açıktır ve düşünme tokenları, yanıt metninizle aynı `max_tokens` bütçesini paylaşır. 4.6'da yanıtınıza uyan bir bütçe, şimdi onu kesebilir. `max_tokens`'ı artırın veya o çağrıda düşünme istemiyorsanız `thinking={"type": "disabled"}` olarak ayarlayın.
Yeni tokenlaştırıcı için kodumu değiştirmem gerekiyor mu? Hayır. İstek, yanıt ve akış şekilleri aynıdır, bu nedenle kod değişikliği gerekmez. Ancak tokenlar bazında bütçelediğiniz her şeyi yeniden ölçmelisiniz: token sayıları, `max_tokens` boyutlandırması ve istek başına maliyet tahminleri. Sonnet 4.6 token sayılarınızı yeniden kullanmayın.
`temperature` ve `budget_tokens`'a ne oldu? Her ikisi de Sonnet 5'te varsayılan olmayan değerlere ayarlandığında 400 hatası döndürür. Varsayılan olmayan `temperature`, `top_p` ve `top_k`'yi kaldırın ve davranışı sistem isteminiz aracılığıyla yönlendirin. `budget_tokens` genişletilmiş düşünmeyi adaptif düşünme artı efor parametresiyle değiştirin. Fable 5 ve Mythos API değişiklikleri kılavuzu, daha yüksek katmanda aynı deseni kapsar.
