Claude Opus 5 Efor Parametresi: Maliyet-Yetenek Değişimi

Claude Opus 5 efor parametresi açıklandı: tüm beş seviyesi, neden yüksek varsayılan olarak ayarlandığı, yeniden kalibrasyonun neleri değiştirdiği, max_tokens etkileşimi ve düşünme devre dışı bırakıldığında oluşan 400 hatası.

INEZA Felin-Michel

INEZA Felin-Michel

25 July 2026

Claude Opus 5 Efor Parametresi: Maliyet-Yetenek Değişimi

Kurumsal İçin Apidog

Şirket İçi (On-Premises) Dağıtım

SSO ve RBAC

SOC 2 Uyumlu

Apidog Enterprise'ı Keşfedin

24 Temmuz 2026'daki Claude Opus 5 lansmanının her ana akım yazısında aynı özellikten bahsedildi. Fortune, bunu maliyet ve yetenek arasında geçiş yapma yöntemi olarak adlandırdı. CNBC, Bloomberg ve TechCrunch hepsi buna işaret etti. Ancak hiçbiri ne olduğunu, seviyelerin ne olduğunu, birini değiştirdiğinizde ne olduğunu veya faturanıza ne yaptığını söylemedi.

Bu, effort adı verilen bir istek parametresidir, Opus 5'te beş seviyesi vardır ve varsayılan olarak high'dır. Özelliğin tamamı budur. Bunu bir makaleye değer kılan şey, Anthropic'in bu model için seviyeleri yeniden kalibre etmesidir; bu da Opus 4.8'de ayarladığınız ayarların artık yanlış olduğu ve belirli bir ayar kombinasyonunun bu hafta birçok geçiş günlüğünde görünecek bir 400 hatası döndüreceği anlamına gelir.

💡
Okurken seviyeleri gerçek bir uç noktaya karşı denemek isterseniz, Apidog aynı isteği beş farklı ayarda göndermek ve geri dönenleri karşılaştırmak için basit bir yoldur.
Düğme

Effort parametresi aslında nedir

Effort, bir Mesajlar API isteğindeki output_config nesnesinde yer alır:

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "output_config": { "effort": "high" },
  "messages": [
    { "role": "user", "content": "Refactor this module and explain the tradeoffs." }
  ]
}

Modelin yanıt vermeden önce ne kadar dahili muhakeme yaptığını kontrol eder. Opus 5 varsayılan olarak uyarlanabilir düşünmeyi çalıştırır ve effort, bu düşünme bütçesinin ne kadar cömertçe harcanacağını ayarlayan düğmedir. Daha yüksek effort, daha fazla muhakeme jetonu, daha yüksek maliyet ve daha fazla gecikme anlamına gelir. Daha düşük effort ise bu üçünden daha azı anlamına gelir.

Tüketici arayüzleri, aynı fikri ham bir JSON alanı yerine bir effort seçici olarak sunar; maliyet-yetenek geçişi olarak basında yer alan çerçeve de buradan gelir. Bunun altında bu parametre bulunur. API üzerinde geliştirme yapıyorsanız, parametre aslında kontrol ettiğiniz şeydir, bu yüzden makalenin geri kalanı bundan bahseder. İsteğin tam yapısı Opus 5 API kılavuzumuzda ve parametre referansı Anthropic'in modeller genel bakışında yer almaktadır.

Effort'un olmadığı bir şey: ayrıntı kontrolü. Anthropic'in Opus 5 için istem rehberi, effort'u düşürmenin görünen yanıtın uzunluğunu değil, düşünmeyi kısalttığını açıkça belirtir. Opus 5 zaten Opus 4.8'den daha uzun varsayılan yanıtlar ve daha uzun teslimatlar yazar. Daha kısa çıktı istiyorsanız, istemde daha kısa çıktı isteyin. low seviyesine düşmek bunu sizin için yapmaz.

Beş seviye

Seviye Ne işe yarar Tipik kullanım
low Yanıt vermeden önce minimal muhakeme Yüksek hacimli sınıflandırma, çıkarma, yönlendirme, kısa özetler
medium Orta düzeyde muhakeme Geri çağrılan bağlam üzerinde Soru-Cevap, tek dosya düzenlemeleri, yapılandırılmış dönüşümler
high Varsayılan. Önemli muhakeme Henüz hiçbir şey ölçmediğiniz genel amaçlı işler
xhigh Genişletilmiş muhakeme Kodlama ve temsilci döngüleri. Anthropic'in her ikisi için de önerdiği başlangıç noktası
max Maksimum muhakeme bütçesi Yanlış bir cevabın jetonlardan daha pahalıya mal olduğu zor tek seferlik problemler

Bu tablo hakkında kolayca göz ardı edilebilecek iki şey var.

Varsayılan high'dır, low veya xhigh değildir. Hiçbir output_config içermeyen bir istek gönderirseniz, high elde edersiniz. Bu, maliyet tahminleri için önemlidir: Opus 5'teki el değmemiş bir istek gerçek muhakeme işi yapar ve size bunun için fatura keserken, Opus 4.8'deki aynı el değmemiş istek hiç düşünme yapmıyordu. Bu değişiklik, Opus 4.8'den Opus 5'e geçişteki iki kritik değişiklikten biridir ve bir finans ekibini şaşırtması en muhtemel olanıdır.

Ve kodlama ve temsilci çalışmaları için önerilen xhigh'dır, max değil. Anthropic, bu iş yükleri için başlangıç noktası olarak xhigh'ı konumlandırır. max onun üzerindedir, ancak oradan başlamak, muhtemelen bir faydasını ölçemeyeceğiniz fazladan kapasite için ödeme yapmak anlamına gelir. xhigh'dan başlayın, sonra aşağı doğru kademeleri deneyin.

Yeniden kalibrasyon neyi değiştirdi

Ayarları modeller arasında taşımayı kötü bir fikir yapan kısım burasıdır.

Anthropic, Opus 5'te her effort seviyesinin ne anlama geldiğini yeniden kalibre etti. Opus 5'teki medium etiketi, Opus 4.8'deki medium etiketinin tanımladığı muhakeme miktarının aynısını tanımlamaz. Anthropic'in rehberliği, 4.8 yapılandırmanızı taşımak yerine Opus 5 üzerinde yeni bir effort testi çalıştırmanız yönündedir.

Pratik sonuç uyarıdan daha ilginç. Önceki Opus modellerinde, low ve medium ciddi işler için çoğunlukla teorikti: ucuzdular ve belirgin şekilde daha kötüydüler, bu yüzden ekipler her şeyi high veya üzerine ayarlayıp bunun bedelini ödüyordu. Opus 5'te alt seviyeler eskisinden anlamlı derecede daha güçlü, bu da low ve medium'un Opus sınıfı bir modelde üretim görevleri için gerçekten kullanılabilir olduğu ilk seferdir.

Lansmandaki gerçek maliyet kaldıracı budur ve basın haberlerinin 'geçiş' kelimesine sıkıştırdığı da budur. Opus 5, Opus 4.8 ile aynı şekilde, milyon giriş jetonu başına 5 dolar ve milyon çıkış jetonu başına 25 dolar maliyetle gelir. Muhakeme jetonları bu faturanın çıkış tarafına düşer. Dolayısıyla, bir sınıflandırma hattını high seviyesinde çalıştırmak ile low seviyesinde çalıştırmak arasındaki fark bir yuvarlama hatası değildir; ekstra muhakemenin başlangıçta size doğruluk kazandırmadığı bir iş yükünde çıktı harcamanızın büyük bir kısmıdır. Opus 5 fiyatlandırma dökümümüzde, %50 toplu indirim ve 512 jetonluk önbellek minimumu da dahil olmak üzere tüm fiyat kartı bulunmaktadır ve bunların her ikisi de daha düşük bir effort ayarıyla birleşir.

Tek bir uç nokta yerine tüm bir Claude ortamında tasarruf arıyorsanız, Claude API faturanızı düşürme yöntemleri burada da geçerlidir ve listeye effort da eklenmiştir.

xhigh ve max'in max_tokens ile etkileşimi

max_tokens, düşünme jetonları ve yanıt jetonlarını birlikte sınırlar. Bu, isteğin tüm çıktı tarafında, sadece görünen metinde değil, katı bir üst sınırdır.

Effort'u artırdığınızda, modelin yazmaya başlamadan önce bu üst sınırın ne kadarını muhakemeye harcayacağını artırırsınız. max_tokens'ı düşünmeyen bir model için belirlediğiniz bir değerde bırakırken effort'u xhigh veya max'e çıkarırsanız, model bütçeyi muhakeme yaparak tüketebilir ve cevabı bitirmeden kesebilir. İstekte bariz bir yanlışlık olmaksızın kesik bir yanıt alırsınız.

Çözüm, ona yer açmaktır. Anthropic'in rehberliği, Opus 5 üzerinde xhigh veya max çalıştırırken max_tokens: 64000 ile başlamanız yönündedir:

{
  "model": "claude-opus-5",
  "max_tokens": 64000,
  "output_config": { "effort": "xhigh" },
  "messages": [
    { "role": "user", "content": "Fix the failing integration test and explain the root cause." }
  ]
}

Yüksek bir max_tokens bir üst sınırdır, bir satın alma değildir. Gerçekte üretilen jetonlar için faturalandırılırsınız, bu nedenle 64000 ayarlamak 64000 için ödeme yapmak anlamına gelmez. Bu, modelin düşünmesinin ortasında durmaya zorlanmadığı anlamına gelir.

Henüz kimsenin yazmadığı 400 hatası

Bu, destek talepleri oluşturacak.

Düşünmeyi devre dışı bırakmak ve yüksek effort talep etmek çelişkili talimatlardır ve Opus 5 bu kombinasyonu doğrudan reddeder. thinking: {type: "disabled"} ile birlikte xhigh veya max effort göndermek, istek başına uygulanan bir 400 hatası döndürür:

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "thinking": { "type": "disabled" },
  "output_config": { "effort": "xhigh" }
}

Bu istek başarısız olur. Düşünmeyi devre dışı bırakmak sizi high effort ile sınırlar. Geçerli kombinasyonlar şunlardır:

Bu hatayı üreten geçiş yolu tahmin edilebilir: bir ekip, zararsız olduğu bir Opus 4.8 yapılandırmasından thinking: {type: "disabled"} öğesini taşır, ardından kodlama önerisi olduğu için effort'u ayrı olarak xhigh'a yükseltir. Her iki düzenleme de tek başına makul görünür. Birlikte 400 hatası verirler.

Anthropic'in kendi tavsiyesi, Opus 5'te düşünmeyi hiç devre dışı bırakmamaktır. Düşünme kapalıyken, ara sıra iki hata modu ortaya çıkar: model, asla çalıştırılmayan araç çağrılarını düz metin olarak yazar ve dahili XML etiketleri görünür çıktıya sızar. Temsilci bir döngüde sızan metin daha sonraki dönüşleri zehirler. Opus 5'te maliyeti kontrol etmenin önerilen yolu, düşünmeyi devre dışı bırakmak değil, daha düşük bir effort seviyesi kullanmaktır. Her iki artefakt hakkında daha derinlemesine bilgiyi Opus 5 istem rehberinde bulabilirsiniz.

Kendi değerlendirmelerinizde bir effort testi nasıl yapılır

Anthropic size yeniden bir test yapmanızı söylüyor. İşte bir öğleden sonraya sığacak bir prosedür.

1. Bir görev setini dondurun. Sentetik örnekler yerine üretim günlüklerinden 30 ila 50 gerçek istem çekin. Gerçekten endişelendiğiniz zor durumları dahil edin. Kolay görevlerde effort farklılıkları kaybolur, bu da temiz bir örnek setinin size hiçbir şey söylemeyeceğinin tam nedenidir.

2. Herhangi bir çıktıya bakmadan önce geçme kriterini yazın. Testler başarılı, JSON bir şemaya göre doğrulanıyor, çıkarılan alan temel gerçekle eşleşiyor, bir insan değerlendirici evet veya hayır diyor. Kriteriniz bir his ise, testiniz bir his üretir.

3. Her istemi her seviyede çalıştırın. Beş seviye çarpı 40 istem, 200 çağrı yapar. Opus 5'te bu, düşünmeye değmeyecek kadar ucuzdur ve hiçbir şey gecikmeye duyarlı olmadığı için Toplu İş API'si aracılığıyla yarı fiyatına gönderebilirsiniz.

4. Her çalıştırma için üç sayı kaydedin, bir değil: başarılı veya başarısız, usage.output_tokens ve gerçek zaman gecikmesi. Yanıttaki usage bloğu, gerçek maliyet sinyalinin bulunduğu yerdir, çünkü aksi takdirde tahmin edeceğiniz muhakeme jetonlarını sayar.

5. Barınızı geçen en ucuz seviyeyi seçin, ardından ayarlama yapmadığınız bir holdout seti üzerinde doğrulayın. Holdout'u atlayan ekipler, 40 belirli isteme uygun bir ayarı yayınlama eğilimindedir.

6. Bir sonraki modelde yeniden çalıştırın. Bu testin var olmasının tüm nedeni, seviyelerin 4.8 ile 5 arasında yeniden kalibre edilmiş olmasıdır. Bunun tekrar olacağını varsayın.

Apidog'da seviyeleri yan yana karşılaştırma

Bir testin mekanik kısmı, bir istek gövdesini bir alan değiştirilerek beş kez göndermek ve geri dönenleri hizalamaktır. Bu, oldukça fazla curl kopyala-yapıştır işidir ve Apidog'un düzenlediği kısım budur.

Çalışan bir kurulum:

  1. Anthropic Mesajlar uç noktasına karşı bir istek oluşturun ve anahtarınızı gövdeye yapıştırmak yerine bir ortam değişkeni olarak saklayın. Anahtarlar, ekiple paylaştığınız her şeyin dışında kalır.
  2. Çalışan isteği bir koleksiyona kaydedin, ardından beş kez çoğaltın ve her kopyada yalnızca output_config.effort öğesini değiştirin.
  3. Her yanıtta usage nesnesini inceleyin, böylece her seviye için çıktı jetonlarını doğrudan görebilirsiniz, ayrıca önbelleğinizin çalışıp çalışmadığını kontrol ederken cache_read_input_tokens değerini de görebilirsiniz.
  4. Akış özelliğini açın ve xhigh ile low arasında gecikmenin gerçekte nereye gittiğini görmek isterseniz SSE olaylarını okuyun.
  5. stop_reason'ın mevcut olduğunu ve max_tokens olmadığını doğrulayan bir iddia ekleyin, böylece kesik bir xhigh yanıtı, sessizce kısa bir cevap gibi görünmek yerine koleksiyonunuzda yüksek sesle başarısız olur.

Bu son iddia, ilk kurulmaya değer olandır, çünkü yüksek effort'ta bir kesilme yanlış gidebilecek tek en olası şeydir. Okurken karşılaştırma koleksiyonunu oluşturmak isterseniz Apidog'u indirin. Burada hiçbir şey bunu gerektirmez; sadece beş kabuk betiği sürdürmekten daha iyidir.

Dürüst üst sınır

Effort, Opus 5'i daha ucuza ve iyi çalıştırmayı sağlar. Ancak Opus 5'i Claude yığınının en tepesine çıkarmaz.

Anthropic'in Opus 5 için kendi lansman sayıları güçlüdür: Opus 4.8'in Frontier-Bench v0.1 puanının iki katından fazla, ARC-AGI 3'te bir sonraki en iyi modelin yaklaşık 3 katı ve CursorBench 3.2'de Fable 5'in %0.5'i içinde, yarı fiyatına. Bunların hepsi Anthropic tarafından yayınlanan, satıcı tarafından yürütülen rakamlardır ve 25 Temmuz 2026 itibarıyla hiçbiri bağımsız olarak yeniden üretilmemiştir. Bunları tarafsız ölçümler olarak değil, bir kaynağı olan iddialar olarak kabul edin ve her birindeki uyarılar için Opus 5 karşılaştırma dökümümüze bakın.

Opus 5'in üzerinde, Fable 5 hala Anthropic'in en yetenekli geniş çapta piyasaya sürülen modelidir, milyon giriş başına 10 dolar ve milyon çıktı başına 50 dolar. Ve Opus 5, siber güvenlik istismarı ve otonom biyoloji araştırmalarında Mythos 5'in gerisinde kalmaktadır, bunu Anthropic doğrudan belirtir. Opus 5'i max seviyesinde çalıştırmak bu boşluklardan hiçbirini kapatmaz. Dürüst özet, sınır sınıfı yeteneği, sınır fiyatının yarısına, üzerinde adlandırılmış bir tavan ile sunmaktır. Fiyat farkının iş yükünüze değip değmeyeceği, Opus 5 vs Fable 5 yazımızda ele aldığımız sorudur.

Düğme

Sıkça Sorulan Sorular

Claude Opus 5'teki varsayılan effort seviyesi nedir? high. output_config alanı olmayan bir istek, adaptif düşünme açıkken high effort seviyesinde çalışır.

Beş effort seviyesi nelerdir? low, medium, high, xhigh ve max. Anthropic, kodlama ve temsilci çalışmaları için xhigh ile başlamanızı ve kendi değerlendirmelerinize göre oradan aşağı doğru denemeler yapmanızı önerir.

Effort'u xhigh olarak ayarladığımda isteğim neden 400 hatası döndürüyor? Neredeyse kesinlikle thinking: {type: "disabled"} de gönderdiğiniz içindir. Düşünmeyi devre dışı bırakmak effort'u high ile sınırlar ve bu kombinasyon istek başına reddedilir. Ya devre dışı bırakılmış düşünme bloğunu kaldırın ya da effort'u high veya altına düşürün.

Opus 4.8 effort ayarlarımı Opus 5'te yeniden kullanabilir miyim? Hayır. Seviyeler yeniden kalibre edildi, bu nedenle aynı etiket farklı bir muhakeme miktarı anlamına gelir. Anthropic sizden yeni bir test çalıştırmanızı ister. Nelerin değiştiğinin tam listesi geçiş rehberinde yer almaktadır.

Effort'u düşürmek yanıtları kısaltır mı? Hayır. Effort, görünen uzunluğu değil, muhakemeyi kontrol eder ve Opus 5'in varsayılan yanıtları Opus 4.8'den daha uzundur. Daha kısa çıktı istiyorsanız, açıkça kısalık için istemde bulunun.

xhigh veya max'te hangi max_tokens değerini kullanmalıyım? 64000 ile başlayın. max_tokens düşünme ve yanıtı birlikte sınırlar, bu nedenle düşünmeyen bir model için boyutlandırılmış bir bütçe kesilecektir. Yalnızca üretilen jetonlar için faturalandırılırsınız, bu nedenle yüksek tavan tek başına hiçbir maliyeti yoktur.

Tüm bunların tam teknik özellik tablosu, kullanılabilirlik matrisi ve fiyatlandırma bağlamı için Claude Opus 5 nedir ile başlayın.

API Tasarım-Öncelikli Yaklaşımı Apidog'da Uygulayın

API'leri oluşturmanın ve kullanmanın daha kolay yolunu keşfedin