Claude Opus 5 API Nasıl Kullanılır?

Adım adım Claude Opus 5 API kılavuzu: bir anahtar edinin, claude-opus-5 model kimliğiyle ilk çağrınızı gönderin, yanıtları akış olarak alın, araç kullanımını ekleyin, çabayı ayarlayın ve önbellek isabetleri için kullanımı okuyun.

Ashley Innocent

Ashley Innocent

25 July 2026

Claude Opus 5 API Nasıl Kullanılır?

Kurumsal İçin Apidog

Şirket İçi (On-Premises) Dağıtım

SSO ve RBAC

SOC 2 Uyumlu

Apidog Enterprise'ı Keşfedin

Claude Opus 5, 24 Temmuz 2026'da piyasaya sürüldü ve Anthropic artık geliştiricileri önce ona yönlendiriyor: belgeler, hangi modeli kullanacağınızdan emin değilseniz Claude Opus 5 ile başlamanızı söylüyor. API model kimliği, tarih son eki olmadan, tam olarak claude-opus-5 dizgesidir.

Bu kılavuz, anahtar alma, ilk istek gönderme, akış, araç kullanımı, adaptif düşünme, effort parametresi ve önbelleğinizin çalıştığını doğrulamak için usage nesnesini okuma gibi tüm yolu anlatır. Buradaki her istek, JSON girişli ve JSON çıkışlı düz HTTP'dir, bu nedenle uygulama kodunuza bağlamadan önce Apidog'da oluşturabilir ve hata ayıklayabilirsiniz.

Düğme

Opus 4.8'den gelen iki değişiklik, daha ilk çağrınızda sizi zorlayacaktır, bu yüzden her şeyden önce geliyorlar. Yeni baştan başlamak yerine mevcut bir hizmeti taşıyorsanız, bu kılavuzla birlikte tam Opus 4.8'den Opus 5'e geçiş kılavuzunu okuyun.

İlk çağrınızdan önce: iki çığır açan değişiklik

1. Düşünme varsayılan olarak açıktır. Opus 4.8'de, thinking alanı olmayan bir istek hiç düşünmeden çalışıyordu. Opus 5'te, aynı istek adaptif düşünmeyle çalışır. max_tokens hala düşünme belirteçleri ve yanıt belirteçleri için birlikte sabit bir sınırdır, bu nedenle çalışan bir 4.8 entegrasyonundan kopyaladığınız bir istek gövdesi artık yanıtın ortasında kesilebilir. max_tokens değeriniz beklenen çıktı uzunluğuna göre sıkıca ayarlanmışsa, onu artırın.

2. Düşünmeyi devre dışı bırakmak çaba seviyenizi sınırlar. thinking: {"type": "disabled"} ile birlikte xhigh veya max çaba göndermek 400 hatası döndürür. Anthropic bunu her istek için uygular, bu nedenle sessizce kötüleşmek yerine hemen başarısız olur. Düzeltme, birini seçmektir: düşünmeyi açık tutun ve maliyeti kontrol etmek için çabayı düşürün veya düşünmeyi devre dışı bırakın ve çabayı high ile sınırlayın.

Anthropic'in kendi tavsiyesi ilk seçenektir. Düşünme devre dışı bırakıldığında, Opus 5 bazen araç çağrılarını düz metin olarak yazar (hiçbir zaman çalışmazlar ve sızan metin, bir aracı döngüsündeki sonraki dönüşleri kirletir) ve bazen <thinking> etiketlerini görünür çıktıya sızdırır. Düşünmeyi açık tutmak ve çabayı kısmak her ikisinden de kaçınır.

Her iki değişiklik de Anthropic'in model taşıma kılavuzunda belgelenmiştir.

Adım 1: Bir API anahtarı alın

Claude Geliştirici Platformu'nda oturum açın, kuruluş ayarlarınızın API anahtarları bölümünü açın ve bir anahtar oluşturun. Bir kez kopyalayın; daha sonra geri okuyamazsınız.

Koda yapıştırmak yerine bir ortam değişkeninde saklayın:

export ANTHROPIC_API_KEY="sk-ant-..."

Bir GUI istemcisinde test yapıyorsanız, anahtarı orada da bir ortam değişkenine koyun. Apidog'da bu, ANTHROPIC_API_KEY değişkenine sahip bir ortam (Yerel, Hazırlık, Üretim) oluşturmak, ardından başlıkta {{ANTHROPIC_API_KEY}} referansını vermektir. Kayıtlı istekleriniz ekiple paylaşılabilir kalır ve sır hiçbir zaman bir koleksiyon dışa aktarımına düşmez.

İsteklerin başarılı olması için faturalandırma kredileri de eklemeniz gerekir. Opus 5 için fiyatlar, milyon giriş belirteci başına 5 dolar ve milyon çıktı belirteci başına 25 dolardır, Opus 4.8 ile aynıdır ve tam fiyatlandırma dökümü önbellekleme, toplu ve hızlı mod fiyatlarını kapsar.

Adım 2: İlk isteğinizi gönderin

Uç nokta POST https://api.anthropic.com/v1/messages'tır. Üç başlık önemlidir: anahtarınız, API sürümü ve içerik türü.

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 4096,
    "messages": [
      {"role": "user", "content": "API açısından 429 ve 529 arasındaki farkı açıklayın."}
    ]
  }'

max_tokens değerine dikkat edin. 4096, çoğu başlangıç kod parçacığında gördüğünüz 1024'ten bilinçli bir adımdır, çünkü düşünme belirteçleri artık aynı bütçeden gelir.

Resmi SDK aracılığıyla Python eşdeğeri:

import os
from anthropic import Anthropic

client = Anthropic(api_key=os.environ["ANTHROPIC_API_KEY"])

message = client.messages.create(
    model="claude-opus-5",
    max_tokens=4096,
    messages=[
        {"role": "user", "content": "API açısından 429 ve 529 arasındaki farkı açıklayın."}
    ],
)

for block in message.content:
    if block.type == "text":
        print(block.text)

message.content üzerindeki bu döngü bir süsleme değildir. Yanıt content, yazılı bloklardan oluşan bir dizidir ve düşünme açıkken, text bloğundan önce bir thinking bloğu göreceksiniz. content[0].text'in yanıt olduğunu varsayan kod, Opus 5'te bozulur. Bu, en yaygın yükseltme hatasıdır ve istek hala 200 döndürdüğü için gözden kaçırmak kolaydır.

Yapılandırma sırasında elinizin altında bulundurmaya değer birkaç özellik: Opus 5, hem varsayılan hem de maksimum olarak 1M belirteç bağlam penceresine sahiptir (beta başlık yok, uzun bağlam fiyat primi yok), Mesajlar API'sinde 128k maksimum çıktı ve Mayıs 2026 bilgi kesme tarihine sahiptir. Modellere genel bakış tam tabloyu içerir ve bizim Opus 5 açıklayıcımız özellik sayfasının geri kalanını kapsar.

Adım 3: Adaptif düşünmeyle çalışın

Adaptif düşünme, modelin bir isteğin ne kadar dahili akıl yürütmeyi hak ettiğine karar vermesi anlamına gelir. Bir belirteç bütçesi belirlemezsiniz. Bir sonraki adımda ele alınan çaba ile yönlendirirsiniz.

Kodda ele almanız gerekenler:

Düşünmeyi tamamen kapatmak için:

{
  "model": "claude-opus-5",
  "max_tokens": 4096,
  "thinking": {"type": "disabled"},
  "output_config": {"effort": "high"},
  "messages": [{"role": "user", "content": "Yalnızca HTTP durum kodunu döndür."}]
}

Bu istekte çaba kasten high ile sınırlıdır. Bunu xhigh'e yükseltirseniz, yukarıda açıklanan 400 hatasını alırsınız.

Adım 4: output_config.effort ile maliyeti kontrol edin

effort alanı output_config altında yer alır ve low, medium, high, xhigh veya max değerlerini alır. Varsayılan olarak high'dır. Bu, ana akım medyanın maliyet ve yetenek arasında bir geçiş olarak tanımladığı parametredir; API'de bu, istek gövdenizdeki tek bir dizedir.

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 65536,
    "output_config": {"effort": "xhigh"},
    "messages": [
      {"role": "user", "content": "Bu işleyiciyi yanıtları akışa almak ve geri basıncı korumak için yeniden düzenleyin."}
    ]
  }'

Ayarlamadan önce bilmeniz gereken üç şey.

Seviyeler yeniden kalibre edildi. Anthropic, Opus 4.8 çaba ayarlarınızı aktarmamanızı açıkça belirtiyor. low ve medium, Opus 5'te önceki Opus modellerine göre belirgin şekilde daha güçlüdür, bu da daha önce high'da çalıştırdığınız iş yüklerinin artık daha ucuza iyi olabileceği anlamına gelir. Bir eşlemeye güvenmek yerine kendi değerlendirmelerinize karşı yeni bir tarama yapın.

xhigh, kodlama ve ajan tabanlı çalışmalar için hala önerilen başlangıç noktasıdır. Ayrıca max_tokens'in en çok önemli olduğu yerdir. Ona yer açın; 64k, uzun ajan tabanlı dönüşler için mantıklı bir başlangıç sınırı olduğundan, yukarıdaki kod parçacığı neden 65536 kullanıyor.

Daha düşük çaba, görünür uzunluğu değil, düşünmeyi keser. Opus 5'in varsayılan yanıtları ve yazılı çıktıları Opus 4.8'den daha uzundur. Daha kısa çıktı istiyorsanız, istemde belirtin. low'a düşürmek bunu sizin için yapmaz. Çaba parametresi derinlemesine incelemesi, tam bir tarama metodolojisini anlatır.

Adım 5: Yanıtı akışa alın

"stream": true ekleyin ve uç nokta tek bir JSON gövdesi yerine sunucu tarafından gönderilen olayları döndürür.

with client.messages.stream(
    model="claude-opus-5",
    max_tokens=4096,
    messages=[{"role": "user", "content": "Güvenilir olmayan bir üst akış için yeniden deneme politikası taslağı oluşturun."}],
) as stream:
    for text in stream.text_stream:
        print(text, end="", flush=True)

    final = stream.get_final_message()
    print("\n\nusage:", final.usage)

Ham SSE dizisi şöyledir: message_start, ardından her blok için content_block_start / content_block_delta / content_block_stop, ardından stop_reason ve son çıktı belirteç sayısını taşıyan message_delta, ardından message_stop.

Düşünme açıkken, sırasıyla iki içerik bloğu akışa alınır: deltaları thinking_delta olarak gelen bir düşünme bloğu, ardından text_delta ile metin bloğu. Her deltayı aynı arabelleğe işleyen bir kullanıcı arayüzü, modelin akıl yürütmesini kullanıcılarınıza yazdırır. Bunları baştan itibaren ayrı ayrı yönlendirin.

Akış, bir GUI istemcisinin yerini kazandığı yerdir, çünkü bir terminalde ham SSE okumak acınasıdır. Apidog, olay akışını geldiği gibi işler, böylece tek bir işleyici kodu satırı yazmadan önce blok sınırlarını izleyebilir ve ayrıştırma varsayımlarınızı onaylayabilirsiniz.

Adım 6: Araç kullanımını ekleyin

Araç tanımları bir tools dizisinde yer alır. Model, stop_reason: "tool_use" ve bir tool_use içerik bloğu ile yanıt verir; aracı yürütür ve sonucu yeni bir kullanıcı mesajında bir tool_result bloğu olarak geri gönderirsiniz.

tools = [
    {
        "name": "get_order_status",
        "description": "Müşteri siparişinin mevcut durumunu kimliğe göre arayın.",
        "input_schema": {
            "type": "object",
            "properties": {
                "order_id": {"type": "string", "description": "Sipariş kimliği, örn. A-10293"}
            },
            "required": ["order_id"],
        },
    }
]

message = client.messages.create(
    model="claude-opus-5",
    max_tokens=4096,
    tools=tools,
    messages=[{"role": "user", "content": "A-10293 siparişinin durumu nedir?"}],
)

if message.stop_reason == "tool_use":
    call = next(b for b in message.content if b.type == "tool_use")
    result = get_order_status(**call.input)

    follow_up = client.messages.create(
        model="claude-opus-5",
        max_tokens=4096,
        tools=tools,
        messages=[
            {"role": "user", "content": "A-10293 siparişinin durumu nedir?"},
            {"role": "assistant", "content": message.content},
            {"role": "user", "content": [
                {"type": "tool_result", "tool_use_id": call.id, "content": result}
            ]},
        ],
    )

message.content'i doğrudan yardımcı program dönüşü olarak geçirmek, düşünme bloğunu koruyan şeydir. Bu dönüşü elle yeniden oluşturmayın.

Aracılar için önemli olan iki Opus 5 ayrıntısı. Araç kullanımı sistem istemi ek yükü Opus 4.8'den daha düşüktür: tool_choice auto veya none olarak ayarlandığında 286 belirteç, 4.8'de 290 ve Opus 4.7'de 675. İstek başına küçük, milyon ajan dönüşünde gerçek. Ve prompt önbelleğini geçersiz kılmadan dönüşler arasında araç eklemenize veya kaldırmanıza olanak tanıyan bir beta başlık, mid-conversation-tool-changes-2026-07-01 vardır.

Opus 5 ayrıca 4.8'den daha kolay bir şekilde alt aracılara devreder. Maliyet hassasiyetli iş yüklerinde, bunu faturada keşfetmek yerine sistem isteminizde açıkça belirtin.

Adım 7: Önbellek isabetleri için kullanım nesnesini okuyun

Her yanıt bir usage nesnesi taşır. Prompt önbelleklemenizin bir şey yapıp yapmadığını doğrulamanın tek dürüst yolu budur.

"usage": {
  "input_tokens": 84,
  "cache_creation_input_tokens": 6421,
  "cache_read_input_tokens": 0,
  "output_tokens": 913
}

Bir bloğu önbelleğe almak için cache_control ile işaretleyin:

{
  "model": "claude-opus-5",
  "max_tokens": 4096,
  "system": [
    {
      "type": "text",
      "text": "<uzun, sabit talimatlarınız ve referans materyaliniz>",
      "cache_control": {"type": "ephemeral"}
    }
  ],
  "messages": [{"role": "user", "content": "Birinci soru."}]
}

İlk çağrı: cache_creation_input_tokens sıfır olmayan ve cache_read_input_tokens 0. Aynı önekle ikinci çağrı: bunlar yer değiştirir. Asla yer değiştirmezlerse, önekiniz bayt-aynı değildir veya minimumun altındadır.

Bu minimum, Opus 5'teki iyi haberdir. Prompt önbellekleme artık 512 belirteçte başlar, Opus 4.8'de 1.024'ten düşürüldü. Daha önce önbelleğe almak için çok kısa olan prompt'lar artık hiçbir kod değişikliği olmadan önbelleğe alınır ve önbellek okumaları, 5 dolarlık temel giriş oranına karşı milyon belirteç başına 0.50 dolardan faturalandırılır. Test paketinizde cache_read_input_tokens'ı doğrulayın, böylece önbelleği sessizce bozan bir prompt düzenlemesi fatura yerine başarısız bir test olarak görünür. Daha fazla kaldıraç için, Claude API faturanızı düşürme hakkındaki kılavuzumuza bakın.

Tüm akışı Apidog'da test edin ve hata ayıklayın

Yukarıdakilerin hepsi yetkilendirme başlıklarına sahip bir HTTP isteği, bir JSON gövdesi, bir SSE akışı ve karşılaştırmanız gereken bir yanıttır. Apidog hepsi bir arada bir API geliştirme platformudur ve bu, tam da onun ele aldığı türden bir uç noktadır: isteği gönderir, anahtarı saklar, akışı işler ve yanıtı test eder. Çıkarım yapmaz veya modelleri yönlendirmez; çağrı hala Anthropic'e gider.

İlk günden itibaren kendini amorti eden bir kurulum:

  1. İsteği oluşturun. Üç başlık ile POST https://api.anthropic.com/v1/messages ve anahtarın ortam değişkeninden çekilmesi, satır içi yapıştırılması yerine.
  2. Bir koleksiyona kaydedin. Ekibiniz, her kişinin bir blog kod parçacığından yeniden oluşturması yerine, bilinen iyi bir istek şeklini yeniden kullanır.
  3. Her çaba seviyesi için çatallayın. İsteği output_config.effort değeri low, medium, high ve xhigh olarak ayarlanmış şekilde çoğaltın, aynı istemi her birine gönderin ve çıktı kalitesini, gecikmeyi ve belirteç sayılarını yan yana karşılaştırın. Bu, Anthropic'in çalıştırmanızı istediği çaba taramasıdır, bir test düzeneği yazmadan yapılır.
  4. SSE akışını izleyin. "stream": true'yu açın ve düşünme bloklarını ve metin bloklarını ayrı ayrı ele aldığınızı doğrulamak için olayları geldikçe okuyun.
  5. Araç çağrısı yüklerini inceleyin. stop_reason tool_use olarak geri döndüğünde, modelin ürettiği tam input nesnesi oradadır, bu da input_schema'nızın çok gevşek olduğunu anlamanızı sağlar.
  6. Yanıtı doğrulayın. stop_reason'ın max_tokens (kesme uyarınız) olmadığını ve tekrar çağrılarda cache_read_input_tokens'ın sıfırdan büyük olduğunu (önbellekleme uyarınız) kontrol eden kontroller ekleyin.

Takip etmek isterseniz Apidog'u indirin. Aynı koleksiyon deseni herhangi bir Claude modeliyle çalışır, böylece onu Sonnet 5'e veya mevcut Opus 4.8 isteklerinize yönlendirebilir ve davranışı karşılaştırabilirsiniz.

Gerçekten karşılaşacağınız hatalar ve tuzaklar

Dürüst tavan

Opus 5, Claude yığınının zirvesi değildir ve bunu açıkça belirtmekte fayda var. Fable 5, milyon giriş belirteci başına 10 dolar ve milyon çıktı belirteci başına 50 dolar ile Anthropic'in "en yetenekli geniş çapta yayınlanan" unvanını hala koruyor. Opus 5 ayrıca siber güvenlik istismarı ve otonom biyoloji araştırmalarında Mythos 5'in gerisinde kalıyor, bunu Anthropic kendisi belirtiyor.

Lansman kıyaslama iddiaları (Frontier-Bench v0.1'de Opus 4.8'in yaklaşık iki katı, ARC-AGI 3'te bir sonraki en iyi modelin yaklaşık 3 katı, CursorBench 3.2'de Fable 5'in %0.5'i içinde) Anthropic'in kendi rakamlarıdır ve 25 Temmuz 2026 itibarıyla bağımsız olarak çoğaltılmamıştır. Bunları satıcı tarafından yürütülen sonuçlar olarak okuyun, ardından kendi değerlendirmelerinizi yapın. Opus 5 ile Fable 5 karşılaştırması, fiyat farkının nerede değdiğini ve nerede değmediğini açıklar ve Anthropic'in lansman yazısı, iddiaların birincil kaynağıdır.

SSS

Claude Opus 5 için model kimliği nedir? Tam olarak, tarih son eki olmadan claude-opus-5. Amazon Bedrock'ta anthropic.claude-opus-5'tir; Google Cloud ve AWS'deki Claude Platformu birinci taraf kimliğini kullanır.

Çalışan Opus 4.8 isteğim neden Opus 5'te kesilmeye başladı? Düşünme artık varsayılan olarak açık. max_tokens, düşünme belirteçlerini ve yanıt belirteçlerini birlikte sınırlar, bu nedenle 4.8'de yanıtınıza uyan bir bütçe, Opus 5'te akıl yürütme artı yanıta uymayabilir. max_tokens'ı artırın ve stop_reason: "max_tokens" olup olmadığını kontrol edin.

Düşünmeyi devre dışı bıraktığımda neden 400 hatası alıyorum? Neredeyse kesinlikle thinking: {"type": "disabled"} ile output_config.effort'u xhigh veya max olarak eşleştirdiniz. Bu kombinasyon istek başına reddedilir. Çabayı high ile sınırlayın veya düşünmeyi etkin tutun ve bunun yerine çabayı düşürün.

1M bağlam penceresi için bir beta başlığına ihtiyacım var mı? Hayır. Opus 5'te, 1M belirteç hem varsayılan hem de maksimumdur, beta başlığı veya uzun bağlam fiyat primi yoktur. Toplu API'de 300k çıktıya ulaşmak için output-300k-2026-03-24 beta başlığına ihtiyacınız vardır; Mesajlar API'si çıktıyı 128k ile sınırlar.

Opus 4.8 çaba ayarlarımı yeniden kullanabilir miyim? Anthropic hayır diyor. Seviyeler yeniden kalibre edildi ve low ve medium Opus 5'te belirgin şekilde daha güçlüdür. Kendi değerlendirme setinize karşı yeni bir tarama yapın.

Apidog modeli çalıştırıyor mu? Hayır. Apidog HTTP isteğini gönderir, inceler ve test eder; çıkarım Anthropic tarafında gerçekleşir. Anahtarları, akışı, araç çağrısı yüklerini ve çağrı etrafındaki yanıt doğrulamasını yönetir.

API Tasarım-Öncelikli Yaklaşımı Apidog'da Uygulayın

API'leri oluşturmanın ve kullanmanın daha kolay yolunu keşfedin