Qwen 3.8 Fiyatlandırması ve Detayları: 1 Milyon Bağlamda 2$ Giriş / 6$ Çıkış

Qwen 3.8'in genel kullanıma sunulduğundaki fiyatlandırması: 1 milyon jeton başına 2 dolar giriş / 6 dolar çıkış, 1 milyonluk bağlamın tamamında sabit. Önbellek indirimleri, ücretsiz kota küçük yazısı ve hesaplanmış maliyet matematiği.

INEZA Felin-Michel

INEZA Felin-Michel

3 August 2026

Qwen 3.8 Fiyatlandırması ve Detayları: 1 Milyon Bağlamda 2$ Giriş / 6$ Çıkış

Kurumsal İçin Apidog

Şirket İçi (On-Premises) Dağıtım

SSO ve RBAC

SOC 2 Uyumlu

Apidog Enterprise'ı Keşfedin

Alibaba, Qwen 3.8-Max'i Ağustos 2026 başında piyasaya sürdü ve fiyatlandırma sorusu nihayet gerçek bir cevaba kavuştu. Temmuz önizleme penceresi sırasında dolaşan hikaye, "%10 önizleme fiyatlandırması" promosyonuydu. O hikaye bitti. Genel kullanıma sunulduğunda, resmi Model Studio fiyatlandırma sayfası qwen3.8-max'i 1M giriş belirteci başına 2 dolar ve 1M çıkış belirteci başına 6 dolar olarak listeliyor; bu, tüm 1M belirteçlik bağlam penceresini kapsayan tek bir sabit kademedir.

Bu sabit kademe, ilginç olan kısım. Çoğu öncü model, isteminiz belirli bir bağlam eşiğini aştığında belirteç başına daha fazla ücret alır. Qwen 3.8-Max bunu yapmıyor: ister 5.000 belirteç gönderin ister 900.000, oran 2$/6$ olarak kalıyor.

Bu makale, kapsamlı bir genel bakış sunuyor: sabit kademe tasarımı, Qwen 3.7-Max, Kimi K3, Claude Opus 5 ve GPT-5.6 Terra ile karşılaştırmalar, önbellekleme indirimleri, ücretsiz kota ayrıntıları ve gerçek matematiksel hesaplamalarla maliyet örnekleri. Daha geniş bir model genel bakışı için, Qwen 3.8'in ne olduğu ve neden önemli olduğu ile başlayın, ardından sayılar için geri dönün.

Öncelikle bir not: Liste fiyatları size yalnızca bir tahmin sunar. Qwen 3.8-Max varsayılan olarak xhigh çabasıyla mantık yürütme özelliğiyle gelir ve düşünme belirteçleri çıktı olarak faturalandırılır. Maliyetleri güvenilir bir şekilde tahmin etmenin yolu, gerçek istekler gönderip belirteç kullanımını ölçmektir. Apidog, test yaparken her yanıtın tam belirteç dökümünü gösterir, bu da maliyet tahminini aritmetiğe dönüştürür. Bunun hakkında daha fazlası aşağıda.

Genel Kullanıma Sunulma (GA) rakamı: 2$ giriş, 6$ çıkış, tek kademe

İşte qwen3.8-max için resmi tarife kartı, 3 Ağustos 2026 itibarıyla Model Studio fiyatlandırma sayfasına göre doğrulanmıştır:

Öğe Fiyat (1M belirteç başına)
Giriş $2.00
Çıkış (düşünme belirteçleri dahil) $6.00
Önbelleğe alınmış giriş (önbellek isabeti) Giriş oranının %10'u
Açık önbellek oluşturma Giriş oranının %125'i
Bağlam kademesi Tek kademe, 0 ila 1M belirteç
Düşünme ve düşünmeme Aynı şekilde faturalandırılır

Belirtmeye değer üç ayrıntı: 1M bağlam penceresi, uzun istem ek ücreti olmaksızın tek bir fiyatla tamamen kapsanmaktadır. Düşünme ve düşünmeme modları aynı oranlara sahiptir, ancak düşünme belirteçleri çıktı olarak sayılır (aşağıdaki dürüstlük bölümüne bakın). Ve maksimum çıktı istek başına 65.536 belirteçtir, yani tek bir yanıt çıktı olarak en fazla yaklaşık 0,39 ABD doları tutarında faturalandırılır.

Resmi Qwen 3.8 duyurusu, modeli Alibaba'nın bugüne kadarki en yetenekli modeli olarak konumlandırıyor: 95B aktif ile toplam 2.4T parametre, 1M belirteçlik bağlam penceresi, çok modlu giriş. Bunu 2$/6$ fiyatla almak, Alibaba'nın kendi önceki amiral gemisi de dahil olmak üzere çoğu öncü kademenin fiyatının altında kalıyor.

1M belirteç boyunca sabit fiyatlandırmanın neden alışılmadık olduğu

Kademeli bağlam fiyatlandırması sektör standardıdır: belirli bir bağlam eşiğinin altında bir oran, üzerinde ise daha yüksek bir oran uygulanır, çünkü uzun bağlamlara hizmet vermek daha maliyetlidir.

Alibaba bunu kendisi de yapıyor. Aynı Model Studio fiyatlandırma sayfasında, qwen3-max ve qwen3-coder-plus gibi modeller bağlam uzunluğu kademelerinde fiyatlandırılır, giriş arttıkça belirteç başına oran da yükselir. Qwen 3.8-Max, Alibaba'nın kendi kataloğunda bu kalıbı kırıyor: fiyatlandırma tablosu tek bir sıra gösteriyor, “0<Belirteç≤1M”, ve hepsi bu.

Bu neden önemli: Kademeli fiyatlandırma ile uzun bağlamlı iş yükleri gizli bir çarpan taşır. Ara sıra bir isteme 300K belirteçlik belge dolduran bir RAG hattı, bu isteklerde tipik oranının birkaç katına mal olabilir. Qwen 3.8-Max ile marjinal belirteç her zaman aynı fiyata gelir, bu nedenle bütçeleme doğrusaldır: belirteçler çarpı oran, bitti. Uzun belge analizi, büyük kod tabanlı aracılar veya yoğun bilgi alma boru hatları için bu öngörülebilirlik, düşük oranın kendisi kadar değerlidir.

Liste fiyatından Qwen 3.7-Max'ten daha ucuz

Qwen 3.8-Max, selefinin liste fiyatının altında piyasaya sürüldü; bu, amiral gemisi nesil sıçramaları için nadir görülen bir durumdur:

Model daha büyük bir bağlam penceresi, çok modlu giriş ve daha iyi kıyaslama puanları kazanırken her iki tarafta da %20'lik bir kesinti var.

Bir komplikasyon: Qwen 3.7-Max şu anda %50'lik bir promosyonla sunuluyor ve bu da fiyatını 1,25$/3,75$'a düşürüyor. Promosyon oranlarında, eski amiral gemisi yeni olandan daha ucuz. İş yükünüz Qwen 3.8'in 1M bağlamına veya çok modlu ve aracılık kazançlarına ihtiyaç duymuyorsa, indirimli 3.7-Max promosyon devam ettiği sürece meşru bir değer oyunudur; sadece maliyet modelinizi bir promosyon etrafında kurgulamayın. Basamakların daha aşağısında, Qwen 3.7-Plus, kendi %20 promosyonuyla 0,4$/1,6$ fiyatıyla bütçe dostu iş atı olmaya devam ediyor.

Dürüstlük bölümü: düşünme belirteçleri çıktı olarak faturalandırılır

Bu, çoğu fiyatlandırma yazısının atladığı ve faturanızda sizi şaşırtması en muhtemel olan kısımdır.

Qwen 3.8-Max, reasoning_effort parametresini üç seviyede destekler: xhigh, medium ve low. Varsayılan ayar xhigh olup, en agresif ayardır. Düşünme modunda, model nihai yanıtından önce dahili muhakeme belirteçleri oluşturur ve bu muhakeme belirteçleri, görünür metinle aynı şekilde, 6$ çıktı oranı üzerinden faturalandırılır.

Sonuç: Varsayılan ayarlarda, yoğun muhakeme gerektiren istekler, basit bir "istem belirteçleri artı yanıt belirteçleri" tahminiyle öngörülenden daha pahalıya mal olur. 800 belirteçlik görünür yanıt gösteren bir yanıt, zor bir problemde birkaç bin düşünme belirteci tüketmiş olabilir.

Üç azaltma yöntemi: derin muhakeme gerektirmeyen görevler için (sınıflandırma, çıkarma, biçimlendirme) reasoning_effortmedium veya low seviyesine düşürün; her yanıttaki usage nesnesi muhakeme dahil gerçek sayıları bildirdiğinden, aylık harcamayı tahmin etmeden önce görev türüne göre gerçek kullanımı ölçün; ve özellikle çıktı belirteçlerini izleyin, çünkü burada çıktı girişe göre 3 kat daha maliyetlidir ve düşünme çıktıyı şişirir.

Bağlam önbellekleme: %10 isabet, %125 oluşturma

Uygulamanız aynı istem önekini (uzun bir sistem istemi, sabit bir belge, araç tanımları) tekrar tekrar gönderiyorsa, bağlam önbellekleme ekonomiyi önemli ölçüde değiştirir:

Başabaş noktası matematiği basittir. Oluşturma bir kez %25 ek maliyet getirir; sonraki her isabet %90 tasarruf sağlar. Bir önek iki kez bile yeniden kullanılırsa, önbellekleme zaten kendini amorti eder. Yüksek frekanslı aracılar veya ağır sistem istemine sahip sohbet uygulamaları için tasarruflar hızla birikir (aşağıdaki örnekte gösterilmiştir).

Ücretsiz kota ayrıntıları: 1M belirteç, Singapur, 90 gün

Model Studio, qwen3.8-max için ücretsiz bir kota sunar ve ayrıntılar önemlidir:

Düşünme belirteçleri de diğer çıktılar gibi bu kotadan çekilir, bu nedenle xhigh seviyesindeki birkaç düzine zorlu muhakeme görevi, beklediğinizden daha hızlı bir şekilde 1M belirteci tüketebilir. Ücretsiz erişim ana hedefinizse, Qwen Chat dahil tüm ücretsiz yolları Qwen 3.8'i ücretsiz nasıl kullanacağınız makalesinde topladık.

Qwen 3.8 fiyatlandırması nasıl karşılaştırılır?

İşte 1M belirteç başına liste fiyatlarını kullanan mevcut durum. Promosyon oranları işaretlenmiştir, çünkü promosyonlar sona erer.

Model Giriş Çıkış Notlar
Qwen 3.8-Max $2.00 $6.00 1M bağlam boyunca sabit; önbellek isabetleri %10
Qwen 3.7-Max $2.50 $7.50 Şu anda %50 indirimli: $1.25/$3.75 (promosyon)
Qwen 3.7-Plus $0.40 $1.60 Şu anda %20 indirimli (promosyon)
Kimi K3 $3.00 $15.00 Önbellek isabetleri $0.30
Claude Opus 5 $5.00 $25.00
GPT-5.6 Terra $2.00 $12.00

Tabloyu okurken:

Fiyat kalite demek değildir ve satıcı kıyaslama tabloları satıcı kıyaslama tablolarıdır. Ancak saf tarife kartı düzeyinde, Qwen 3.8-Max bu sıralamada en ucuz öncü sınıf amiral gemisidir.

Uygulamalı örnekler: gerçek görevler ne kadara mal olur

Liste oranları, görev odaklı matematik olmadan pek bir şey ifade etmez. Üç senaryo, 2$/6$ üzerinden hesaplanmıştır:

Örnek 1: 50K belirteçli bir aracı oturumu

Bir aracı çalıştırması 38.000 giriş belirteci (talimatlar, araç şemaları, araç sonuçları) tüketir ve 12.000 çıktı belirteci üretir:

Şimdi varsayılan xhigh muhakemeyi ekleyelim. Modelin çalıştırma boyunca 8.000 düşünme belirteci harcadığını varsayalım. Çıktı 20.000 belirteç olur: 20.000 × 6$ / 1.000.000 = 0,12$ ve oturum toplamı yaklaşık 0,20$ olur. Bu, yalnızca muhakemeden kaynaklanan %33'lük bir artıştır; bütçelemeden önce neden ölçüm yapmanız gerektiğinin nedeni budur.

Örnek 2: 800K belirteçle uzun belge analizi

Bağlama 800.000 belirteçlik belge yüklersiniz ve 5.000 belirteçlik yapılandırılmış bir özet istersiniz:

Burada sabit kademe işi yapıyor. Bu 800K belirtecin her biri, ilk bin belirteçle aynı olan 2$/1M oranında maliyetlendiriliyor. Kademeli bir modelde, bu tam olarak pahalı kademeyi tetikleyen istek şeklidir.

Örnek 3: Önbelleğe alınmış 100K belirteçlik sistem istemi, günde 50 çağrı

Uygulamanız, günde 50 kez olmak üzere her çağrıda 100.000 belirteçlik sistem istemi, ürün belgeleri ve araç tanımlarını önceden yükler.

Önbellekleme olmadan: Çağrı başına 100.000 × 2$ / 1.000.000 = 0,20$, yani yalnızca önek için günde 10,00$.

Açık önbellekleme ile: oluşturma maliyeti bir kez 100.000 × 2,50$ / 1.000.000 = 0,25$, ardından 49 önbellek isabeti her biri 100.000 × 0,20$ / 1.000.000 = 0,02$, yani 0,98$. Günlük toplam: yaklaşık 1,23$, %88 tasarruf. Bir ayda bu, yaklaşık 300$'a karşılık 40$'ın altında bir rakamdır.

Maliyetleri tahminlerden değil, ölçülen kullanımdan hesaplayın

Üç örnek de varsayılan belirteç sayılarına dayanmaktadır. Gerçek rakamlarınız farklılık gösterecektir ve muhakeme belirteçleri devreye girdiğinde, yalnızca istem uzunluğundan tahmin edemeyeceğiniz şekillerde farklılık göstereceklerdir. Çözüm, ölçüm yapmaktır.

Pratik bir iş akışı: API anahtarınızı alın, uç noktayı ayarlayın (Qwen 3.8 API kılavuzu üç bölgesel temel URL'yi ve hem OpenAI uyumlu hem de Anthropic uyumlu protokolleri kapsar) ve uygulamanızdaki her görev türü için temsili istekler gönderin. Her yanıt, kesin giriş, çıktı ve muhakeme belirteç sayılarını içeren bir usage nesnesi döndürür.

Apidog'da, üç bölgesel temel URL'yi ortam olarak kaydedin, her bir reasoning_effort seviyesinde aynı isteği gönderin ve belirteç kullanımını doğrudan yanıt denetleyicisinden okuyun. Görev türü başına on temsili istek çalıştırın, sayıların ortalamasını alın, 2$/6$ ile çarpın ve ölçülen verilere dayalı bir maliyet modeline sahip olun. Aynı istemi aynı çalışma alanında qwen3.7-max veya Kimi K3'e karşı A/B testi yaparak daha ucuz modelin iş yükünüzde işe yarayıp yaramadığını da görebilirsiniz. Apidog'u ücretsiz indirin ve bir saat içinde görev başına gerçek maliyet numaralarına sahip olabilirsiniz.

Sonuç olarak

Qwen 3.8-Max'in 2$/6$'lık fiyatı, öncü sınıf bir amiral gemisi için agresif bir fiyatlandırmadır: selefinin liste fiyatının altında, GPT-5.6 Terra'nın çıktı oranının yarısı, Opus 5'in bir kısmı ve pazarın çoğunun kademeli olarak yükseldiği tam 1M belirteçlik bir bağlamda sabit. %10 önbellek isabetleri eklendiğinde, uzun bağlamlı, yüksek tekrarlılığa sahip iş yükleri için ekonomi gerçekten güçlü görünüyor.

İki uyarı: varsayılan xhigh muhakemesi, çıktı faturalandırmasını basit tahminlerin üzerine çıkarır ve etrafındaki destekler (3.7-Max %50 indirimli, Singapur ücretsiz kotası) zaman sınırlıdır. Gerçek belirteç kullanımınızı ölçün, reasoning_effort'ı bilerek ayarlayın, böylece tarife kartı az sürpriz içerir.

button

Sıkça sorulan sorular

Qwen 3.8, uzun istemler için daha mı maliyetlidir?

Hayır. Resmi fiyatlandırma, 0 ila 1M belirteci kapsayan tek bir kademe listeler, bu nedenle 900K belirteçlik bir istem, kısa bir istemle aynı 1M giriş başına 2$ oranında faturalandırılır. Bu, Alibaba'nın kendi kataloğundaki Model Studio model listesindeki bazıları da dahil olmak üzere, bağlam uzunluğuyla oranların yükseldiği kademeli modellerden farklıdır.

Qwen 3.8'de düşünme belirteçleri ekstra maliyetli midir?

Ayrı bir düşünme oranı yoktur: düşünme ve düşünmeme modları aynı 2$/6$ üzerinden faturalandırılır. Ancak düşünme belirteçleri, 1M başına 6$ üzerinden çıktı belirteçleri olarak sayılır ve reasoning_effort varsayılan olarak xhigh'dır. Bu nedenle, yoğun muhakeme gerektiren istekler, görünür yanıtın önerdiğinden daha pahalıya mal olur. Basit görevler için çaba seviyesini düşürün ve ne için ödeme yaptığınızı görmek için her yanıttaki usage nesnesini kontrol edin.

Qwen 3.8'i denemek için ücretsiz bir yol var mı?

Evet. Model Studio, yalnızca Singapur bölgesi uç noktasında geçerli olmak üzere 90 gün boyunca geçerli 1M belirteçlik ücretsiz bir kota içerir. Qwen Chat ayrıca tarayıcıda ücretsiz erişim sunar. Her iki yol ve küçük yazılar, Qwen 3.8'i ücretsiz nasıl kullanacağınız makalesinde ele alınmıştır.

Eski “%10 önizleme fiyatlandırması” hala mevcut mu?

Hayır. Bu, Temmuz 2026 basın yayınlarında bildirilen bir önizleme dönemi promosyonuydu; genel kullanıma sunulmasıyla standart 2$/6$ tarife kartı ile değiştirildi. Model Studio fiyatlandırma sayfasını gerçeklik kaynağı olarak kabul edin.

API Tasarım-Öncelikli Yaklaşımı Apidog'da Uygulayın

API'leri oluşturmanın ve kullanmanın daha kolay yolunu keşfedin