Alibaba, Qwen 3.8-Max'i resmi olarak 2026 Ağustos başında piyasaya sürdü ve model, sıra dışı bir kombinasyonla geliyor: jeton başına yalnızca 95 milyar parametreyi etkinleştiren 2,4 trilyon parametreli bir Uzmanlar Karışımı (MoE) modeli, tam 1 milyonluk bağlamda milyon jeton başına 2/6 dolarlık sabit bir fiyat ve ağırlıkların bir hafta içinde Hugging Face ve ModelScope'ta herkese açık olacağı sözü. Bu son kısım önemli. Daha önce hiçbir Qwen-Max sınıfı modelin açık ağırlıkları yayınlanmamıştı.
Resmi duyuru, onu bugüne kadarki en yetenekli Qwen olarak adlandırıyor ve satıcının kıyaslama tablosu bunu gerçekten güçlü sonuçlar ve birkaç dürüst kayıpla destekliyor. Bu rehber, Qwen 3.8-Max'in gerçekte ne olduğunu, sayıların ne söylediğini, Kimi K3, Fable 5 ve GPT-5.6 Sol karşısındaki konumunu ve bugün onu çalıştırmak için sahip olduğunuz her yolu açıklıyor. API'ye karşı geliştirme yapmayı planlıyorsanız, model hem OpenAI uyumlu hem de Anthropic uyumlu uç noktalarla birlikte gelir; bu da Apidog gibi protokolü bilen bir istemciyi her iki şekli de aynı anahtarla test etmek için kullanışlı kılar.
Qwen 3.8-Max'e bir bakış
| Özellik | Qwen 3.8-Max |
|---|---|
| Geliştirici | Alibaba (Qwen ekibi) |
| Piyasaya Sürülme | Ağustos 2026 başı (Model Studio'da genel erişim, 3 Ağustos) |
| Mimari | Qwen 3.5 temeli üzerine inşa edilmiş MoE |
| Toplam parametreler | 2.4T |
| Aktif parametreler | 95B (~%4 aktivasyon) |
| Bağlam penceresi | 1.000.000 jeton |
| Maksimum çıktı | 65.536 jeton |
| Modaliteler | Metin + görüntü girişi, metin çıktısı |
| Akıl yürütme kontrolleri | reasoning_effort: çok yüksek (varsayılan), orta, düşük |
| API model kimliği | qwen3.8-max |
| Fiyatlandırma | 1 milyon jeton başına 2 dolar giriş / 6 dolar çıktı, tüm bağlamda sabit |
| Açık ağırlıklar | Gelecek hafta için söz verildi (~10 Ağustos); 2026 Ağustos başı itibarıyla henüz indirilemez durumda |
| API protokolleri | OpenAI uyumlu ve Anthropic uyumlu |
Bu tablodaki her şey Alibaba'nın kendi yayın materyallerinden ve Model Studio fiyatlandırma sayfasından alınmıştır. Şimdi detaylara geçelim.
Qwen 3.8-Max nedir
Qwen 3.8-Max, Alibaba'nın Qwen ailesinin yeni amiral gemisidir ve Qwen 3.5 mimari temeli üzerine inşa edilmiştir. Sıralamanın en üstünde Qwen3.7-Max'in yerini alıyor ve satıcı tablosu selefine göre anlamlı sıçramalar gösteriyor: Terminal Bench 2.1, 74.5'ten 86.6'ya, PaperBench ise 64.8'den 93.0'a yükseldi. Eski modelden geçiş yapıp yapmamaya karar veriyorsanız, farklar Qwen 3.8 ile Qwen 3.7 Max karşılaştırmamızda açıklanmıştır.

Manşet özellik, parametre dağılımıdır. 2.4T toplam parametre kulağa çok büyük geliyor ve öyle de, ancak MoE tasarımı ileri geçiş başına yalnızca 95B parametreyi etkinleştiriyor. Yaklaşık %4'lük bu aktivasyon oranı, Alibaba'nın bu kadar büyük bir modeli milyon jeton başına 2/6 dolara sunabilmesinin nedenidir. Kıyaslama için, Kimi K3 toplamda 2.8T ve 104B aktif parametre ile çalışır, bu yüzden Qwen 3.8-Max her iki açıdan da daha küçük bir modeldir.
Giriş tarafında, model API aracılığıyla metin ve görüntüleri kabul eder. Alibaba'nın blogu ayrıca uzun belge anlama (200+ sayfalık PDF'ler) ve bellek grafikleri olarak adlandırdığı yolla 100 saatlik video anlama yeteneklerini de gösteriyor. Bunları ayrı API giriş türleri yerine, blogda gösterilen yetenekler olarak değerlendirin; yayınlanan API yapılandırmaları metin ve görüntüyü giriş modaliteleri olarak listeliyor.
Akıl yürütme, reasoning_effort parametresi aracılığıyla üç düzeyde kontrol edilir: çok yüksek (varsayılan), orta ve düşük. Ayrıca enable_thinking ve varsayılan olarak korunmuş olan preserve_thinking de mevcuttur. Erken öğrenmeye değer bir fiyatlandırma detayı: düşünme ve düşünmeme modları aynı oranda faturalandırılır, ancak düşünme jetonları çıktı olarak sayılır, bu nedenle çok yüksek varsayılanındaki gerçek faturalar, basit bir etiket hesaplamasından daha yüksek çıkar.
İlk açık ağırlıklı Max sınıfı Qwen
Bu, sürümün en büyük stratejik hamlesidir. Alibaba yıllar içinde birçok Qwen modelini açık kaynaklı hale getirdi, ancak Max katmanını asla. Qwen 3.8-Max bu düzeni bozuyor: şirket, ağırlıkların Hugging Face ve ModelScope'a "gelecek hafta" ulaşacağını söylüyor, bu da yaklaşık 10 Ağustos'a denk geliyor.
İki uyarı, açıkça belirtilmiştir:
- Ağırlıklar henüz indirilemez durumda değil. 2026 Ağustos başı itibarıyla, bu bir sözden ibaret. Kimi K3 burada yakın zamanda bir emsal oluşturdu: ağırlıkları lansmandan 11 gün sonra geldi, bu yüzden kısa bir gecikme şaşırtıcı olmaz.
- 2.4T'lik bir modeli kendi kendine barındırmak çok düğümlü bir projedir. Agresif bir şekilde nicemlenmiş olsa bile, bu bir iş istasyonunda çalıştırabileceğiniz bir şey değildir. Çoğu ekip için "açık ağırlıklar", yerel bir dağıtımdan ziyade üçüncü taraf sağlayıcılar aracılığıyla daha ucuz barındırılan erişim anlamına gelecektir.
Qwen 3.8-Max'e olan ilginiz çoğunlukla liste fiyatını ödememekle ilgiliyse, mevcut gerçekçi yollar Qwen Chat ve Model Studio ücretsiz kotasıdır; her ikisi de Qwen 3.8'i ücretsiz kullanma rehberimizde ele alınmıştır.
Kıyaslamaların gösterdikleri, kayıplar da dahil
Alibaba, Qwen 3.8-Max'i Claude Opus 4.8, Fable 5, GPT-5.6 Sol ve Qwen3.7-Max ile karşılaştıran tam bir kıyaslama tablosu yayınladı. Rakamları vermeden önce iki açıklama: bunlar satıcı tarafından yürütülen sonuçlardır ve kodlama sıralarının çoğu tüm modeller için Claude Code donanımı kullanılarak yürütülmüştür. Birkaç kıyaslama (QwenSWEBench, QwenQoderBench, CoWorkBench, RecreationBench) Alibaba'nın kendi dahili çalışmalarıdır. Yazım sırasında Artificial Analysis gibi kaynaklardan bağımsız veri bulunmamaktadır.
Bu çerçevede, Alibaba'nın tablosundaki dikkat çeken satırlar:
Kazandığı yerler:
- PaperBench: 93.0, tek en iyi amiral gemisi sonucu, GPT-5.6 Sol (90.5), Fable 5 (88.8) ve Opus 4.8'in (80.3) önünde
- IFBench: 82.8, satırdaki en yüksek puan, Sol'un 72.7'sinin önünde
- Terminal Bench 2.1: 86.6, Opus 4.8 ve Fable 5'i (her ikisi de 84.6) geride bırakarak, sadece Sol'un (88.8) gerisinde kalıyor
- Çok modluluk en güçlü yönü: MathVision 95.2, LogicVista 91.9, OSWorld-Verified 86.1 ve tablodaki hemen hemen her şeyi geride bırakan OCR satırları
Kaybettiği yerler:
- SWE-bench Pro: 67.7, Fable 5'in 80.0'ının oldukça gerisinde ve Opus 4.8'in 69.2'sinin biraz gerisinde (Sol'un 64.6'sını yener)
- HLE: 43.6, satırdaki en zayıf amiral gemisi puanı; Fable 5 53.3, Sol 47.2 ve Opus 4.8 45.7 puanları kaydetti
Dürüst özet: Alibaba'nın kendi rakamlarına göre, Qwen 3.8-Max, Opus 4.8'i çeşitli ajan tabanlı satırlarda geride bırakırken, çoğu temel kodlama işinde Fable 5'in gerisinde kalıyor ve çok modluluk ile belge zekası alanlarında büyük başarılar elde ediyor. GPQA Diamond'da 92.6 puanla Fable 5 ile berabere, Sol'un 94.1'inin hemen gerisinde yer alıyor, bu da saf bilimsel akıl yürütmenin rekabetçi olduğunu gösteriyor. Donanımın ayrıntıları ve bağımsız doğrulamalar dahil olmak üzere tablonun tam incelemesi için Qwen 3.8 kıyaslama analizimize bakın.
Alibaba ayrıca bir dizi tanıtım çalışması yayınladı: genel bir depoda 16 günlük otonom kodlama oturumu (265 commit, 127 pull request), orijinal makalenin AIME24 sonucunu geride bırakan bir makale çoğaltma çalışması ve 24 saat içinde 526 insan ekibinden 458'ini geride bırakan bir Tianchi yarışması girişi. Bunlar satıcının kendi demoları olduğundan, kontrollü değerlendirmeler yerine yetenek reklamları olarak okuyun. Donanım kurulumlarının nasıl yeniden üretileceği de dahil olmak üzere kodlama hikayesi, kodlama için Qwen 3.8 adlı yazımızda özel olarak ele alınmıştır.
Kimi K3, Fable 5 ve GPT-5.6 Sol karşısında nerede duruyor
Kimi K3'e Karşı. Bu doğal bir rekabet: iki Çin laboratuvarı, iki açık ağırlıklı dev MoE modeli, haftalar arayla piyasaya sürüldü. K3 daha büyük (2.8T toplam, 104B aktif vs 2.4T/95B), Qwen çok modlu iken K3 yalnızca metin tabanlı ve K3'ün ağırlıkları zaten yayınlanmışken Qwen'inkiler hala bir sözden ibaret. Fiyatlandırma da keskin bir şekilde ayrılıyor: K3, 0.30 dolarlık önbellek isabetleriyle 3 dolar giriş/15 dolar çıktı ücreti alırken, Qwen'in sabit 2 dolar/6 dolar fiyatı var. Henüz doğrudan bir karşılaştırma değerlendirmesi mevcut değil; her satıcı kendi tablosunu yayınladı. Onları Qwen 3.8 ile Kimi K3 karşılaştırmamızda satır satır karşılaştırıyoruz ve Moonshot'ın modeline yeni başlıyorsanız, Kimi K3 nedir ile başlayın.
Fable 5'e Karşı. Anthropic'in amiral gemisi, kodlama kıyaslama ölçütü olmaya devam ediyor ve Qwen 3.8-Max onu yenemiyor: Alibaba'nın kendi tablosuna göre SWE-bench Pro (67.7'ye karşı 80.0) ve HLE (43.6'ya karşı 53.3) bariz boşluklar. Qwen'in bunun yerine sunduğu ise fiyat (öncü oranların küçük bir kısmı), 1M bağlam, yolda olan açık ağırlıklar ve daha güçlü çok modlu satırlar.
GPT-5.6 Sol'e Karşı. Sol, Terminal Bench'i (88.8'e karşı 86.6), GPQA'yı (94.1'e karşı 92.6) ve HLE'yi (47.2'ye karşı 43.6) alırken, Qwen 3.8-Max PaperBench'i (93.0'a karşı 90.5) ve IFBench'i (82.8'e karşı 72.7) kazanıyor. Fiyat açısından, Qwen'in 2 dolar/6 dolar fiyatı, GPT-5.6 Terra'nın çıktıda 2 dolar/12 dolar fiyatını düşürüyor ve Sol düzey erişim hala daha pahalıya mal oluyor.
Bir diğer referans: Claude Opus 5'in liste fiyatı 5 dolar/25 dolar. Satıcı tabloları hakkında ne düşünürseniz düşünün, Alibaba amiral gemisini yüksek hacimli iş yükleri için denklemi değiştiren bir seviyede fiyatlandırıyor.
Fiyatlandırma: 2$/6$, 1M jeton boyunca sabit
Fiyatlandırma, tek bir cümlede belirtilebilecek kadar basittir: milyon giriş jetonu başına 2 dolar, milyon çıktı jetonu başına 6 dolar, sıfır jetondan 1 milyon bağlam sınırına kadar sabit bir katman, düşünme modu olsun ya da olmasın.
Sabit katman sıra dışı bir durumdur. Çoğu uzun bağlam modeli, isteminiz büyüdükçe fiyatları artırır; Qwen 3.8-Max bunu yapmaz. Ayrıca Qwen3.7-Max'in 2.5 dolar/7.5 dolarlık liste fiyatından daha ucuz piyasaya sürülüyor, ancak bu eski model şu anda %50 indirimle (1.25 dolar/3.75 dolar) çalışıyor ve bu da onu uygun fiyatlı bir seçenek olarak alakalı kılıyor.
Bağlam önbellekleme, tekrarlayan önek iş yüklerini tatlandırır: önbellek isabetleri giriş oranının %10'u üzerinden faturalandırılır ve açık önbellek oluşturma %125 maliyetlidir. Ayrıca, deneme sürüşleri için ücretsiz bir kota (1M jeton, sadece Singapur bölgesi, 90 gün geçerli) bulunmaktadır. Her görev için örnekler ve düşünme jetonu tuzağının nicelendirilmesi dahil olmak üzere tam maliyet dökümü, Qwen 3.8 fiyatlandırma rehberimizde yer almaktadır.
Qwen 3.8-Max'e nasıl erişilir
Erişim matrisi, tipik bir lansmandan daha geniştir. Beş yol:
1. Qwen Sohbet. Tüketici uygulaması, API anahtarına gerek yok. Fikir edinmenin en hızlı yolu.
2. Alibaba Cloud Model Studio (DashScope) üzerindeki API. home.qwencloud.com adresinden bir anahtar alın, DASHSCOPE_API_KEY'i ayarlayın ve OpenAI uyumlu sohbet tamamlama veya yanıt uç noktaları aracılığıyla qwen3.8-max model kimliğini çağırın. Üç bölgesel temel URL aktif: Pekin (dashscope.aliyuncs.com/compatible-mode/v1), Singapur (dashscope-intl.aliyuncs.com/compatible-mode/v1) ve ABD-Virginia (dashscope-us.aliyuncs.com/compatible-mode/v1). Model Studio modeller sayfası, onu önerilen yığının en üstünde listeler.
3. Anthropic uyumlu uç nokta. Bu gerçekten sıra dışı olan: https://dashscope-intl.aliyuncs.com/apps/anthropic, Anthropic Mesajlar protokolünü konuşur, bu nedenle Claude için oluşturulmuş araçlar, iki ortam değişkeniyle Qwen'i işaret edebilir.
4. Kodlama donanımları. Alibaba, beş ajan için resmi yapılandırmalar yayınladı: Claude Code (ANTHROPIC_BASE_URL artı ANTHROPIC_MODEL=qwen3.8-max aracılığıyla), Codex, Qoder, Qwen Code ve OpenClaw. Alibaba'nın kodlama kıyaslamalarının çoğunu Claude Code donanımı içinde çalıştırdığını belirtmekte fayda var, bu nedenle yayınladığı yapılandırma kendi rakamlarının arkasındaki yapılandırmadır.
5. Yakında açık ağırlıklar. Hugging Face ve ModelScope için gelecek hafta söz verildi, 2026 Ağustos başı itibarıyla henüz indirilemez durumda.
2'den 4'e kadar olan rotaların kurulum detayları, kopyala-yapıştır Python ve cURL ile birlikte Qwen 3.8 API rehberimizde yer almaktadır.
Çift protokol API'sini test etme
Aynı modelin iki farklı protokol şeklinde yanıt vermesi, pratik bir test sorunu yaratır: isteğiniz her ikisinde de aynı şekilde mi davranıyor? İşte burada bir API istemcisi değerini gösterir. Apidog'da, üç bölgesel temel URL'yi ortam olarak kaydedebilir ve istekleri düzenlemeden bölgeler arasında geçiş yapabilir, aynı istemi OpenAI uyumlu uç nokta ve Anthropic protokol uç noktası aracılığıyla yan yana gönderebilir ve nihai yanıttan önce reasoning_content deltalarının geldiğini görmek için SSE akışını inceleyebilirsiniz. Bu son kısım, varsayılan çok yüksek düşünme modunun gerçekte ne kadar düşünme ürettiğini doğrulamak için kullanışlıdır, çünkü bu jetonlar faturanıza çıktı olarak yansır. Uç noktaları bağladığınızda takip etmek isterseniz Apidog'u ücretsiz indirin; aynı çalışma alanı, bir iş yükünü taahhüt etmeden önce qwen3.8-max'i qwen3.7-max veya kimi-k3 ile aynı istemlerde A/B testi yapmayı da kolaylaştırır.
Qwen 3.8-Max, ürün yelpazesinde nerede yer alıyor
Daha geniş aileyi haritalandırıyorsanız, Qwen 3.8-Max artık Qwen3.7-Max ve artı katman modellerinin üzerinde yer alıyor ve en iyi Qwen modelleri rehberimiz, hangi katmanın hangi iş yüküne uyduğunu kapsıyor. Kısa versiyonu: Çok modlu ve ajan tabanlı tavan gerektiğinde 3.8-Max tercih edilir, kampanya süresince %50 indirimli 3.7-Max uygun fiyatlı amiral gemisidir ve artı modeller rutin görevler için ucuz iş atları olmaya devam eder.
Sıkça Sorulan Sorular
Qwen 3.8 açık kaynak mı?
Henüz değil, ama çok yakın. Alibaba, 2026 Ağustos başındaki lansman itibarıyla ağırlıkların "gelecek hafta" Hugging Face ve ModelScope'a geleceğini vaat etti, bu da onu ilk açık ağırlıklı Max sınıfı Qwen yapacak. Yazım sırasında hiçbir şey indirilebilir durumda değil. O zamana kadar erişim API veya Qwen Sohbet aracılığıyla sağlanır; ücretsiz yollar için Qwen 3.8'i ücretsiz kullanma kılavuzumuza bakın.
Qwen 3.8-Max ne kadar?
Milyon giriş jetonu başına 2 dolar ve milyon çıktı jetonu başına 6 dolar, tüm 1M bağlam boyunca tek ve sabit bir katmanda. Önbellek isabetleri giriş ücretinin %10'u üzerinden faturalandırılır. Düşünme jetonları çıktı olarak faturalandırılır ve varsayılan akıl yürütme çabası çok yüksektir, bu nedenle akıl yürütme ağırlıklı işler için etiket fiyatının üzerinde bütçe ayırın.
Qwen 3.8-Max, Kimi K3'ten daha mı iyi?
Henüz doğrudan bir karşılaştırmalı değerlendirme yok; her iki satıcı da kendi tablolarını yayınladı. Kağıt üzerinde, Qwen 3.8-Max daha küçük (2.4T/95B aktif vs 2.8T/104B), K3 yalnızca metin tabanlıyken çok modlu ve çıktıda daha ucuz (6$ vs 15$). K3'ün bugünkü avantajı ise ağırlıklarının zaten herkese açık olmasıdır.
Qwen 3.8-Max'i Claude Code'da kullanabilir miyim?
Evet. Alibaba resmi bir yapılandırma yayınladı: ANTHROPIC_BASE_URL'yi Anthropic uyumlu DashScope uç noktasına yönlendirin ve ANTHROPIC_MODEL=qwen3.8-max olarak ayarlayın. Codex, Qoder, Qwen Code ve OpenClaw da resmi yapılandırmalara sahiptir.
Sırada ne var
Qwen 3.8-Max, bir basın önizlemesi değil, gerçek bir amiral gemisi sürümüdür: üç API bölgesinde genel erişim, yayınlanmış fiyatlandırma, kazanma ve kaybetmelerle dolu tam (satıcı tarafından yürütülen) bir kıyaslama tablosu ve açık ağırlıklar günler içinde gelecek. Dürüst okuma şudur ki, temel kodlama konusunda Fable 5'i tahtından etmiyor, ancak birkaç ajan tabanlı satırda Opus 4.8'i yeniyor, belge ve çok modlu çalışmalarda önde gidiyor ve tüm bunları yaparken 2$/6$ maliyetle sunuluyor.
Mantıklı hareket, onu herhangi birinin tablosuna göre değil, kendi iş yükünüze göre test etmektir. Ücretsiz kotayı alın, her iki protokol uç noktasını da bağlayın ve gerçekten çalıştırdığınız istemlerdeki çıktıları karşılaştırın. API kurulum rehberimizle başlayın ve ağırlıkların programa uygun olup olmadığını görmek için 10 Ağustos civarında tekrar kontrol edin.
