Qwen 3.8 vs Qwen 3.7 Max: Gerçekten Ne Değişti?

Qwen 3.8-Max ile 3.7-Max: kıyaslama farkları, 2$/6$ fiyatına karşı %50 indirimli promosyon, görsel girişi ve açık ağırlıklar. Ne zaman yükseltmeli ve ne zaman beklemeli.

INEZA Felin-Michel

INEZA Felin-Michel

3 August 2026

Qwen 3.8 vs Qwen 3.7 Max: Gerçekten Ne Değişti?

Kurumsal İçin Apidog

Şirket İçi (On-Premises) Dağıtım

SSO ve RBAC

SOC 2 Uyumlu

Apidog Enterprise'ı Keşfedin

Alibaba, Qwen 3.8-Max'i 2026 Ağustos başında piyasaya sürdü ve eğer üretimde zaten qwen3.7-max kullanıyorsanız, vermeniz gereken önemli bir karar var. Yeni model, ajanlık ve araştırma kıyaslamalarında büyük kazanımlar sağlıyor, görüntü girişi ekliyor, daha düşük bir liste fiyatıyla piyasaya çıkıyor ve Alibaba'nın selefi için hiç vermediği bir sözle geliyor: açık ağırlıklar.

Ancak karar "yeni model kazanır" kadar basit değil. Qwen 3.7-Max şu anda sınırlı süreli %50 indirimle çalışıyor ve bu onu mutlak anlamda 3.8-Max'ten daha ucuz hale getiriyor. Bazı kıyaslama farkları dramatik. Diğerleri ise neredeyse sıfır. Bu makale, önemli olan her değişikliği ele alıyor, böylece şimdi geçiş yapıp yapmayacağınıza, bekleyip beklemeyeceğinize veya tamamen bir alt kademeye düşüp düşmeyeceğinize karar verebilirsiniz.

Yeni modelin tam resmini önce görmek isterseniz, Qwen 3.8-Max açıklayıcımızla başlayın. Giden amiral gemisi hakkında arka plan bilgisi için, Qwen 3.7'nin neler getirdiğine bakın.

Sayılar öncesinde metodoloji hakkında bir not. Aşağıdaki her kıyaslama figürü, Alibaba'nın resmi Qwen 3.8 sürüm gönderisindeki kendi tablosundan alınmıştır. Bu burada gerçekten faydalıdır: her iki model de aynı satıcı çalıştırmasında değerlendirilmiştir, bu nedenle bağımsız doğrulama henüz beklemede olsa bile farklar içsel olarak tutarlıdır. Çoğu kodlama satırı Claude Code harness üzerinde çalıştırıldı ve birkaç kıyaslama Qwen'in kendi içinde yapıldı.

Kısa versiyon

Ne değişti Qwen 3.7-Max Qwen 3.8-Max
Terminal Bench 2.1 74.5 86.6
SWE-bench Pro 60.6 67.7
PaperBench 64.8 93.0
IFBench 79.1 82.8
GPQA Diamond 92.4 92.6
HLE 41.4 43.6
Liste fiyatı (1M token başına) $2.5 giriş / $7.5 çıkış $2 giriş / $6 çıkış
Mevcut fiyat (promosyon) $1.25 giriş / $3.75 çıkış $2 giriş / $6 çıkış
Görüntü girişi Hayır Evet
Açıklanmış mimari Açıklanmadı Toplam 2.4T, 95B aktif MoE
Açık ağırlıklar Hiç yayınlanmadı "Gelecek hafta" sözü verildi (~10 Ağustos)
Bağlam penceresi 1M token 1M token

Şimdi detaylar.

Kıyaslama farkları: Sıçramanın gerçek olduğu yerler

Başlıca iyileştirmeler ajanlık işleri etrafında toplanmıştır: modelin planladığı, uyguladığı ve kendi kendini düzelttiği uzun ufuklu görevler.

Qwen 3.8-Max Benchmarkları

Terminal Bench 2.1: 74.5'ten 86.6'ya. Bu, terminal tabanlı ajanlık görevlerinde 12 puanlık bir sıçrama ve Qwen'i açıkça geriden gelenden gerçekten rekabetçi bir konuma taşıyor. Aynı tabloda Alibaba, Claude Opus 4.8 ve Fable 5'i her ikisini de 84.6 puanla değerlendiriyor, bu da 3.8-Max'i bu satırda her ikisinin de önüne geçiriyor. GPT-5.6 Sol hala 88.8 ile lider.

SWE-bench Pro: 60.6'dan 67.7'ye. Gerçek dünya yazılım mühendisliği görevlerinde 7 puanlık bir artış. Anlamlı, ancak dürüst olalım: Fable 5 aynı tabloda 80.0'da duruyor, yani bu yetişmek, geçmek değil. Eğer SWE-bench Pro performansı sizin birincil satın alma kriteriniz ise, sınır hala başka bir yerde yaşıyor.

PaperBench: 64.8'den 93.0'a. Tablodaki tek en büyük fark, yapay zeka araştırma makalelerini yeniden üretmede 28 puanlık bir sıçrama. Aynı zamanda 3.8-Max'in en iyi amiral gemisi satırıdır, Alibaba'nın karşılaştırmasındaki her rakibin önünde. İş yükünüz araştırma tekrarını, uzun teknik belgeleri veya çok adımlı bilimsel muhakemeyi içeriyorsa, bu rakam dikkatinizi çekmeli.

IFBench: 79.1'den 82.8'e. Talimat takibi neredeyse 4 puan iyileşiyor. Özellikle, 3.7-Max zaten burada güçlüydü (79.1 aynı çalıştırmada Opus 4.8 ve Fable 5'i yendi), bu nedenle bu, bir zayıflığı düzeltmekten ziyade mevcut bir liderliği genişletiyor.

GPQA Diamond: 92.4'ten 92.6'ya. Neredeyse sabit. Yüksek lisans seviyesindeki bilimsel Soru-Cevap zaten 3.7-Max için doyma noktasına yakındı ve yeni model bunu değiştirmiyor. Eğer iş yükünüz GPQA'ya benziyorsa, yükseltme size kalite açısından hiçbir şey kazandırmaz.

HLE: 41.4'ten 43.6'ya. Humanity's Last Exam 2 puan iyileşiyor ancak hala sınırın gerisinde: Fable 5 aynı tabloda 53.3 ve GPT-5.6 Sol 47.2 puan alıyor. Qwen 3.8-Max birçok yerde farkları kapatıyor. Bu onlardan biri değil.

Desen: ajanlık ve araştırma kıyaslamalarında büyük kazanımlar, talimat takibinde artan kazanımlar, doygun bilgi kıyaslamalarında hareket yok ve en zorlu muhakeme değerlendirmelerinde kalıcı bir boşluk. Koşum takımları ve şirket içi kıyaslamalar hakkındaki ince ayrıntılar da dahil olmak üzere tablonun tamamına daha derinlemesine bir bakış için, Qwen 3.8 kıyaslamaları detaylandırmamıza bakın.

Mimari: Alibaba nihayet sayılarını açıklıyor

Qwen 3.8-Max, Qwen 3.5 mimari temeli üzerine inşa edilmiş, her ileri geçişte 95B aktif parametreye sahip 2.4 trilyon parametreli bir uzmanlar karışımı modelidir. Bu, yaklaşık %4'lük bir aktivasyon oranıdır ve bu, sunucu maliyetleri için önemlidir: 2.4T için değil, 95B için hesaplama ödersiniz.

3.7-Max ile tezat, açıklamanın kendisidir. Alibaba, Qwen 3.7-Max için hiçbir zaman karşılaştırılabilir ölçek rakamları yayınlamadı. Parametre sayıları, aktivasyon oranları, uzman yapılandırması: hepsi açıklanmadı. 3.8-Max ile, Model Studio model dokümantasyonu ve yayın gönderisi mimariyi açıklıyor, bu da kapasite planlamasını ve maliyet modellemesini çok daha az bir tahmine dayalı oyun haline getiriyor.

Açık ağırlıklar yarışındaki bağlam için: Kimi K3 toplam 2.8T ile 104B aktif çalışır. Qwen 3.8-Max her iki eksende de daha küçüktür.

Çok modlu: 3.7-Max'in hiç sahip olmadığı yetenek

Qwen 3.7-Max bir metin modelidir. Qwen 3.8-Max yerel olarak görüntü girişi kabul eder ve Alibaba, Gemini 3.1 Pro ve GPT-5.6 Sol'a karşı çoğu satırda lider olduğu ayrı bir çok modlu kıyaslama tablosu yayınladı.

Alibaba'nın çok modlu tablosundaki öne çıkan skorlar: MathVision 95.2, LogicVista 91.9 ve bilgisayar kullanım görevleri için OSWorld-Verified 86.1. Bu tabloda karşılaştırılabilecek bir 3.7-Max sütunu yoktu, çünkü olamazdı: eski model görüntü kabul etmiyor.

Pratikte bu, daha önce ayrı bir görüntü modeline yönlendirmeniz gereken iş yüklerinin (ekran görüntüsü anlama, belge görüntüleri, UI otomasyonu, grafik çıkarma) artık metin trafiğinizle aynı model kimliği üzerinde çalışabileceği anlamına gelir. Yayın gönderisi ayrıca uzun belge ve video anlama yeteneklerini de gösteriyor, ancak bunlar ayrı API giriş türleri yerine blogda gösterilen yeteneklerdir, bu nedenle belirli durumunuz için API belgelerini kontrol edin.

Fiyatlandırma: Yeni model daha ucuz, ancak şu an değil

Yükseltme matematiğinin ilginçleştiği yer burası.

Qwen 3.8-Max, 1M token başına 2$ giriş / 6$ çıkış fiyatıyla piyasaya sürülüyor, tüm 1M bağlam boyunca tek ve sabit bir kademe. Qwen 3.7-Max ise 2.5$ / 7.5$ listeleniyor. Yani yeni, daha yetenekli model, selefinin liste fiyatını %20 oranında düşürüyor. Bu, bir amiral gemisi nesil değişiminde neredeyse hiç olmaz.

Ancak bir püf noktası var: Alibaba şu anda 3.7-Max için sınırlı süreli %50 promosyon uyguluyor ve bu, etkili fiyatını 1.25$ / 3.75$'a düşürüyor. Bugünkü fiyatlarla, eski model yenisinden %38 daha ucuza mal oluyor. Tüm oranlar resmi Model Studio fiyatlandırma sayfasında bulunabilir.

Akılda tutulması gereken iki şey:

  1. Promosyon sona erebilir. Alibaba bunu sınırlı süreli olarak etiketliyor ve bitiş tarihi yayınlamadı. Eğer mimarinizi 1.25$ / 3.75$ etrafında kurarsanız, bütçe varsayımınızın görünmeyen bir son kullanma tarihi vardır. Liste fiyatlarında, 3.8-Max daha ucuz modeldir.
  2. Düşünce tokenları gerçek faturaları şişirir. Qwen 3.8-Max varsayılan olarak reasoning_effort: xhigh kullanır ve düşünce tokenları çıkış olarak faturalandırılır. İstek başına etkili maliyetiniz, etikette yazandan çok daha yüksek olabilir. Qwen 3.8 fiyatlandırma rehberimiz, önbellek ekonomisini ve görev başına maliyet matematiğini ele alıyor.

Ve eğer Max modellerden hiçbiri bütçenize uymuyorsa, 0.4$ / 1.6$ (şu anda %20 indirimli) fiyatıyla qwen3.7-plus hala değer kademesi olmaya devam ediyor. Plus vs Max karşılaştırması, Plus'ın ne zaman yeterli olduğunu ele alıyor.

Açık ağırlıklar: Max sınıfı için bir ilk

Hiçbir Qwen-Max sınıfı model açık ağırlıklarla gönderilmedi. Qwen 3.7-Max de gönderilmedi ve Alibaba böyle bir şey olacağını asla ima etmedi. Qwen 3.8-Max bu deseni bozuyor: yayın gönderisi, Hugging Face ve ModelScope'ta "gelecek hafta" ağırlıkları vaat ediyor, bu da yaklaşık 10 Ağustos'a işaret ediyor.

Bu yazının yazıldığı an itibarıyla (3 Ağustos 2026), ağırlıklar indirilemiyor. Sözü bir söz olarak kabul edin. Örnek cesaret verici: Kimi K3'ün ağırlıkları lansmandan 11 gün sonra geldi ve Alibaba'nın daha küçük Qwen modelleriyle uzun bir açık ağırlık geçmişi var. Ancak 2.4T parametreli bir indirme, nicelenmiş olsa bile çok düğümlü bir kendi kendine barındırma projesidir, bu nedenle çoğu ekip için pratik etki, rafınızda çalışan bir modelden ziyade üçüncü taraf tarafından barındırılan erişim ve fiyatlandırma baskısı olacaktır.

Eğer açık ağırlıklar tedarik veya uyumluluk hikayeniz için önemliyse, bu tek başına 3.7 ve 3.8 sorusunu çözebilir. Bir modelde (muhtemelen) olacak. Diğerinde asla olmayacak.

Ne değişmedi

Açıkça belirtmekte fayda var, çünkü yükseltme gönderileri genellikle abartma eğilimindedir:

Yükseltmeli misiniz? Üç dürüst yol

Şimdi yükseltin eğer iş yükünüz ajanlık veya araştırma ağırlıklıysa. Terminal Bench (74.5'ten 86.6'ya) ve PaperBench (64.8'den 93.0'a) farkları, üretimde hissedebileceğiniz türden bir sıçramadır ve bonus olarak görüntü girişi ve daha düşük liste fiyatı elde edersiniz. Terminalleri işleten, teknik işleri yeniden üreten veya ekran görüntülerini işleyen ajanlar geliştiriyorsanız, durum açık.

3.7-Max promosyonunu kullanın eğer iş yükünüz sabit bölgelerdeyse. GPQA tarzı bilgi görevleri 0.2 puan değişti. Eğer trafiğiniz Soru-Cevap, özetleme veya genel sohbet ise ve 3.7-Max zaten kalite eşiğinizi karşılıyorsa, 1.25$ / 3.75$, her iki Max modelinin şimdiye kadar sunduğu token başına en iyi anlaşmadır. Promosyon durumunu aylık olarak tekrar kontrol etmek için bir takvim hatırlatıcısı ayarlayın ve geri dönüş fiyatınızın 2$ / 6$ olan 3.8-Max olduğunu, 3.7-Max'in liste fiyatı olmadığını bilin.

Qwen3.7-plus'a düşün eğer fiyat odaklıysanız ve görevleriniz rutin ise. 0.4$ / 1.6$ fiyatıyla, giriş başına 3.8-Max'ten 5 kat daha ucuzdur ve sınıflandırma, çıkarma ve şablonlu üretim için Max sınıfı yetenek genellikle boşa harcanan bir harcamadır.

Karar vermeden önce geçişi test edin

Satıcı kıyaslamaları, dahili olarak tutarlı olsalar bile, bir modelin istemlerinizde nasıl davranacağını tahmin etmez. Bunu çözmenin ucuz yolu, gerçek iş yükünüz üzerinde yan yana bir karşılaştırma yapmaktır.

Apidog'da bunu birkaç dakika içinde kurabilirsiniz: bir koleksiyonu Model Studio'nun OpenAI uyumlu uç noktasına işaret edin, ardından yalnızca model ID değişkeninde farklılık gösteren iki ortam oluşturun, biri qwen3.7-max olarak ayarlı, diğeri qwen3.8-max. Aynı istek setini her ikisine de uygulayın, tek bir tıklamayla ortamları değiştirin ve yanıt görüntüleyicisinden çıktıları, gecikmeyi ve token kullanımını karşılaştırın. Her iki model de aynı API yüzeyini paylaştığı için, tek bir koleksiyon her ikisini de kapsar ve temsil edici üretim istemlerini test senaryoları olarak kaydedebilir ve Alibaba bir güncelleme gönderdiğinde veya promosyon fiyatlandırması değiştiğinde bunları tekrar çalıştırabilirsiniz.

Bu, "yükseltmeli miyiz?" sorusunu bir kıyaslama tartışmasından bir öğleden sonraki kanıt incelemesine dönüştürüyor. Üretim yapılandırmanızı değiştirmeden önce Apidog'u ücretsiz indirin ve kendi trafiğiniz üzerinde karşılaştırmayı yapın.

SSS

Qwen 3.8-Max, Qwen 3.7-Max'ten daha mı ucuz?

Liste fiyatına göre evet: 1M token başına 2$ / 6$ karşılığında 2.5$ / 7.5$. Bugünkü gerçek fiyatlarla hayır: 3.7-Max'in sınırlı süreli %50 promosyonu onu 1.25$ / 3.75$'a getiriyor, bu da 3.8-Max'ten %38 daha ucuz. Promosyonun yayınlanmış bir bitiş tarihi yok. Tam maliyet dökümleri Qwen 3.8 fiyatlandırma rehberimizde bulunmaktadır.

Qwen3.7-max'ten qwen3.8-max'e geçmek için kodumu değiştirmem gerekiyor mu?

Temel kullanım için hayır. Her iki model de aynı OpenAI uyumlu Model Studio uç noktaları aracılığıyla hizmet vermektedir, bu nedenle geçiş bir model ID değişimidir. reasoning_effort'ı açıkça ayarlamak isteyebilirsiniz, çünkü 3.8-Max varsayılan olarak xhigh'a ayarlanmıştır ve düşünce tokenları çıkış olarak faturalandırılır. Eğer görüntü gönderiyorsanız, bu yalnızca 3.8-Max'e özel bir yetenektir ve standart görüntü girişi mesaj formatını gerektirir.

Qwen 3.7-Max açık ağırlıklara sahip mi?

Hayır ve Alibaba'nın bu hatla ilgili geçmişine dayanarak asla sahip olmayacak. Qwen 3.8-Max, açık ağırlıklar vaat edilen ilk Max sınıfı modeldir ve Hugging Face ile ModelScope'ta yaklaşık 10 Ağustos 2026'da beklenmektedir. 3 Ağustos itibarıyla henüz indirilemiyor.

Qwen 3.8-Max şimdi Claude veya GPT'den daha mı iyi?

Satıra bağlıdır ve unutmayın ki bunlar Alibaba'nın kendi rakamlarıdır. Kendi tablolarında, 3.8-Max Terminal Bench 2.1'de Opus 4.8 ve Fable 5'i yener ve PaperBench ile IFBench'te herkesin önündedir. SWE-bench Pro'da Fable 5'in oldukça gerisinde kalır (67.7'ye karşı 80.0) ve HLE'de sınırdaki herkesin gerisindedir. Henüz bağımsız kıyaslama sayıları mevcut değil, bu nedenle nihai kararı üçüncü taraf değerlendirmeleri gelene kadar erteleyin.

API Tasarım-Öncelikli Yaklaşımı Apidog'da Uygulayın

API'leri oluşturmanın ve kullanmanın daha kolay yolunu keşfedin