Qwen 3.8 vs Kimi K3: Çin'in İki Dev Açık Kaynak Yapay Zeka Modeli Karşılaştırması

Qwen 3.8-Max ile Kimi K3: parametreler, açık ağırlıklar, modalite, fiyatlandırma ve harness desteği karşılaştırması, satıcı tarafından yürütülen kıyaslamalara dürüst bir yaklaşımla.

INEZA Felin-Michel

INEZA Felin-Michel

3 August 2026

Qwen 3.8 vs Kimi K3: Çin'in İki Dev Açık Kaynak Yapay Zeka Modeli Karşılaştırması

Kurumsal İçin Apidog

Şirket İçi (On-Premises) Dağıtım

SSO ve RBAC

SOC 2 Uyumlu

Apidog Enterprise'ı Keşfedin

Temmuz 2026, açık ağırlıklı öncü modeller için iki atlı bir aya dönüştü ve her iki at da Çin'den çıktı. Moonshot AI, Kimi K3'ü 16 Temmuz'da piyasaya sürdü. Üç gün sonra, Alibaba Qwen 3.8-Max'in ön gösterimini yaptı, ardından Ağustos başında genel kullanıma sundu. Her ikisi de trilyon parametreli uzman karışımı modellerdir. Her ikisi de açık ağırlıklar vaat ediyor (veya sunuyor). Her ikisi de Claude Kod tarzı ajan donanımlarına takılabiliyor. Ve her ikisi de ABD öncü laboratuvarlarının fiyatlarını düşürüyor.

Yüzeydeki benzerlik, gerçek farklılıkları gizliyor: bugün ne indirebileceğinizde, modellerin ne görebildiğinde ve bir aylık yoğun kullanımın maliyetinde. Bu karşılaştırma, 3 Ağustos 2026 itibarıyla doğrulayabileceğiniz her ekseni ele almaktadır. Alibaba'nın yeni amiral gemisinin tam özellik dökümü için, Qwen 3.8-Max açıklayıcımızdan başlayın ve geri dönün.

button

Başlamadan önce küçük bir dürüstlük notu: bu iki modelin henüz bağımsız bir karşılaştırmalı testi bulunmamaktadır. Bu makaledeki her sayı, bir satıcının kendi tablosundan gelmektedir ve her sayının kime ait olduğunu belirtmekteyiz. Karşılaştırma bölümünü kesin değil, yol gösterici olarak değerlendirin.

Zaman çizelgesi: kim ne zaman neyi piyasaya sürdü

Burada çıkış sırası normalden daha fazla önem taşıyor, çünkü “açık ağırlıklar” şu anda her model için farklı bir anlama geliyor.

Kimi K3, 16 Temmuz 2026'da piyasaya sürüldü. Moonshot, lansmanda açık ağırlıklar sözü verdi ve 11 gün sonra bu sözünü yerine getirdi: ağırlıklar 27 Temmuz'da 594 GB MXFP4 sürümü olarak Hugging Face'e ulaştı. Bugün itibarıyla K3'ü indirebilir, daha da nicemleyebilir ve kendi donanımınızda çalıştırabilirsiniz. Bu bir söz değil. Bu gerçekleşti.

Qwen 3.8-Max, 19 Temmuz'da ön gösterimi yapıldı ve resmi Qwen çıkış gönderisine göre Ağustos başında Alibaba Cloud Model Studio'da genel kullanıma sunuldu. Ağırlıklar Hugging Face ve ModelScope için “gelecek hafta” sözü verildi, bu da yaklaşık 10 Ağustos'a denk geliyor. 3 Ağustos 2026 itibarıyla indirilebilir değiller. K3'ün lansman ve ağırlıklar arasındaki 11 günlük boşluğu, bu sürecin normal olduğunu gösteriyor, ancak bugün bu modellerden yalnızca biri pratikte açık.

Kendi kendine barındırma sizin belirleyici faktörünüzse, bu tek gerçek karşılaştırmayı erken bitirebilir.

Parametreler: iki trilyon ölçekli MoE modeli, biri daha yalın

Her iki model de seyrek uzman karışımı tasarımlardır, bu da başlıktaki parametre sayısının ve jeton başına hesaplama maliyetinin çok farklı sayılar olduğu anlamına gelir.

Özellik Qwen 3.8-Max Kimi K3
Toplam parametre 2.4T 2.8T
Jeton başına aktif parametre 95B 104B
Aktivasyon oranı ~4% ~3.7%
Mimari temel Qwen 3.5 temelli, MoE MoE
Açık ağırlık formatı Vaat edildi (~10 Ağustos) MXFP4, Hugging Face'te 594 GB

Qwen 3.8-Max, her iki açıdan da daha küçük bir modeldir: K3'ten 400 milyar daha az toplam parametre ve 9 milyar daha az aktif parametreye sahiptir. Hiçbir fark dramatik değildir ve aktif parametre sayıları yeteneğe doğrusal olarak dönüşmez. Dönüştükleri şey, hizmet maliyetidir. Jeton başına 95 milyar parametre etkinleştiren bir model, diğer her şey eşit olduğunda 104 milyar etkinleştiren bir modelden daha ölçekli çalıştırması daha ucuzdur ve bu fark aşağıdaki API fiyatlandırmasında görülmektedir.

Kendi kendine barındıranlar için, daha ilgili sayı K3'ün MXFP4 hassasiyetinde 594 GB'lık indirme boyutudur. Bu, uzun bağlamda KV önbelleğini hesaba katmadan bile çok düğümlü bir alandır. Qwen 3.8-Max'in toplam 2.4T ile dosyaları göründüğünde benzer bir ağırlık sınıfına düşmesini bekleyin. Çoğu ekip her iki model için de barındırılan uç noktaları kullanacak ve kendi kendine barındırmayı uyumluluk veya araştırma durumları için saklayacaktır.

Bugün açıklık: canlı ağırlıklar ve eski bir söz

Bu eksen kendi bölümünü hak ediyor, çünkü her iki tarafın pazarlaması “açık” derken gerçekler farklıdır.

Kimi K3'ün ağırlıkları herkese açıktır. Depoyu doğrulayabilir, lisansı kontrol edebilir ve dosyaları hemen çekebilirsiniz. Bu, gerçek açıklığın sağladığı her şeyi getirir: üçüncü taraf barındırma, topluluk nicemlemeleri, ince ayar ve karşılaştırdığınız modelin sizden habersiz değiştirilemeyeceğine dair güvence.

Qwen 3.8-Max, açık ağırlıklarla piyasaya sürülen ilk Qwen-Max sınıfı model olacak, bu, Alibaba'nın önceki tüm Max seviye modelleri sadece API olarak tutmasının ardından stratejisinde gerçek bir değişiklik anlamına geliyor. Ancak bir ilk, ancak gerçekleştiğinde bir ilktir. Hugging Face deposu canlı olana kadar, Qwen 3.8-Max, ekli bir duyuruya sahip bir API modelidir.

Bu ekseni bugün K3 için puanlayın, 10 Ağustos civarında tekrar kontrol etmek üzere bir not alın. Alibaba sözünü yerine getirirse, bu eksen berabere kalır ve karşılaştırma lisans koşullarına ve nicemleme kalitesine kayar.

Modalite: Qwen görüntüleri görür, K3 metin okur

Burada fark diğer yönde ilerliyor ve yakın bile değil.

Qwen 3.8-Max, resmi model yapılandırmalarına ("input_modalities": ["text", "image"]) göre metin ve görüntü girişi kabul eder. Alibaba'nın lansman gönderisi daha da ileri gidiyor, 200'den fazla sayfalık PDF'lerde uzun belge anlama ve bellek grafikleri aracılığıyla 100 saatlik video anlama yeteneğini gösteriyor; bunları blog demoları olarak ele alın, belgelenmiş API giriş türleri olarak değil. Ancak görüntü girişi gerçek ve bugün API'de mevcut. Alibaba'nın satıcı karşılaştırmaları buna yöneliyor: çok modlu tablo (MathVision 95.2, LogicVista 91.9, OSWorld-Verified 86.1, güçlü OCR satırları), Qwen 3.8-Max'in en tek taraflı sayılarını kaydettiği yerdir.

Kimi K3 bir metin modelidir. İş yükünüz ekran görüntüleri, taranmış belgeler, kullanıcı arayüzü anlama veya herhangi bir görüşe dayalı ajan görevi içeriyorsa, K3, tüm yapıştırma kodu ve ekstra gecikme ile birlikte boru hattına ayrı bir görüş modelinin eklenmesini gerektirir.

Sadece metin tabanlı kodlama ve ajan çalışması için bu eksen önemsizdir. Belge zekası ve bilgisayar kullanımlı ajanlar için belirleyicidir.

Bağlam, çıktı ve API yüzeyi

Qwen 3.8-Max, 1.000.000 jetonluk bir bağlam penceresini tek bir düz katman olarak sunar, maksimum 65.536 jeton çıktı ile. Muhakeme, bir reasoning_effort parametresiyle (varsayılan olarak xhigh, medium ve low seçenekleriyle) kontrol edilir ve düşünce çıktısı varsayılan olarak korunur. Özellikle, düşünce ve düşünce dışı modlar aynı oranda faturalandırılır.

Erişim, Alibaba Cloud Model Studio aracılığıyla üç bölgesel temel URL (Pekin, Singapur, ABD-Virginia) ve alışılmadık bir şekilde tek bir platformda iki protokol şekliyle gerçekleşir: OpenAI uyumlu bir uç nokta ve Anthropic uyumlu bir uç nokta. Bu çift protokollü yüzey, Qwen 3.8-Max'in Claude Code'a yalnızca ANTHROPIC_BASE_URL ve ANTHROPIC_MODEL=qwen3.8-max ile entegre olmasının nedenidir. Tüm ürün yelpazesi ve bölgesel kullanılabilirlik Model Studio modeller sayfasında belgelenmiştir; bölgeler arasında çalışıyorsanız, Apidog gibi araçlar, her temel URL'yi bir ortam olarak saklamanıza ve istekleri düzenlemeden aralarında geçiş yapmanıza olanak tanır.

Kimi K3 de Anthropic protokolünü konuşur ve Claude Kod tarzı donanımlara takılır; bu da tam olarak bu iki modelin aynı koltuk için rekabet etmesinin nedenidir: "mevcut ajan donanımınızı daha ucuz bir öncü modele yöneltin" koltuğu. K3'ün uç nokta detayları ve güncel limitleri için, lansmandan bu yana değişmiş olabilecek sayılara güvenmek yerine Kimi K3 açıklayıcımıza bakın.

Fiyatlandırma: düz ve basit vs ucuz giriş, pahalı çıkış

İşte yayınlanan milyon jeton başına oranlar:

Oran Qwen 3.8-Max Kimi K3
Giriş $2.00 $3.00
Çıkış $6.00 $15.00
Önbellek isabetli giriş $0.20 (girişin %10'u) $0.30
Katmanlandırma Tam 1M bağlam boyunca düz Moonshot'un yayınlanmış tarifesine göre

Resmi Model Studio fiyatlandırma sayfasına göre Qwen 3.8-Max, jeton sıfırdan bir milyona kadar, düşünme olsun olmasın, düz bir şekilde 2 dolar giriş ve 6 dolar çıkış maliyetine sahiptir. Açık önbellek oluşturma, girişin %125'i oranında, önbellek isabetleri ise %10'u oranında faturalandırılır. Ayrıca ücretsiz bir kota da bulunmaktadır: 1 milyon jeton, yalnızca Singapur bölgesinde, 90 gün geçerli.

K3'ün oranları önbellek isabetleri için milyon başına 0,30 dolar, milyon giriş başına 3 dolar ve milyon çıkış başına 15 dolardır.

Karşılaştırma tek bir sayıdan ibaret değil. İyi önbellek disiplinine sahip (uzun sistem istemleri, tekrarlanan belge bağlamı) giriş ağırlıklı iş yüklerinde, iki model etiket fiyatından daha yakın durur: önbelleğe alınmış megajeton başına 0,20 dolar ve 0,30 dolar dar bir farktır. Çıkış ağırlıklı iş yüklerinde ise fark geniştir: K3'ün 15 dolarlık çıkış oranı, Qwen'in 6 dolarının 2,5 katıdır. Çok fazla muhakeme ve kod üreten ajan döngüleri, kağıt üzerinde Qwen 3.8-Max'i destekleyen, çıkış ağırlıklı olma eğilimindedir.

Qwen için özel olarak geçerli bir uyarı: reasoning_effort varsayılan olarak xhigh'dır ve düşünce jetonları çıktı olarak faturalandırılır. Gerçek faturalar, saf jeton-giriş-jeton-çıkış tahminlerinin öngördüğünden daha yüksek olacaktır. Taahhütte bulunmadan önce bunu modellemek isterseniz, Qwen 3.8 fiyatlandırma dökümümüz görev başına maliyet örnekleriyle çalışır.

Karşılaştırmalar: iki satıcı tablosu, hakem yok

Bu, bu iki modelin çoğu karşılaştırmasının yanlış gittiği yerdir, bu yüzden neyin mevcut olduğu konusunda kesin olalım.

Mevcut olan: Alibaba, Qwen 3.8-Max için Claude Opus 4.8, Fable 5, GPT-5.6 Sol ve Qwen 3.7-Max'e karşı bir karşılaştırma tablosu yayınladı. Moonshot, Kimi K3 için benzer bir öncü sıralamaya karşı kendi lansman tablosunu yayınladı. Her ikisi de satıcı tarafından yürütülmektedir.

Mevcut olmayan: Qwen 3.8-Max ve Kimi K3'ü aynı donanım altında aynı tabloya koyan herhangi bir bağımsız değerlendirme. Yazıldığı sırada Qwen 3.8-Max için herhangi bir Yapay Analiz sayısı mevcut değildi. İki satıcı birbirlerinin modellerini karşılaştırmadı.

Bu çerçeveyle, işte her tarafın kendi çalışmasında iddia ettikleri.

Alibaba'nın tablosundan (Alibaba'nın çalışması, büyük ölçüde Claude Code donanımı aracılığıyla yürütüldü, bu Alibaba'nın kendisinin açıkladığı bir detay):

Benchmark Qwen 3.8-Max Claude Opus 4.8 Fable 5 GPT-5.6 Sol
Terminal Bench 2.1 86.6 84.6 84.6 88.8
SWE-bench Pro 67.7 69.2 80.0 64.6
PaperBench 93.0 80.3 88.8 90.5
GPQA Diamond 92.6 92.0 92.6 94.1
HLE 43.6 45.7 53.3 47.2

Alibaba'nın kendi sayıları net kayıpları içeriyor: Qwen 3.8-Max, SWE-bench Pro'da Fable 5'in çok gerisinde kalıyor ve HLE'de listelenen herkesin gerisinde. Öne çıkan satırları PaperBench, talimat takip etme (IFBench 82.8) ve çok modlu tarama. Diğer birçok öne çıkan sonuç, Alibaba'nın şirket içi karşılaştırmalarını (QwenSWEBench, CoWorkBench ve diğerleri) kullanır ve bunlar kimseye karşı çapraz referans verilemez.

Moonshot tarafından ise, K3'ün lansman tablosu, Moonshot'un öne çıkan karşılaştırma satırlarında Claude Opus 4.8'i yendiğini, ancak genel olarak Fable 5 ve GPT-5.6 Sol'un gerisinde kaldığını gösterdi. Bu iddiaları ve uyarılarını Kimi K3 vs Claude Opus 4.8 karşılaştırmamızda ele aldık.

Karşılaştırmaların çakıştığı iki tabloyu yan yana getirebilir misiniz? Yapabilirsiniz ve insanlar yapacaktır, ancak farklı donanımlar, iskeleler ve örnekleme ayarları, tablolar arası okumaları en iyi ihtimalle gösterge niteliğinde kılar. Dürüst özet: her iki satıcı da modellerini ajans görevlerinde ABD öncüleriyle rekabetçi ve seçici olarak önde gösteriyor. İki tablodan hiçbiri hangisinin daha güçlü olduğunu belirlemez. Alibaba'nın sayıları hakkındaki ayrıntılı bilgi için Qwen 3.8 karşılaştırma analizimize bakın.

Kendi karşılaştırmanızı Apidog'da çalıştırın

Hakem olmadığı için, en faydalı karşılaştırma, kendi iş yükünüzde çalıştırdığınız karşılaştırmadır. Her iki model de OpenAI uyumlu sohbet tamamlama uç noktaları sunar, bu da Apidog'da yan yana bir testi basitleştirir.

Biri DashScope temel URL'sini ve qwen3.8-max'i, diğeri Moonshot'un uç noktasını ve K3 model ID'sini tutan, her biri kendi API anahtarı değişkenine sahip iki ortam kurun. Gerçek isteminizle (ürününüzden gerçek bir görev, bilmece değil) bir istek kaydedin ve aynı yükü her iki modele de göndermek için ortamlar arasında geçiş yapın. Apidog'un yanıt görünümü size durumu, gecikmeyi ve tam gövdeyi yan yana gösterir ve SSE hata ayıklaması, her modelin muhakeme içeriğini nasıl akıttığını gösterir ki bu, kullanıcı arayüzünüz düşünce jetonlarını işliyorsa önemlidir. Birkaç onay (yanıt şeması, gecikme tavanı, çıktıda gerekli anahtar kelimeler) ekleyin ve bir "atmosfer kontrolünü" herhangi bir satıcı bir güncelleme yayınladığında tekrar çalıştırabileceğiniz tekrarlanabilir bir teste dönüştürün. Karşılaştırmayı çalıştırmak için Apidog'u ücretsiz indirin; her iki uç nokta üzerinden on istem, size herhangi bir satıcının tablosundan daha fazlasını söyleyecektir.

Değerlendirme kartı

Eksen Bugünkü Kazanan Uyarı
Toplam/aktif parametreler Qwen 3.8-Max (daha yalın: 2.4T/95B vs 2.8T/104B) Daha küçük olmak kendi başına daha iyi veya kötü değildir; esas olarak hizmet maliyetini gösterir
Bugün açık ağırlıklar Kimi K3 (Hugging Face'te canlı, 594 GB MXFP4) Qwen'in ağırlıkları ~10 Ağustos'ta bekleniyor; tekrar kontrol edin, bu eksen yakında berabere kalabilir
Modalite Qwen 3.8-Max (metin + görüntü girişi) Video/uzun belge iddiaları blog demolarıdır, belgelenmiş API giriş türleri değildir
Bağlam penceresi Qwen 3.8-Max (1M düz katman, 65.536 maksimum çıktı) K3'ün mevcut limitlerini kendi kullanım durumunuz için Moonshot'un belgeleriyle doğrulayın
Fiyat Qwen 3.8-Max (2$/6$ düz vs 3$/15$) xhigh düşünme varsayılanı Qwen'in gerçek çıktı faturalarını şişirir
Karşılaştırmalar Çağrı mümkün değil Her iki tablo da satıcı tarafından yürütülmüştür; bağımsız bir karşılaştırma mevcut değildir
Donanım ekosistemi Berabere Her ikisi de Anthropic protokol uç noktaları aracılığıyla Claude Kod tarzı donanımlara entegre olur
Vaatler konusunda geçmiş performans Kimi K3 Ağırlıklar lansmandan 11 gün sonra gönderildi; Qwen'in sözü hala açık

Hangisi ne zaman

Kimi K3'ü seçin eğer bu hafta kendi donanımınızda ağırlıklara ihtiyacınız varsa, uyumluluk duruşunuz sabitleyebileceğiniz ve denetleyebileceğiniz bir model gerektiriyorsa veya iş yükünüz tamamen metin tabanlı ve önbellek fiyatlandırmasının baskın olduğu kadar giriş ağırlıklıysa.

Qwen 3.8-Max'i seçin eğer iş yükünüz görüntüler veya belgelerle ilgiliyse, çok sayıda çıktı jetonu (ajan döngüleri, kod üretimi) oluşturuyorsanız veya katmanlı fiyatlandırma sürprizleri olmadan 1M jetonluk bir bağlam istiyorsanız.

Bir hafta bekleyin eğer açık ağırlıklar bu modellerden birine bakmanızın tek nedeni ise. Eğer Qwen'in ağırlıkları 10 Ağustos civarında söz verildiği gibi gelirse, açıklık ekseni sıfırlanır ve karar modaliteye, fiyata ve kendi değerlendirme sonuçlarınıza kalır.

Gerçek hikaye, geliştiricilerin artık üç hafta içinde Çin'den iki güvenilir, ucuz, donanım uyumlu öncü seçeneğe sahip olmasıdır. Hangisine yönelirseniz yönelin, yol haritanızı herhangi bir satıcının tablosuna taahhüt etmeden önce her iki uç nokta üzerinden kendi istemlerinizi çalıştırın.

button

SSS

Kimi K3, Qwen 3.8-Max'ten daha mı açık?

Bugün, evet, basit bir gerçek olarak: K3'ün ağırlıkları 27 Temmuz 2026'dan beri Hugging Face'te (594 GB, MXFP4) bulunurken, Qwen 3.8-Max'in ağırlıkları yaklaşık 10 Ağustos için vaat edildi ve henüz indirilemiyor. Alibaba sözünü yerine getirirse, her ikisi de açık ağırlıklı öncü modeller olacak ve anlamlı farklılıklar lisans koşullarına ve topluluk desteğine kayacak. O zamana kadar, yalnızca K3 kendi kendine barındırılabilir; yerel K3 rehberimiz bunun ne gerektirdiğini açıklıyor.

Hangi model kodlamada daha iyi, Qwen 3.8-Max mi Kimi K3 mü?

Bunu henüz kimse dürüstçe yanıtlayamaz. Her iki satıcı da güçlü ajans-kodlama sayıları yayınlıyor, ancak her biri kendi koşulları altında kendi değerlendirmelerini yaptı ve bağımsız bir karşılaştırma mevcut değil. Alibaba'nın kendi tablosu bile Qwen 3.8-Max'in SWE-bench Pro'da Fable 5'e kaybettiğini gösteriyor, bu yüzden satıcı tabloları kayıpları kabul ediyor; sadece satıcılar arasında karşılaştırılabilir değiller. Karar vermeden önce her iki modeli de kendi deponuzdaki görevler üzerinde çalıştırın.

Her iki modeli de Claude Code'da kullanabilir miyim?

Evet. Her ikisi de Anthropic uyumlu uç noktalar sunar. Qwen 3.8-Max için, Alibaba'nın çıkış gönderisindeki yapılandırmayı kullanarak ANTHROPIC_BASE_URL'yi DashScope Anthropic uç noktasına ve ANTHROPIC_MODEL=qwen3.8-max'i ayarlayın. K3, Moonshot'un uç noktası aracılığıyla aynı deseni destekler. Bu paylaşılan donanım uyumluluğu, ikisi arasında A/B testini kurmayı bu kadar ucuz hale getiriyor.

Tipik bir ajan iş yükü için hangisi daha ucuz?

Liste fiyatına göre, Qwen 3.8-Max: K3'ün 3$/15$'ına karşılık milyon jeton başına 2$/6$, ve ajan döngüleri, farkın 2.5 kat olduğu çıktı jetonlarına doğru eğilim gösterir. İki yeterlilik: K3'ün 0,30 dolarlık önbellek isabet oranı, giriş ağırlıklı, iyi önbelleğe alınmış iş yüklerini rekabetçi tutar ve Qwen'in varsayılan xhigh muhakeme çabası, düşünmeyi çıktı olarak faturalandırır, bu nedenle gerçek dünya maliyetleri saf tahminlerin üzerinde seyreder. Etiket fiyatlarının hikayeyi anlattığını varsaymadan önce kendi jeton karışımınızı modelleyin.

API Tasarım-Öncelikli Yaklaşımı Apidog'da Uygulayın

API'leri oluşturmanın ve kullanmanın daha kolay yolunu keşfedin