Apa Itu Qwen 3.8-Max

Qwen 3.8 dijelaskan: Unggulan sumber terbuka 2.4T milik Alibaba dengan 95B parameter aktif, konteks 1M, harga $2/$6, tolok ukur nyata, dan setiap cara untuk mengaksesnya.

Ashley Innocent

Ashley Innocent

3 August 2026

Apa Itu Qwen 3.8-Max

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Alibaba secara resmi merilis Qwen 3.8-Max pada awal Agustus 2026, dan model ini hadir dengan kombinasi yang tidak biasa: model Mixture-of-Experts berparameter 2,4 triliun yang hanya mengaktifkan 95 miliar parameter per token, harga tetap $2/$6 per juta token di seluruh konteks 1 juta, dan janji bahwa bobotnya akan dipublikasikan di Hugging Face dan ModelScope dalam waktu seminggu. Bagian terakhir ini penting. Belum pernah ada model kelas Qwen-Max yang meluncurkan bobot terbuka sebelumnya.

Pengumuman resmi menyebutnya sebagai Qwen paling mumpuni hingga saat ini, dan tabel benchmark vendor mendukung hal tersebut dengan beberapa baris yang benar-benar kuat dan beberapa kekalahan yang jujur. Panduan ini menguraikan apa sebenarnya Qwen 3.8-Max, apa yang dikatakan angka-angka, bagaimana posisinya dibandingkan Kimi K3, Fable 5, dan GPT-5.6 Sol, serta setiap cara untuk menjalankannya hari ini. Jika Anda berencana untuk membangun menggunakan API, model ini dilengkapi dengan endpoint yang kompatibel dengan OpenAI dan Anthropic, yang membuat klien yang sadar protokol seperti Apidog berguna untuk menguji kedua bentuk tersebut dengan kunci yang sama.

button

Qwen 3.8-Max sekilas

Spesifikasi Qwen 3.8-Max
Pengembang Alibaba (tim Qwen)
Rilis Awal Agustus 2026 (GA di Model Studio, 3 Agustus)
Arsitektur MoE, dibangun di atas fondasi Qwen 3.5
Total parameter 2.4T
Parameter aktif 95B (~4% aktivasi)
Jendela konteks 1.000.000 token
Output maksimal 65.536 token
Modalitas Input teks + gambar, output teks
Kontrol penalaran reasoning_effort: xhigh (standar), medium, low
ID model API qwen3.8-max
Harga $2 input / $6 output per 1M token, tetap di seluruh konteks penuh
Bobot terbuka Dijanjikan untuk minggu depan (~10 Agustus); belum dapat diunduh per awal Agustus 2026
Protokol API Kompatibel dengan OpenAI dan kompatibel dengan Anthropic

Semua yang ada di tabel tersebut berasal dari materi rilis Alibaba sendiri dan halaman harga Model Studio. Sekarang mari kita bahas detailnya.

Apa itu Qwen 3.8-Max

Qwen 3.8-Max adalah unggulan baru dari keluarga Qwen Alibaba, dibangun di atas fondasi arsitektur Qwen 3.5. Ini menggantikan Qwen3.7-Max di puncak lini produk, dan tabel vendor menunjukkan peningkatan signifikan dibandingkan pendahulunya: Terminal Bench 2.1 naik dari 74,5 menjadi 86,6, dan PaperBench naik dari 64,8 menjadi 93,0. Jika Anda memutuskan apakah akan beralih dari model lama, perbedaannya dijelaskan dalam perbandingan Qwen 3.8 vs Qwen 3.7 Max kami.

Spesifikasi utamanya adalah pembagian parameter. Total parameter 2.4T terdengar sangat besar, dan memang demikian, tetapi desain MoE hanya mengaktifkan 95B per forward pass. Rasio aktivasi sekitar 4% itulah mengapa Alibaba dapat melayani model sebesar ini dengan harga $2/$6 per juta token. Sebagai konteks, Kimi K3 berjalan dengan total 2.8T dengan 104B aktif, jadi Qwen 3.8-Max adalah model yang lebih kecil dalam kedua aspek tersebut.

Di sisi input, model ini menerima teks dan gambar melalui API. Blog Alibaba juga mendemonstrasikan pemahaman dokumen panjang (PDF 200+ halaman) dan pemahaman video 100 jam melalui apa yang disebutnya grafik memori. Perlakukan ini sebagai kemampuan yang didemonstrasikan di blog daripada jenis input API terpisah; konfigurasi API yang diterbitkan mencantumkan teks dan gambar sebagai modalitas input.

Penalaran dikendalikan melalui parameter reasoning_effort dengan tiga level: xhigh (standar), medium, dan low. Ada juga enable_thinking dan preserve_thinking, dengan thinking dipertahankan secara standar. Satu detail harga yang perlu diketahui lebih awal: mode berpikir dan tidak berpikir ditagih dengan tarif yang sama, tetapi token berpikir dihitung sebagai output, sehingga tagihan sebenarnya pada standar xhigh akan lebih tinggi daripada perhitungan stiker yang sederhana.

Qwen kelas Max dengan bobot terbuka pertama

Ini adalah langkah strategis terbesar dari rilis ini. Alibaba telah merilis banyak model Qwen sebagai sumber terbuka selama bertahun-tahun, tetapi tidak pernah untuk tingkat Max. Qwen 3.8-Max mematahkan pola itu: perusahaan mengatakan bobotnya akan tersedia di Hugging Face dan ModelScope “minggu depan,” yang berarti sekitar 10 Agustus.

Dua peringatan, yang dinyatakan secara jelas:

  1. Bobotnya belum bisa diunduh. Per awal Agustus 2026, janji tersebut masih janji. Kimi K3 menjadi preseden baru-baru ini: bobotnya tiba 11 hari setelah peluncuran, jadi sedikit penundaan tidak akan mengejutkan.
  2. Self-hosting model 2.4T adalah proyek multi-node. Bahkan dengan kuantisasi agresif, ini bukanlah sesuatu yang bisa Anda jalankan di workstation. Bagi sebagian besar tim, “bobot terbuka” akan berarti akses hosting yang lebih murah melalui penyedia pihak ketiga daripada penerapan lokal.

Jika minat Anda pada Qwen 3.8-Max terutama karena tidak ingin membayar harga daftar, rute realistis saat ini adalah Qwen Chat dan kuota gratis Model Studio, keduanya dibahas dalam panduan kami tentang cara menggunakan Qwen 3.8 secara gratis.

Apa yang ditunjukkan benchmark, termasuk kekalahan

Alibaba menerbitkan tabel benchmark lengkap yang membandingkan Qwen 3.8-Max dengan Claude Opus 4.8, Fable 5, GPT-5.6 Sol, dan Qwen3.7-Max. Dua pengungkapan sebelum angka apa pun: ini adalah hasil yang dijalankan oleh vendor, dan sebagian besar baris pengkodean dieksekusi menggunakan Claude Code harness untuk semua model. Beberapa benchmark (QwenSWEBench, QwenQoderBench, CoWorkBench, RecreationBench) adalah ciptaan internal Alibaba sendiri. Tidak ada angka independen dari outlet seperti Artificial Analysis yang ada pada saat penulisan.

Dengan kerangka itu, baris-baris unggulan per tabel Alibaba:

Di mana ia menang:

Di mana ia kalah:

Ringkasan jujur: menurut angka Alibaba sendiri, Qwen 3.8-Max mengalahkan Opus 4.8 pada beberapa baris agen, tertinggal dari Fable 5 pada sebagian besar pekerjaan pengkodean inti, dan unggul jauh dalam kecerdasan multimodal dan dokumen. Pada GPQA Diamond, model ini berada di angka 92,6, seri dengan Fable 5 dan sedikit di belakang Sol 94,1, jadi penalaran sains mentah cukup kompetitif. Untuk pembahasan tabel lengkap, termasuk rincian harness dan apa saja verifikasi independen yang perlu diperhatikan, lihat uraian benchmark Qwen 3.8 kami.

Alibaba juga menerbitkan serangkaian demo: sesi pengkodean otonom selama 16 hari di repositori publik (265 commit, 127 pull request), demonstrasi reproduksi makalah yang mengalahkan hasil AIME24 makalah asli, dan entri kontes Tianchi yang mengungguli 458 dari 526 tim manusia dalam 24 jam. Ini adalah demo dari vendor sendiri, jadi bacalah sebagai iklan kemampuan daripada evaluasi terkontrol. Kisah pengkodean, termasuk cara mereproduksi pengaturan harness, dibahas secara khusus dalam Qwen 3.8 untuk pengkodean.

Posisinya dibandingkan Kimi K3, Fable 5, dan GPT-5.6 Sol

Vs Kimi K3. Ini adalah persaingan alami: dua lab Tiongkok, dua model MoE raksasa dengan bobot terbuka, dirilis dalam rentang beberapa minggu. K3 lebih besar (total 2.8T, 104B aktif vs 2.4T/95B), hanya teks sedangkan Qwen multimodal, dan bobotnya sudah tersedia sedangkan Qwen masih berupa janji. Harga juga sangat berbeda: K3 mengenakan biaya $3 input/$15 output dengan hit cache $0,30, dibandingkan Qwen yang tetap $2/$6. Belum ada evaluasi langsung; setiap vendor menerbitkan tabelnya sendiri. Kami membandingkannya baris demi baris di Qwen 3.8 vs Kimi K3, dan jika Anda baru mengenal model Moonshot, mulailah dengan apa itu Kimi K3.

Vs Fable 5. Unggulan Anthropic tetap menjadi benchmark pengkodean yang harus dikalahkan, dan Qwen 3.8-Max tidak mengalahkannya: SWE-bench Pro (67,7 vs 80,0) dan HLE (43,6 vs 53,3) adalah kesenjangan yang jelas, menurut tabel Alibaba sendiri. Yang ditawarkan Qwen sebagai gantinya adalah harga (sebagian kecil dari tarif frontier), konteks 1M, bobot terbuka yang akan datang, dan baris multimodal yang lebih kuat.

Vs GPT-5.6 Sol. Sol memenangkan Terminal Bench (88,8 vs 86,6), GPQA (94,1 vs 92,6), dan HLE (47,2 vs 43,6), sementara Qwen 3.8-Max memenangkan PaperBench (93,0 vs 90,5) dan IFBench (82,8 vs 72,7). Dari segi harga, $2/$6 Qwen lebih murah dibandingkan $2/$12 GPT-5.6 Terra untuk output, dan akses tingkat Sol masih lebih mahal.

Satu lagi patokan: Claude Opus 5 terdaftar seharga $5/$25. Terlepas dari apa pun yang Anda pikirkan tentang tabel vendor, Alibaba menetapkan harga unggulannya pada tingkat yang mengubah perhitungan untuk beban kerja bervolume tinggi.

Harga: $2/$6, tetap di seluruh 1M token

Penetapan harga cukup sederhana untuk dinyatakan dalam satu kalimat: $2 per juta token input, $6 per juta token output, satu tingkatan tetap dari token nol hingga batas konteks 1M, mode berpikir atau tidak.

Tingkatan harga tetap adalah bagian yang tidak biasa. Sebagian besar model konteks panjang menaikkan harga seiring bertambahnya prompt Anda; Qwen 3.8-Max tidak. Ini juga diluncurkan lebih murah dari harga daftar Qwen3.7-Max yaitu $2.5/$7.5, meskipun model yang lebih lama tersebut saat ini menjalankan promosi 50% ($1.25/$3.75), yang menjaganya tetap relevan sebagai pilihan bernilai.

Caching konteks mempermanis beban kerja dengan awalan berulang: hit cache ditagih 10% dari tarif input, dan pembuatan cache eksplisit berharga 125%. Ada juga kuota gratis (1M token, hanya wilayah Singapura, berlaku 90 hari) untuk mencoba. Rincian biaya lengkap, dengan contoh per tugas yang telah dikerjakan dan kuantifikasi jebakan token berpikir, tersedia dalam panduan harga Qwen 3.8 kami.

Cara mengakses Qwen 3.8-Max

Matriks akses lebih luas daripada peluncuran biasa. Lima rute:

1. Qwen Chat. Aplikasi konsumen, tidak memerlukan kunci API. Cara tercepat untuk membentuk opini.

2. API di Alibaba Cloud Model Studio (DashScope). Dapatkan kunci dari home.qwencloud.com, atur DASHSCOPE_API_KEY, dan panggil ID model qwen3.8-max melalui endpoint chat-completions atau responses yang kompatibel dengan OpenAI. Tiga URL dasar regional sudah aktif: Beijing (dashscope.aliyuncs.com/compatible-mode/v1), Singapura (dashscope-intl.aliyuncs.com/compatible-mode/v1), dan AS-Virginia (dashscope-us.aliyuncs.com/compatible-mode/v1). Halaman model Model Studio mencantumkannya di bagian atas tumpukan yang direkomendasikan.

3. Endpoint yang kompatibel dengan Anthropic. Ini adalah yang benar-benar tidak biasa: https://dashscope-intl.aliyuncs.com/apps/anthropic berbicara protokol Pesan Anthropic, sehingga alat yang dibuat untuk Claude dapat mengarah ke Qwen dengan dua variabel lingkungan.

4. Harness pengkodean. Alibaba menerbitkan konfigurasi resmi untuk lima agen: Claude Code (melalui ANTHROPIC_BASE_URL plus ANTHROPIC_MODEL=qwen3.8-max), Codex, Qoder, Qwen Code, dan OpenClaw. Perlu dicatat bahwa Alibaba menjalankan sebagian besar benchmark pengkodeannya di dalam harness Claude Code, sehingga konfigurasi yang diterbitkannya juga merupakan konfigurasi di balik angka-angkanya sendiri.

5. Bobot terbuka, segera. Hugging Face dan ModelScope, dijanjikan minggu depan, belum dapat diunduh per awal Agustus 2026.

Detail pengaturan untuk rute 2 hingga 4, dengan Python dan cURL yang dapat disalin-tempel, ada di panduan API Qwen 3.8 kami.

Menguji API dual-protokol

Model yang sama menjawab pada dua bentuk protokol yang berbeda menimbulkan pertanyaan pengujian praktis: apakah permintaan Anda berperilaku identik pada keduanya? Di sinilah klien API membuktikan nilainya. Di Apidog, Anda dapat menyimpan tiga URL dasar regional sebagai lingkungan dan beralih wilayah tanpa mengedit permintaan, mengirim prompt yang sama melalui endpoint yang kompatibel dengan OpenAI dan endpoint protokol Anthropic secara berdampingan, dan memeriksa aliran SSE untuk melihat delta reasoning_content tiba sebelum jawaban akhir. Bagian terakhir ini berguna untuk memverifikasi seberapa banyak pemikiran yang sebenarnya dihasilkan oleh standar xhigh, karena token-token tersebut akan masuk ke tagihan Anda sebagai output. Unduh Apidog secara gratis jika Anda ingin mengikuti saat Anda menghubungkan endpoint; ruang kerja yang sama juga memudahkan untuk menguji A/B qwen3.8-max dibandingkan qwen3.7-max atau kimi-k3 pada prompt yang identik sebelum Anda berkomitmen pada beban kerja.

Posisi Qwen 3.8-Max dalam jajaran produk

Jika Anda memetakan keluarga yang lebih luas, Qwen 3.8-Max kini berada di atas Qwen3.7-Max dan model tingkat plus, dan panduan kami untuk model Qwen terbaik mencakup tingkatan mana yang sesuai untuk beban kerja mana. Versi singkatnya: 3.8-Max adalah pilihan saat Anda membutuhkan kemampuan multimodal dan agen tingkat tinggi, 3.7-Max dengan diskon 50% adalah unggulan bernilai selama promosi berlangsung, dan model plus tetap menjadi kuda pekerja murah untuk tugas-tugas rutin.

FAQ

Apakah Qwen 3.8 sumber terbuka?

Belum, tapi sudah dekat. Alibaba menjanjikan bobotnya untuk Hugging Face dan ModelScope “minggu depan” sejak peluncuran awal Agustus 2026, yang akan menjadikannya Qwen kelas Max dengan bobot terbuka pertama. Belum ada yang bisa diunduh pada saat penulisan. Sampai saat itu, akses berjalan melalui API atau Qwen Chat; lihat cara menggunakan Qwen 3.8 secara gratis untuk rute tanpa biaya.

Berapa harga Qwen 3.8-Max?

$2 per juta token input dan $6 per juta token output, pada satu tingkat harga tetap di seluruh konteks 1M penuh. Hit cache ditagih 10% dari input. Token berpikir ditagih sebagai output, dan upaya penalaran standar adalah xhigh, jadi anggarkan di atas harga stiker untuk pekerjaan yang sangat membutuhkan penalaran.

Apakah Qwen 3.8-Max lebih baik dari Kimi K3?

Belum ada evaluasi langsung; kedua vendor menerbitkan tabel mereka sendiri. Di atas kertas, Qwen 3.8-Max lebih kecil (2.4T/95B aktif vs 2.8T/104B), multimodal sedangkan K3 hanya teks, dan lebih murah untuk output ($6 vs $15). Keunggulan K3 hari ini adalah bobotnya sudah publik.

Bisakah saya menggunakan Qwen 3.8-Max di Claude Code?

Ya. Alibaba menerbitkan konfigurasi resmi: arahkan ANTHROPIC_BASE_URL ke endpoint DashScope yang kompatibel dengan Anthropic dan atur ANTHROPIC_MODEL=qwen3.8-max. Codex, Qoder, Qwen Code, dan OpenClaw juga memiliki konfigurasi resmi.

Apa yang harus dilakukan selanjutnya

Qwen 3.8-Max adalah rilis unggulan yang nyata, bukan pratinjau pers: GA di tiga wilayah API, harga yang dipublikasikan, tabel benchmark lengkap (dijalankan vendor) dengan kemenangan dan kekalahan, dan bobot terbuka yang akan segera dirilis. Pembacaan jujur adalah bahwa model ini tidak menggulingkan Fable 5 dalam pengkodean inti, tetapi mengalahkan Opus 4.8 pada beberapa baris agen, unggul dalam pekerjaan dokumen dan multimodal, dan biayanya $2/$6 saat melakukannya.

Langkah yang masuk akal adalah mengujinya terhadap beban kerja Anda sendiri daripada tabel siapa pun. Ambil kuota gratis, sambungkan kedua endpoint protokol, dan bandingkan output pada prompt yang benar-benar Anda jalankan. Mulailah dengan panduan pengaturan API, dan periksa kembali sekitar 10 Agustus untuk melihat apakah bobotnya dirilis sesuai jadwal.

button

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.