Alibaba merilis Qwen 3.8-Max pada awal Agustus 2026, dan hasil pencarian sudah dipenuhi klaim “gunakan gratis selamanya” yang tidak sesuai dengan ketentuan sebenarnya. Berikut adalah versi jujur, diperiksa berdasarkan halaman Alibaba sendiri per 3 Agustus 2026.
Ada tepat empat jalur yang patut Anda pertimbangkan. Dua di antaranya berfungsi hari ini. Satu adalah janji dengan tanggal terlampir. Satu lagi adalah cadangan. Jika Anda ingin gambaran lengkap modelnya terlebih dahulu (2,4 triliun total parameter, 95B aktif, konteks 1 juta token), mulailah dengan ikhtisar Qwen 3.8 kami dan kembali lagi.
Peta singkat sebelum detailnya:
| Jalur | Gratis? | Berfungsi hari ini? | Kekurangan |
|---|---|---|---|
| Qwen Chat | Ya | Ya | Aplikasi konsumen, tanpa API |
| Kuota API Model Studio | 1 Juta token | Ya | Hanya wilayah Singapura, 90 hari |
| Bobot terbuka (self-host) | Bobot gratis | Belum | Dijanjikan “minggu depan,” dan perangkat kerasnya tidak gratis |
| Model Qwen lama | Ya | Ya | Bukan Qwen 3.8 |
Jalur 1: Qwen Chat, opsi tanpa penyiapan
Jalur gratis tercepat adalah yang diinginkan Alibaba untuk konsumen: Qwen Chat. Masuk, pilih modelnya, dan Anda dapat berbicara dengan Qwen 3.8-Max tanpa kartu dan tanpa konsol cloud. Pos rilis resmi menunjuk ke sini sebagai cara default untuk mencoba model tersebut.

Yang Anda dapatkan: penggunaan gratis model unggulan melalui antarmuka obrolan, termasuk pemahaman gambar dan dokumen yang diandalkan dalam demo peluncuran.
Yang tidak Anda dapatkan: API. Tanpa kunci, tanpa otomatisasi, tanpa cara untuk mengintegrasikannya ke aplikasi atau rangkaian pengujian Anda. Aplikasi obrolan juga menerapkan prompt dan pengaturan sistem mereka sendiri, sehingga perilaku yang Anda lihat di sana tidak akan sama persis dengan apa yang dikembalikan oleh API mentah. Jika Anda mengevaluasi Qwen 3.8 untuk suatu produk, perlakukan Qwen Chat sebagai demo, bukan sebagai tolok ukur.
Kesimpulan: nyata, gratis, dan bagus untuk uji coba. Bukan jalur pengembang.
Jalur 2: kuota gratis Model Studio (baca syarat dan ketentuannya)
Ini adalah jalur yang penting jika Anda menulis kode. Alibaba Cloud Model Studio memberikan kuota gratis untuk qwen3.8-max kepada aktivasi baru: 1 juta token. Ini adalah jumlah yang benar-benar berguna, dan juga dibungkus dengan syarat dan ketentuan yang sering dilewatkan oleh sebagian besar postingan ulasan.
Berikut adalah apa yang sebenarnya tertera di halaman harga, diterjemahkan ke dalam keputusan:
1. Hanya wilayah Singapura. Kuota gratis berlaku untuk wilayah Singapura (internasional). Itu berarti URL dasar Anda adalah:
https://dashscope-intl.aliyuncs.com/compatible-mode/v1
Arahkan ke endpoint Beijing atau US-Virginia dan Anda akan membayar dari token pertama. Jika anggaran latensi Anda memerlukan endpoint AS, kuota gratis tidak akan membantu Anda.
2. 90 hari, lalu habis. Kuota berlaku selama 90 hari sejak aktivasi. Token yang tidak digunakan tidak akan diakumulasikan; token tersebut akan kedaluwarsa. Waktu sudah berjalan sejak rilis model di awal Agustus, jadi jangan aktifkan sekarang dan berencana untuk mengevaluasi pada bulan November.
3. Setelah kuota: $2 input / $6 output per juta token. Itu adalah tarif tetap di seluruh konteks 1 juta, tanpa tingkatan. Ini murah untuk model unggulan, tetapi tidak gratis, dan transisi akan otomatis setelah kuota Anda habis atau kedaluwarsa. Atur peringatan penagihan sebelum Anda memulai. Kami merinci biaya beban kerja nyata dalam panduan harga Qwen 3.8 kami.
Untuk mengklaim kuota: buat akun di Model Studio, aktifkan layanan, dan buat kunci API (konvensi variabel lingkungan adalah DASHSCOPE_API_KEY). Katalog model mencantumkan qwen3.8-max di bagian atas model yang direkomendasikan. Endpoint ini mendukung protokol yang kompatibel dengan OpenAI, dan ada juga endpoint yang kompatibel dengan Anthropic. Panduan API Qwen 3.8 kami mencakup keduanya, termasuk streaming dan output penalaran.
Satu jebakan pemakan kuota: penalaran aktif secara default
Qwen 3.8-Max dikirimkan dengan reasoning_effort disetel ke xhigh, dan token pemikiran ditagih sebagai output. Satu prompt yang sulit dapat secara diam-diam menghasilkan ribuan token penalaran sebelum jawaban dimulai. Pada akun berbayar itu adalah baris biaya; pada kuota gratis 1 juta, itu adalah perbedaan antara dua minggu pengujian dan dua hari. Turunkan reasoning_effort ke low atau medium untuk apa pun yang bukan merupakan tugas penalaran yang sebenarnya.
Manfaatkan satu juta token sebaik mungkin
Satu juta token cepat habis ketika setiap iterasi debugging mengirim ulang seluruh rantai prompt Anda. Beberapa kebiasaan untuk menghematnya:
- Pastikan permintaan benar sebelum Anda mengulanginya. Bangun panggilan di Apidog, sesuaikan parameter, dan periksa respons yang di-streaming, termasuk delta penalaran, satu permintaan pada satu waktu. Debugging interaktif di klien lebih baik daripada membakar kuota pada loop percobaan ulang dalam kode aplikasi Anda.
- Mock apa yang sudah Anda lihat. Setelah Anda mengetahui bentuk respons, simpan contoh dan biarkan server mock Apidog menyajikannya ke frontend atau agen Anda saat Anda membangun. Iterasi pengembangan terhadap mock tidak memakan token; Anda hanya akan memanggil endpoint langsung untuk verifikasi akhir.
- Pantau penggunaan aktual Anda. Jumlah token kembali dalam setiap badan respons. Awasi jumlahnya per permintaan, dan Anda akan tahu tingkat pembakaran token Anda yang sebenarnya daripada mengetahuinya saat kuota habis di tengah sprint.
Unduh Apidog secara gratis jika Anda ingin mengikuti alur kerja tersebut; ini juga membuat peralihan wilayah tanpa kesulitan, karena Anda dapat menyimpan URL dasar Singapura, Beijing, dan AS sebagai lingkungan dan beralih di antaranya.
Kesimpulan: nyata, benar-benar gratis selama 90 hari, dan jalur pengembang terbaik saat ini. Hormati saja pembatasan wilayah dan tanggal kedaluwarsa.
Jalur 3: bobot terbuka, dijanjikan tetapi belum dapat diunduh
Berita utama peluncuran terbesar untuk para pencari gratis: Qwen 3.8-Max adalah model kelas Qwen-Max pertama dengan bobot terbuka. Alibaba mengatakan bobotnya akan tersedia di Hugging Face dan ModelScope “minggu depan,” yang berarti sekitar 10 Agustus.
Per 3 Agustus 2026, bobot tersebut belum dapat diunduh. Tidak ada yang bisa ditarik, tidak ada yang bisa dikuantisasi, tidak ada yang bisa dijalankan. Jika Anda melihat tutorial “jalankan Qwen 3.8 secara lokal hari ini” yang bertanggal sebelum bobotnya benar-benar ada, tutup tab tersebut. Sebagai referensi, Kimi K3 membuat janji bobot terbuka yang sama saat diluncurkan dan mengirimkannya 11 hari kemudian, jadi jadwalnya masuk akal. Hanya saja itu belum terjadi.
Realita self-host
Bahkan ketika bobotnya dirilis, kata “gratis” membutuhkan tanda bintang sebesar rak server. Qwen 3.8-Max memiliki total 2,4 triliun parameter. Preseden terdekat adalah Kimi K3: model berparameter 2,8T yang dikirimkan sebagai bobot 594 GB bahkan dengan kuantisasi MXFP4 yang agresif. Skalakan sedikit ke bawah untuk Qwen 2,4T dan Anda masih akan melihat ratusan gigabyte bobot dan pengaturan penyajian multi-GPU, atau bahkan multi-node. Tidak ada GPU konsumen yang dapat menampungnya. Tidak ada workstation tunggal yang dapat menampungnya. Kami telah menjelaskan secara persis seperti apa kelas perangkat keras tersebut untuk menjalankan Kimi K3 secara lokal, dan ekonominya berlaku di sini tanpa perubahan.
Jadi, apa sebenarnya manfaat dari bobot terbuka? Sebagian besar ini: setelah bobot dipublikasikan, penyedia hosting pihak ketiga dapat menyajikan model tersebut, dan persaingan cenderung mendorong harga hosting di bawah tarif pihak pertama. Bagi sebagian besar pembaca, “bobot terbuka gratis” akan berarti akses API yang lebih murah melalui penyedia hosting, bukan model yang berjalan di laptop Anda. Itu tetap sebuah keuntungan. Hanya saja keuntungan yang berbeda dari apa yang disiratkan oleh frasa tersebut.
Kesimpulan: belum nyata. Periksa kembali pertengahan Agustus, dan anggarkan untuk hosting, bukan perangkat keras.
Jalur 4: opsi cadangan, model Qwen lama yang benar-benar gratis
Jika yang Anda butuhkan adalah “model Qwen yang mumpuni tanpa biaya” daripada “Qwen 3.8-Max secara spesifik,” generasi sebelumnya memiliki jalur gratis yang tidak kedaluwarsa dalam 90 hari. Model Qwen bobot terbuka yang lebih kecil sudah dapat dijalankan pada perangkat keras yang dimiliki orang, dan jajaran model yang lebih lama memiliki jalur akses gratisnya sendiri. Kami menyimpan panduan terpisah tentang penggunaan Qwen 3.7 secara gratis yang tetap mutakhir mengenai opsi-opsi tersebut.
Pertukaran yang jujur: Anda kehilangan peningkatan benchmark yang membuat 3.8-Max menjadi berita. Untuk proyek sampingan, pengklasifikasi, atau mempelajari bentuk API Qwen sebelum mengeluarkan uang, model yang lebih lama seringkali sudah cukup.
Yang tidak nyata
Untuk menghemat waktu pencarian Anda, berikut adalah apa yang tidak ada per 3 Agustus 2026:
- Tidak ada tingkat API gratis tanpa batas. Kuota 1 juta token adalah batasnya, dan itu akan kedaluwarsa.
- Tidak ada tingkat gratis di luar Singapura. Endpoint Beijing dan US-Virginia akan menagih dari token pertama.
- Belum ada bobot yang dapat diunduh. “Minggu depan” adalah janji, bukan tautan.
- Tidak ada Qwen 3.8 gratis resmi di agregator pihak ketiga. Akses pihak ketiga yang di-hosting kemungkinan akan muncul setelah bobot dikirimkan; apa pun sebelum itu yang mengklaim sebagai 3.8-Max gratis patut diragukan tentang model apa yang sebenarnya ada di baliknya.
FAQ
Apakah API Qwen 3.8 benar-benar gratis?
Sebagian. Anda mendapatkan 1 juta token gratis melalui Alibaba Cloud Model Studio, berlaku selama 90 hari dan hanya di wilayah Singapura. Setelah itu, tarifnya adalah $2 per juta token input dan $6 per juta token output, jadi rencanakan evaluasi Anda dalam jangka waktu 90 hari.
Bisakah saya mengunduh dan menjalankan Qwen 3.8 secara lokal sekarang?
Tidak. Bobot dijanjikan untuk Hugging Face dan ModelScope sekitar 10 Agustus 2026, dan belum dikirimkan pada saat penulisan ini. Ketika sudah, rencanakan untuk ratusan gigabyte dan penyajian multi-GPU; ini adalah model berparameter 2,4T, bukan sesuatu yang dapat dijalankan oleh laptop.
Bagaimana ini berbeda dari opsi gratis Kimi K3?
Bobot Kimi K3 sudah tersedia dan dapat diunduh, jadi jalur self-host-nya nyata hari ini, sementara Qwen 3.8 masih tertunda. Namun, keduanya terlalu besar untuk perangkat keras konsumen. Panduan kami tentang penggunaan Kimi K3 secara gratis mencakup jalur model tersebut jika Anda ingin membandingkan.
Apakah kuota gratis mencakup token penalaran?
Ya, tetapi itu akan mengurasnya. Output penalaran ditagih seperti output normal, dan reasoning_effort default adalah xhigh. Turunkan untuk panggilan rutin atau kuota Anda akan habis untuk rantai pemikiran yang tidak pernah Anda baca.
Intinya
Akses gratis Qwen 3.8 itu nyata, tetapi spesifik: Qwen Chat untuk penggunaan santai, dan 1 juta token wilayah Singapura dengan batas waktu 90 hari untuk pengembang. Jalur bobot terbuka secara tertulis akan tersedia dalam beberapa hari dan praktiknya sebagian besar akan berarti akses hosting yang lebih murah. Segala sesuatu di luar itu adalah model yang lebih lama atau blog yang penuh harapan.
Jika Anda memilih jalur API, habiskan kuota Anda untuk jawaban, bukan untuk debugging. Buat prototipe permintaan di Apidog, mock respons saat Anda membangun, dan simpan token langsung untuk menjalankan evaluasi yang benar-benar memberi tahu Anda apakah Qwen 3.8-Max layak mendapatkan tempat di tumpukan teknologi Anda.
