xAI mengirimkan Grok 4.6 pada 12 Agustus 2026, dan target utamanya adalah para pengembang: sebuah model canggih untuk agen yang berjalan lama dan pekerjaan coding multi-langkah, dengan harga $2 per juta token input dan $6 per juta token output. Dokumen resmi mencakup materi referensi, tetapi tidak ada di hasil pencarian teratas yang memandu Anda untuk memanggil API secara end-to-end. Panduan ini memperbaikinya. Pada akhirnya, Anda akan memiliki kunci API, permintaan yang berfungsi di curl, Python, dan JavaScript, output streaming, dan pengaturan yang dapat diulang untuk menguji endpoint Grok 4.6 sebelum masuk ke produksi. Jika Anda ingin membangun dan men-debug permintaan tersebut secara visual alih-alih mengelola banyak jendela terminal, Apidog menangani seluruh alurnya, unduh secara gratis untuk mengikuti.tombol
Ringkasan
- Dapatkan kunci API di console.x.ai, atur sebagai
XAI_API_KEY, dan panggilhttps://api.x.ai/v1/chat/completionsdengan modelgrok-4-6. - API ini kompatibel dengan OpenAI, jadi SDK resmi OpenAI berfungsi dengan menukar URL dasar, tidak perlu mempelajari pustaka klien baru.
- Grok 4.6 memberi Anda jendela konteks 500.000 token dan batas pengetahuan hingga 1 Februari 2026.
- Harga: $2 per juta token input, $6 per juta token output. Varian yang lebih cepat harganya dua kali lipat.
- Selain API asli, Grok 4.6 tersedia melalui OpenRouter, Vercel, Cloudflare, Cursor, dan Grok Build.
- Uji permintaan, periksa respons streaming, dan mock endpoint Grok untuk CI dengan Apidog.

Apa yang sedang Anda kerjakan
Sebelum menulis kode apa pun, berikut adalah lembar spesifikasi yang penting untuk keputusan integrasi:
| Spesifikasi | Grok 4.6 |
|---|---|
| Tanggal rilis | 12 Agustus 2026 |
| Jendela konteks | 500.000 token |
| Batas pengetahuan | 1 Februari 2026 |
| Harga input | $2 / 1M token |
| Harga output | $6 / 1M token |
| Varian cepat | 2x harga |
| Gaya API | REST kompatibel OpenAI |
| Ketersediaan | xAI API, OpenRouter, Vercel, Cloudflare, Cursor, Grok Build |
Peningkatan utama dari Grok 4.5 bersifat agentic: xAI melaporkan bahwa model lebih sering memeriksa pekerjaannya sendiri pada lintasan panjang dan menghasilkan percobaan pertama yang lebih kuat pada proyek interaktif dan visual. Pada benchmark, ia melonjak dari 54% menjadi 65.9% pada DeepSWE v1.1 dan dari 47.1% menjadi 57.5% pada APEX-Agents. Jika Anda membangun terhadap API Grok 4.5, permukaan integrasi tidak berubah, lihat panduan API Grok 4.5 kami untuk dasar-dasarnya, lalu tukar nama modelnya.
Langkah 1: Dapatkan kunci API Anda
- Buka console.x.ai dan masuk atau buat akun xAI.
- Buka Kunci API dari sidebar dan klik Buat kunci API.
- Beri nama kunci untuk lingkungannya (
grok-dev,grok-prod); Anda akan berterima kasih pada diri sendiri saat memutar kunci nanti. - Salin kunci segera. xAI menunjukkannya sekali.
Simpan sebagai variabel lingkungan daripada menempelkannya ke dalam kode:
export XAI_API_KEY="kunci-anda-di-sini"
Satu kebiasaan yang patut diadopsi sejak hari pertama: simpan kunci terpisah untuk pengembangan dan produksi, dan jangan pernah menyimpan kunci ke kontrol versi. Jika kunci bocor, cabut di konsol dan keluarkan yang baru.
Langkah 2: Permintaan pertama Anda dengan curl
API xAI mengikuti format penyelesaian obrolan OpenAI. Berikut adalah permintaan minimal:
curl https://api.x.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $XAI_API_KEY" \
-d '{
"model": "grok-4-6",
"messages": [
{"role": "system", "content": "Anda adalah asisten teknis yang ringkas."},
{"role": "user", "content": "Jelaskan idempoten dalam REST API dalam dua kalimat."}
]
}'
Respons yang berhasil mengembalikan array choices dengan pesan asisten, ditambah objek usage yang menghitung token input dan output. Blok usage itu adalah meteran penagihan Anda, catat dari awal.
Tip: ID model terkadang berbeda antara API asli dan pengecer (OpenRouter mencantumkannya sebagai x-ai/grok-4.6, misalnya). Jika Anda mendapatkan kesalahan model not found, daftar apa yang dapat diakses kunci Anda:
curl https://api.x.ai/v1/models -H "Authorization: Bearer $XAI_API_KEY"
Langkah 3: Python dan JavaScript
Karena API ini kompatibel dengan OpenAI, SDK resmi OpenAI berfungsi dengan dua baris yang diubah: URL dasar dan kuncinya.
Python:
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["XAI_API_KEY"],
base_url="https://api.x.ai/v1",
)
response = client.chat.completions.create(
model="grok-4-6",
messages=[
{"role": "system", "content": "Anda adalah asisten teknis yang ringkas."},
{"role": "user", "content": "Tulis fungsi Python yang memvalidasi alamat email."},
],
)
print(response.choices[0].message.content)
print(response.usage)
JavaScript / TypeScript:
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.XAI_API_KEY,
baseURL: "https://api.x.ai/v1",
});
const response = await client.chat.completions.create({
model: "grok-4-6",
messages: [
{ role: "system", content: "Anda adalah asisten teknis yang ringkas." },
{ role: "user", content: "Tulis penjaga tipe TypeScript untuk objek Pengguna." },
],
});
console.log(response.choices[0].message.content);
Kompatibilitas ini juga berarti migrasi ke arah mana pun murah. Jika Anda sudah menjalankan API GPT-5.6, Anda dapat menguji A/B Grok 4.6 melawannya di balik satu flag konfigurasi.
Langkah 4: Respons streaming
Untuk apa pun yang berhadapan dengan pengguna, gunakan streaming. Grok 4.6 disetel untuk output multi-langkah yang panjang, dan membuat pengguna menatap spinner untuk respons 2.000 token adalah pertukaran yang buruk.
stream = client.chat.completions.create(
model="grok-4-6",
messages=[{"role": "user", "content": "Refaktor fungsi ini dan jelaskan setiap perubahan: ..."}],
stream=True,
)
for chunk in stream:
delta = chunk.choices[0].delta.content
if delta:
print(delta, end="", flush=True)
Respons streaming tiba sebagai peristiwa yang dikirim server (SSE). Sulit untuk diperiksa di terminal setelah Anda men-debug, setiap bagian adalah baris data: yang terpisah, dan penanganan yang salah muncul sebagai token yang hilang atau UI yang macet. Apidog merender aliran SSE secara real time di panel responsnya, yang membuatnya jelas apakah macet karena model sedang berpikir atau klien Anda melakukan buffering.
Langkah 5: Manfaatkan konteks 500K, dengan hati-hati
Jendela 500.000 token dapat memuat seluruh basis kode berukuran sedang atau beberapa ratus halaman dokumen. Dua peringatan sebelum Anda menyerahkan semuanya kepadanya:
- Biaya berskala dengan input. Dengan $2 per juta token input, prompt 500K-token penuh berharga sekitar $1 per permintaan sebelum model menulis sepatah kata pun. Untuk kueri berulang pada korpus yang sama, cache secara agresif atau ambil secara selektif daripada mengirim ulang semuanya.
- Posisi penting. Seperti setiap model konteks panjang, kualitas pengambilan paling kuat di dekat awal dan akhir prompt. Letakkan instruksi di atas dan pertanyaan di bawah; buang materi referensi di antaranya.
Varian cepat (harga 2x lipat) sangat berharga untuk jalur yang sensitif terhadap latensi seperti asisten coding interaktif. Untuk pekerjaan batch, analisis semalam, klasifikasi massal, tingkat standar adalah pilihan yang jelas. Perhitungan harga lengkap dan perbandingan dengan GPT-5.6 dan Claude ada di rincian harga Grok 4.5 kami, yang masih berlaku secara struktural untuk 4.6.
Uji integrasi dengan benar menggunakan Apidog
Perintah curl yang berfungsi bukanlah integrasi. Sebelum Grok 4.6 menyentuh produksi, Anda menginginkan tempat di mana permintaan diberi versi, lingkungan dipisahkan, dan kegagalan dapat direproduksi. Di sinilah Apidog mendapatkan tempatnya dalam alur kerja:

- Buat proyek dan tambahkan lingkungan dengan
base_url = https://api.x.ai/v1danXAI_API_KEYAnda sebagai variabel lingkungan. Kunci dev dan prod tetap terpisah dengan rapi. - Bangun permintaan penyelesaian obrolan sekali, dengan autentikasi yang diwarisi dari lingkungan. Setiap rekan tim sekarang mencapai endpoint yang sama dengan cara yang sama.
- Periksa streaming secara visual. Apidog menampilkan bagian SSE saat tiba, sehingga Anda dapat melihat output token-per-token dan segera melihat kemacetan atau pemotongan.
- Tambahkan asersi. Validasi bahwa
choices[0].message.contenttidak kosong, bahwausage.total_tokenstetap di bawah anggaran, dan bahwa waktu respons memenuhi SLA Anda, lalu jalankan ini sebagai skenario pengujian otomatis di CI. - Mock endpoint. Mock cerdas Apidog mengembalikan respons berbentuk Grok yang realistis, sehingga kode frontend dan agen dapat berkembang terhadap tiruan yang stabil saat Anda melakukan iterasi pada prompt, tanpa membakar token.
Poin terakhir itu lebih penting dari kedengarannya. Perulangan agen yang memanggil model puluhan kali per tugas menjadi mahal untuk diuji terhadap API langsung. Mocking jalur yang mulus dan menguji hal yang sebenarnya secara terpisah menjaga CI tetap cepat dan tagihan Anda tetap wajar.
Kesalahan umum dan perbaikan cepat
| Kesalahan | Kemungkinan penyebab | Perbaikan |
|---|---|---|
401 Unauthorized |
Header Authorization hilang atau salah format |
Periksa prefiks Bearer dan pastikan variabel env diatur di shell yang Anda gunakan |
404 model not found |
ID model salah untuk penyedia Anda | Daftar /v1/models; pengecer menggunakan ID yang berbeda (misalnya, x-ai/grok-4.6 di OpenRouter) |
429 Too Many Requests |
Batas tarif atau kuota habis | Mundur secara eksponensial; periksa penggunaan di console.x.ai |
| Output terpotong | max_tokens disetel terlalu rendah untuk jawaban agentic yang panjang |
Naikkan batasnya; Grok 4.6 bertele-tele pada tugas multi-langkah secara desain |
| Aliran macet | Buffering klien, proxy menghilangkan SSE | Konfirmasi stream: true, nonaktifkan buffering proxy, uji aliran mentah di Apidog |
FAQ
Apakah API Grok 4.6 kompatibel dengan OpenAI? Ya. Endpoint penyelesaian obrolan menerima bentuk permintaan yang sama, dan SDK resmi OpenAI berfungsi dengan mengarahkan base_url ke https://api.x.ai/v1.
Berapa biaya API Grok 4.6? $2 per juta token input dan $6 per juta token output. Varian yang lebih cepat harganya dua kali lipat. Tidak ada biaya terpisah untuk konteks 500K, Anda membayar token yang benar-benar Anda kirim.
Apakah saya memerlukan integrasi baru jika saya menggunakan Grok 4.5? Tidak. Tukar nama model. Format permintaan, autentikasi, dan endpoint tidak berubah dari Grok 4.5.
Bisakah saya menggunakan Grok 4.6 tanpa akun xAI? Ya, melalui OpenRouter, Vercel AI Gateway, atau Cloudflare, masing-masing dengan penagihannya sendiri. API asli biasanya merupakan jalur termurah untuk volume tinggi.
