Cara Menggunakan API Grok 4.7

Panggil Grok 4.7 melalui api.x.ai/v1/responses: ID model grok-4.7, harga $2/$6, upaya penalaran, penalaran terenkripsi, caching, alat, dan batas laju.

Medy Evrard

29 September 2026

Cara Menggunakan API Grok 4.7

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Untuk memanggil Grok 4.7, kirim permintaan POST ke https://api.x.ai/v1/responses dengan "model": "grok-4.7" dan kunci xAI Anda sebagai token Bearer. Biayanya $2 per juta token input, $0.50 per juta token input cache, dan $6 per juta token output untuk prompt di bawah 200.000 token, dengan jendela konteks 500.000 token. SpaceXAI (perusahaan yang sebelumnya bernama xAI) merilisnya pada 21 September 2026 dengan harga yang sama dengan Grok 4.6, jadi untuk sebagian besar integrasi yang ada, peningkatan ini hanya memerlukan perubahan satu baris.

tombol

Di bawah ini: permintaan pertama, upaya penalaran dan dampaknya pada tagihan Anda, penalaran terenkripsi, caching, streaming, alat, batas tarif, dan pengaturan pengujian yang dapat digunakan kembali di Apidog. Untuk latar belakang model ini, baca apa itu Grok 4.7 dan apa yang berubah; referensi resminya adalah halaman Grok 4.7 di dokumen xAI.

Sekilas API Grok 4.7

Properti Nilai
ID Model grok-4.7
Endpoint POST https://api.x.ai/v1/responses (Chat Completions masih berfungsi sebagai endpoint warisan)
Jendela Konteks 500.000 token
Batas Output Tidak ada yang terdaftar oleh xAI
Input / cache / output, di bawah 200 ribu $2.00 / $0.50 / $6.00 per 1 Juta token
Input / cache / output, 200 ribu ke atas $4.00 / $1.00 / $12.00 per 1 Juta token
Tingkat Upaya Penalaran low, medium, high (default), xhigh
Input Teks dan gambar (JPG atau PNG, hingga 20 MiB)
Alat Panggilan fungsi, pencarian web, pencarian X, eksekusi kode
Batas Pengetahuan Mei 2026
API Batch Tidak didukung

Langkah 1: dapatkan kunci dan isi kredit

Buat akun di console.x.ai, isi dengan kredit (API ini prabayar), dan buat kunci. Panduan kunci API Grok kami menjelaskan layar konsol. Jaga kunci agar tidak terekspos di kode Anda:

export XAI_API_KEY="your-key-here"

Langkah 2: buat permintaan pertama Anda

API Respons adalah endpoint utama dan yang digunakan di setiap contoh dalam dokumen xAI:

curl https://api.x.ai/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -d '{
    "model": "grok-4.7",
    "input": "Review this function for bugs: function median(a){a.sort();return a[a.length/2]}"
  }'

API ini bekerja dengan OpenAI SDK. Arahkan klien ke URL dasar xAI dan panggil responses.create:

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.XAI_API_KEY,
  baseURL: "https://api.x.ai/v1",
});

const response = await client.responses.create({
  model: "grok-4.7",
  reasoning: { effort: "medium" },
  input: [
    { role: "system", content: "You are a senior backend reviewer." },
    { role: "user", content: "Find the bug in: function median(a){a.sort();return a[a.length/2]}" },
  ],
});

console.log(response.output_text);

Jika Anda lebih suka klien lain, model yang sama adalah grok-4.7 di Python SDK xAI (xai_sdk), xai.responses('grok-4.7') di Vercel AI SDK, dan xai/grok-4.7 di LiteLLM. Dua catatan kompatibilitas: xAI sekarang melabeli Chat Completions sebagai endpoint lama, dan kompatibilitas Anthropic SDK-nya sepenuhnya tidak digunakan lagi. Kode baru harus menargetkan /v1/responses.

Langkah 3: pilih upaya penalaran

Grok 4.7 selalu melakukan penalaran. Anda tidak bisa mematikannya, tetapi Anda mengontrol seberapa keras ia berpikir dengan reasoning.effort pada Responses API (reasoning_effort di xAI SDK): low untuk panggilan alat yang sensitif terhadap latensi, medium untuk analisis dan konteks panjang, high (default) untuk masalah multi-langkah yang sulit, dan xhigh ketika kualitas lebih penting daripada waktu respons.

Pengaturan ini adalah pendorong terbesar pada tagihan Anda. Halaman rilis SpaceXAI mempublikasikan hasil CursorBench 4.0 per tingkat upaya, dan penyebarannya luas:

Upaya CursorBench 4.0 Biaya Rata-rata per Tugas Token Output Rata-rata per Tugas
low 33.1% $1.58 15,677
medium 41.6% $3.49 36,683
high 43.9% $4.69 56,382
xhigh 46.3% $6.01 70,141

Beralih dari low ke xhigh meningkatkan 13,2 poin dan biaya sekitar 3,8 kali lebih banyak per tugas, karena model menulis sekitar 4,5 kali lebih banyak token output. Mulailah dengan medium, dan tingkatkan rute hanya jika pengujian Anda sendiri menunjukkan bahwa kualitas tambahan itu penting.

Satu batasan lagi: model penalaran menolak presencePenalty, frequencyPenalty, dan stop. Jika pembungkus lama masih mengirimkan salah satunya, permintaan akan mengembalikan kesalahan.

Langkah 4: tangani penalaran terenkripsi dalam panggilan multi-giliran

Ini adalah perubahan perilaku yang paling mungkin mengejutkan Anda. Pada Responses API, grok-4.7 selalu mengembalikan reasoning.encrypted_content, bahkan ketika daftar include Anda tidak memintanya. Anda tidak dapat membaca penalaran tersebut, tetapi Anda dapat meneruskannya.

Untuk percakapan multi-giliran, teruskan item penalaran dari respons sebelumnya tanpa perubahan dalam input permintaan berikutnya. Ini menjaga penalaran model tetap utuh di seluruh giliran. Jangan mengedit, memangkas, atau menyusun ulang item tersebut. Jika kode Anda memfilter array output hingga item message sebelum membangun giliran berikutnya, sekarang ia membuang konteks yang diharapkan Grok 4.7 untuk dikembalikan. Perilaku Chat Completions tidak berubah.

Langkah 5: manfaatkan caching

Input cache berharga $0.50 per juta token dibandingkan $2 untuk input baru, diskon 75%. Masalahnya: cache hit membutuhkan permintaan Anda untuk mendarat di server yang sudah memiliki prefiks. SpaceXAI "sangat merekomendasikan" pengaturan prompt_cache_key pada panggilan Responses API (atau header x-grok-conv-id pada Chat Completions). Ini mengarahkan permintaan percakapan ke server yang sama; tanpanya, xAI memperingatkan, Anda seringkali membayar harga input penuh pada server yang tidak memiliki cache.

Urutkan prompt untuk penggunaan kembali: prompt sistem, skema alat, dan dokumen referensi terlebih dahulu, pesan pengguna baru terakhir. Apa pun yang berubah di bagian atas akan memutus prefiks dan diskonnya.

Langkah 6: streaming respons

Tambahkan "stream": true untuk menerima peristiwa yang dikirim server alih-alih satu badan JSON di akhir. Karena penalaran selalu aktif, model dapat berpikir sejenak sebelum token jawaban pertama, dan panggilan non-streaming terlihat macet atau memicu batas waktu HTTP yang singkat. Grok 4.7 mengalirkan ringkasan penalaran, sehingga Anda dapat menunjukkan kemajuan saat ia berpikir.

Panggilan fungsi adalah pengecualian: menurut dokumen xAI, panggilan fungsi tiba secara utuh dalam satu bagian. Parse saat bagian itu tiba alih-alih merakit argumen dari delta. Panduan kami tentang menguji API LLM yang streaming melalui SSE menunjukkan cara memeriksa urutan peristiwa mentah di Apidog.

Langkah 7: tambahkan alat

Panggilan fungsi menggunakan format alat Responses API. Anda menjelaskan fungsinya, Grok mengembalikan item function_call, Anda menjalankannya, dan Anda mengirim kembali function_call_output dengan call_id yang cocok:

curl https://api.x.ai/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -d '{
    "model": "grok-4.7",
    "input": [{"role": "user", "content": "Has order 10482 shipped yet?"}],
    "tools": [{
      "type": "function",
      "name": "get_order_status",
      "description": "Look up the fulfillment status of an order",
      "parameters": {
        "type": "object",
        "properties": { "order_id": {"type": "string"} },
        "required": ["order_id"]
      }
    }]
  }'

Output terstruktur juga didukung, sehingga Anda dapat menyimpan jawaban akhir ke skema JSON.

Alat sisi server berjalan di sisi xAI: {"type": "web_search"}, pencarian X, dan eksekusi kode. Mereka ditagih di atas token: pencarian web adalah $5 per 1.000 panggilan, pencarian X $5 per 1.000 postingan, dan eksekusi kode $5 per 1.000 panggilan, jadi agen yang mencari setiap giliran membayar biaya itu setiap giliran. Pencarian web menerima allowed_domains dan excluded_domains (masing-masing hingga lima). Tanpa alat pencarian, Grok 4.7 tidak memiliki data langsung; pengetahuannya berhenti pada Mei 2026.

Waspadai jurang harga 200 ribu

Tabel harga memiliki dua baris karena suatu alasan. Setelah prompt mencapai 200.000 token, seluruh permintaan akan ditagih dengan tarif yang lebih tinggi: $4 input, $1 cache, $12 output. Bukan hanya token di atas batas yang lebih mahal.

Prompt 190.000 token dengan jawaban 4.000 token berharga sekitar $0.40. Prompt 210.000 token dengan jawaban yang sama berharga sekitar $0.89. Sekitar 10% lebih banyak input lebih dari menggandakan tagihan.

Hitung token sebelum Anda mengirim, ringkas riwayat saat percakapan mendekati batas, dan gunakan pemadatan konteks xAI untuk loop agen yang panjang. Bagian murah dari jendela 500.000 token berakhir pada 200.000.

Batas tarif dan 429

Batas skala dengan pengeluaran kumulatif Anda dan cocok dengan Grok 4.6:

Tingkat (pengeluaran kumulatif) Permintaan per detik Token per menit
T0 ($0) 150 50 Juta
T1 ($50) 172 53 Juta
T2 ($250) 208 60 Juta
T3 ($1,000) 312 74 Juta
T4 ($5,000) 500 100 Juta

Token cache dihitung ke dalam token per menit. Jika melebihi, Anda akan mendapatkan HTTP 429. Coba lagi dengan exponential backoff dan jitter alih-alih membombardir endpoint; panduan kami untuk kesalahan batas tarif terlampaui mencakup pola-pola tersebut.

Migrasi dari Grok 4.6

Sebagian besar integrasi memerlukan satu perubahan: grok-4.6 menjadi grok-4.7. Harga, jendela konteks, batas tarif, dan tingkat upaya identik. Uji ulang tiga hal sebelum Anda memindahkan lalu lintas produksi:

Panduan API Grok 4.6 kami masih berlaku untuk semua yang tidak berubah. Dua catatan: https://us.api.x.ai/v1 menjaga inferensi di AS dengan premi 10%, dan Grok 4.7 Fast (harga 2x) hanya ada di Cursor dan Grok Build, bukan di API publik.

Uji API Grok 4.7 di Apidog

Permintaan yang disimpan dan dapat diulang mengalahkan perintah curl dalam riwayat shell Anda saat Anda membandingkan tingkat upaya atau memeriksa pembaruan.

  1. Buat lingkungan di Apidog dengan base_url diatur ke https://api.x.ai/v1 dan XAI_API_KEY disimpan sebagai variabel rahasia. Tambahkan lingkungan kedua untuk endpoint AS jika Anda membutuhkannya.
  2. Simpan permintaan: POST {{base_url}}/responses dengan header Authorization: Bearer {{XAI_API_KEY}} dan prompt asli Anda di badan permintaan.
  3. Tambahkan pernyataan: status adalah 200, model sama dengan grok-4.7, usage ada, dan output berisi item message. Ini menangkap kunci yang salah, ID model yang salah, atau bentuk respons yang berubah sebelum aplikasi Anda melakukannya.
  4. Kloning per tingkat upaya (low, medium, high, xhigh) dan jalankan keempatnya sebagai satu skenario pengujian. Anda mendapatkan waktu respons dan penggunaan token secara berdampingan untuk prompt Anda, bukan benchmark.
  5. Buat mock endpoint setelah bentuk respons stabil, sehingga pekerjaan frontend berlanjut tanpa menghabiskan kredit.

Saat model berikutnya dirilis, ubah satu variabel dan jalankan kembali. Unduh Apidog untuk mengaturnya.

FAQ

Apa ID model Grok 4.7? grok-4.7. Pada platform mitra, itu adalah spacexai/grok-4.7 (Vercel AI Gateway) dan x-ai/grok-4.7 (OpenRouter).

Berapa biaya API Grok 4.7? $2 per juta token input, $0.50 cache, dan $6 output untuk prompt di bawah 200.000 token, dan dua kali lipat pada 200.000 ke atas. Tidak ada diskon batch untuk 4.7.

Bisakah saya mematikan penalaran? Tidak. Gunakan upaya low untuk respons tercepat dan termurah.

Apakah ada API Grok 4.7 gratis? API xAI berjalan dengan kredit prabayar. Panduan kami tentang cara menggunakan Grok 4.7 secara gratis mencakup rute tanpa biaya yang ada.

Bagaimana perbandingan Grok 4.7 dengan GPT-6 Sol dan Claude Opus 5.5? Ia memiliki harga output terendah dari ketiganya dan tertinggal dari Opus 5.5 pada benchmark pengkodean yang dilaporkan kedua vendor. Perbandingan tiga arah memiliki angkanya.

Mulai dengan satu permintaan tersimpan

Kirim permintaan curl di atas, lalu simpan di Apidog dengan pernyataan dan skenario tingkat upaya. Anda mendapatkan biaya dasar per tugas pada prompt Anda sendiri sebelum memindahkan lalu lintas. Untuk memilih tingkat upaya default, baca rincian benchmark Grok 4.7 selanjutnya.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.