OpenAI Memangkas Harga API GPT-5.6: Luna Turun 80%, Terra Turun 20% (Rincian Harga Baru)

OpenAI memangkas harga API GPT-5.6 pada 30 Juli 2026: Luna turun 80% menjadi $0,20/$1,20 per juta token, Terra 20% menjadi $2/$12. Kartu tarif lama-vs-baru lengkap, mengapa OpenAI memangkas harga, dan cara mengalihkan beban kerja Anda.

Ashley Innocent

Ashley Innocent

31 July 2026

OpenAI Memangkas Harga API GPT-5.6: Luna Turun 80%, Terra Turun 20% (Rincian Harga Baru)

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

OpenAI memangkas harga API pada dua dari tiga model GPT-5.6-nya pada 30 Juli 2026. GPT-5.6 Luna kini 80% lebih murah: $0,20 per juta token input dan $1,20 per juta token output. GPT-5.6 Terra turun 20% menjadi $2 untuk input dan $12 untuk output. GPT-5.6 Sol, model penalaran unggulan, mempertahankan tarif $5 dan $30 tetapi mendapatkan mode Cepat baru yang berjalan 2,5x lebih cepat dengan harga dua kali lipat dari standar.

Jika Anda membangun model biaya Anda berdasarkan harga peluncuran GPT-5.6, perhitungan tersebut kini sudah usang. Postingan ini membahas daftar harga baru, mengapa OpenAI memangkas harga, bagaimana angka-angka tersebut dibandingkan dengan tingkatan Gemini Flash Google, dan apa yang perlu diubah dalam perutean API Anda minggu ini. Dan karena cara tercepat untuk membandingkan biaya model adalah dengan menguji permintaan yang sama terhadap setiap tingkatan, alat seperti Apidog mempermudah pengiriman satu prompt melalui Sol, Terra, dan Luna secara bersamaan dan mengukur pengeluaran token sebelum Anda berkomitmen.

button

Daftar harga GPT-5.6 yang baru

Berikut adalah perbandingan lengkap sebelum dan sesudah, per juta token:

Model Input lama Input baru Output lama Output baru Perubahan
GPT-5.6 Sol $5.00 $5.00 $30.00 $30.00 Tidak ada perubahan
GPT-5.6 Terra $2.50 $2.00 $15.00 $12.00 -20%
GPT-5.6 Luna $1.00 $0.20 $6.00 $1.20 -80%

Harga baru mulai berlaku pada 30 Juli 2026 dan berlaku untuk tingkatan API standar. Selisih antara batas atas dan bawah keluarga model melonjak dari 5x pada ketersediaan umum pada 9 Juli menjadi 25x hari ini. Kesenjangan tersebut mengubah keputusan perutean. Tiga minggu yang lalu, mengirimkan tugas ke Luna daripada Sol menghemat 80% dari tagihan. Sekarang menghemat 96%.

Diskon caching prompt masih berlaku di atas tarif ini. OpenAI belum menerbitkan harga input yang di-cache terpisah untuk tarif Luna dan Terra yang baru dalam pengumumannya, jadi periksa halaman harga resmi sebelum Anda memperbarui perkiraan penagihan yang bergantung pada pembacaan cache.

Apa yang terjadi pada Sol

Harga jual Sol tidak berubah, tetapi opsi kecepatannya berubah. OpenAI memperkenalkan mode Cepat untuk Sol: generasi token 2,5x lebih cepat dengan tarif dua kali lipat dari standar. Mode Cepat menggantikan tingkatan Pemrosesan Prioritas sebelumnya, jadi jika lalu lintas produksi Anda berjalan pada Pemrosesan Prioritas hari ini, Anda perlu memigrasikan konfigurasi tersebut dan memeriksa ulang baris faktur tempatnya mendarat.

Bacaan praktisnya: OpenAI mengsegmentasikan Sol berdasarkan latensi alih-alih mendiskonnya. Tim yang membutuhkan penalaran unggulan pada kecepatan interaktif membayar premium untuk itu. Semua orang lainnya merute ke bawah dalam keluarga model, yang justru merupakan tempat pemotongan harga mendorong Anda.

Mengapa OpenAI memangkas harga

OpenAI membingkai pemotongan harga sebagai perolehan efisiensi yang diteruskan, bukan langkah rugi-untung. Pengumuman tersebut mengkreditkan empat pendorong:

Yang terakhir adalah detail yang patut diingat. OpenAI mengatakan Sol secara otonom menulis ulang kernel penyajian, memotong overhead penyajian end-to-end sebesar 20% dan meningkatkan efisiensi generasi token lebih dari 15%. "Menjadikan kecerdasan canggih lebih melimpah dan terjangkau adalah inti dari misi OpenAI," kata perusahaan itu dalam pengumumannya. Apa pun pendapat Anda tentang kerangka misi tersebut, mekanismenya konkret: model tersebut kini cukup murah untuk dilayani sehingga OpenAI dapat menurunkan harga Luna 80% dan tetap melindungi margin.

Ada juga pendorong persaingan yang jelas. Liputan VentureBeat membingkai pemotongan harga sebagai respons langsung terhadap tingkatan Flash Google. Harga gabungan Luna (input ditambah output) kini $1,40 per juta token, mengungguli keduanya Gemini 3.5 Flash-Lite seharga $2,80 dan Gemini 3.6 Flash seharga $9. Ujung murah dari frontier adalah tempat volume berada, dan OpenAI ingin mendapatkannya kembali.

Apa arti pemotongan harga bagi beban kerja Anda

Pemotongan Luna 80% adalah yang mengubah keputusan arsitektur, bukan pemotongan Terra 20%. Beberapa perubahan konkret:

Lingkaran agen menjadi murah. Beban kerja agen membakar token dalam rantai panjang: merencanakan, memanggil alat, membaca hasilnya, mencoba lagi. Dengan $1 input dan $6 output, menjalankan lingkaran tersebut di Luna dapat dipertahankan. Dengan $0,20 dan $1,20, itu adalah default. Pengumuman OpenAI sendiri menyebut lingkaran agen yang kompleks sebagai beban kerja yang dibuka oleh harga Luna yang baru.

Klasifikasi, ekstraksi, dan ringkasan berpindah ke tingkatan bawah. Jika Anda tetap menggunakan Terra karena margin kualitas Luna terasa tipis, jalankan kembali evaluasi. Kualitasnya tidak berubah; harganya yang berubah. Beban kerja yang harganya $100 sehari di Terra akan menelan biaya sekitar $11 di Luna dengan tarif baru.

Terra sebagai default menjadi lebih murah untuk dipertahankan. Analisis Sol vs Terra vs Luna kami merekomendasikan Terra sebagai default yang masuk akal untuk pekerjaan sehari-hari. Saran itu tetap berlaku, dan sekarang 20% lebih murah untuk diikuti.

Tombol upaya masih lebih penting daripada daftar harga. GPT-5.6 mengekspos enam tingkat upaya penalaran, dan upaya yang lebih tinggi menghasilkan lebih banyak token sisi output, yang merupakan arah yang mahal di setiap tingkatan. Pemotongan harga tidak memperbaiki pengaturan upaya yang terlalu besar.

Bagaimana cara memeriksa ulang angka Anda sendiri

Jangan mempercayai persentasenya secara membabi buta; ukur lalu lintas aktual Anda. Alur kerja yang mendeteksi kejutan lebih awal:

  1. Ambil sampel representatif dari prompt produksi.
  2. Kirim permintaan yang sama ke gpt-5.6-luna, gpt-5.6-terra, dan gpt-5.6-sol dan tangkap jumlah token per respons.
  3. Kalikan dengan tarif baru dan bandingkan dengan kualitas pada set evaluasi Anda sendiri.

Apidog membuat langkah 2 cepat: definisikan endpoint penyelesaian chat sekali, ganti ID model dengan variabel lingkungan, dan jalankan skenario pengujian yang sama terhadap ketiga tingkatan. Penampil respons menunjukkan blok usage per panggilan, sehingga Anda mendapatkan jumlah token input dan output yang sebenarnya, bukan perkiraan. Jika Anda pertama kali mengintegrasikan GPT-5.6 ke dalam aplikasi, panduan kami untuk menggunakan API GPT-5.6 akan memandu Anda melalui autentikasi, ID model, dan bentuk permintaan. Anda juga dapat memalsukan endpoint saat Anda menunggu persetujuan anggaran, lalu beralih ke lalu lintas langsung tanpa menulis ulang pengujian. Unduh Apidog gratis untuk menjalankan perbandingan.

Gambaran yang lebih besar: perang harga sedang berlangsung

Ini adalah pergerakan harga besar ketiga di ujung murah dari frontier musim panas ini. Google menyegarkan tingkatan Flash-nya pada bulan Juli, Anthropic meluncurkan Claude Opus 5 dengan setengah harga Fable 5, dan sekarang OpenAI telah memangkas Luna di bawah kedua opsi Gemini Flash. Kualitas model masih memisahkan yang unggulan, tetapi tingkatan pekerja keras semakin menyatu pada aturan sederhana: siapa pun yang termurah bulan ini memenangkan pekerjaan batch.

Untuk tim API, itu berarti pilihan model bukan lagi keputusan tahunan. Bangun integrasi Anda sehingga ID model adalah nilai konfigurasi, pertahankan rangkaian evaluasi yang ada, dan jalankan kembali perbandingan biaya setiap kali vendor bergerak. Tim yang memperlakukan perutean model sebagai infrastruktur, dengan pengujian dan pemantauan di sekitarnya, menangkap setiap pemotongan harga dalam hitungan hari alih-alih kuartal.

FAQ

Berapa harga API GPT-5.6 yang baru?

Per 30 Juli 2026: Luna berharga $0,20 per juta token input dan $1,20 per juta token output; Terra berharga $2 dan $12; Sol tidak berubah pada $5 dan $30. Sol juga mendapatkan mode Cepat dengan harga dua kali lipat dari standar untuk pemrosesan 2,5x lebih cepat.

Apakah GPT-5.6 Sol mendapatkan pemotongan harga?

Tidak. Tarif standar Sol tidak berubah. Perubahan pada Sol bersifat struktural: mode Cepat baru menggantikan tingkatan Pemrosesan Prioritas, menukar harga dua kali lipat dengan kecepatan 2,5x.

Apakah GPT-5.6 Luna sekarang lebih murah daripada Gemini Flash?

Berdasarkan harga jual, ya. Tarif gabungan input-plus-output Luna adalah $1,40 per juta token dibandingkan dengan $2,80 untuk Gemini 3.5 Flash-Lite dan $9 untuk Gemini 3.6 Flash. Namun, harga bukanlah kualitas: jalankan keduanya terhadap set evaluasi Anda sendiri sebelum beralih. Jika Anda menginginkan rute gratis terlebih dahulu, lihat cara menggunakan GPT-5.6 secara gratis.

Apakah pemotongan harga berlaku secara otomatis?

Ya. Tarif baru berlaku untuk penggunaan API standar mulai 30 Juli 2026 tanpa perlu perubahan kode. Anda hanya perlu bertindak jika Anda menggunakan Pemrosesan Prioritas pada Sol, yang sedang digantikan oleh mode Cepat.

Apa yang harus dilakukan minggu ini

Daftar harga baru memberi penghargaan kepada tim yang bergerak cepat. Jalankan kembali model biaya Anda dengan angka baru, evaluasi ulang beban kerja mana yang dapat diserap Luna dengan harga 96% di bawah harga Sol, dan periksa apakah pemotongan 20% Terra mengubah ambang batas perutean apa pun. Kemudian verifikasi dengan lalu lintas nyata alih-alih perhitungan harga jual: satu skenario pengujian di Apidog, tiga ID model, dan angka usage akan memberi tahu Anda persis berapa nilai pemotongan tersebut bagi Anda.

button

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.