Claude Haiku 5.5 vs GPT-6 Luna

Haiku 5.5 vs GPT-6 Luna: harga $0,10/$0,50 yang sama untuk di bawah 100 ribu token, tingkatan prompt panjang yang berbeda, tolok ukur Anthropic, dan data biaya per upaya.

Medy Evrard

8 October 2026

Claude Haiku 5.5 vs GPT-6 Luna

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Claude Haiku 5.5 dan GPT-6 Luna memiliki harga daftar yang sama: $0.10/$0.50 per juta token input/output untuk prompt Haiku hingga 100K token, dengan $0.01 untuk pembacaan cache dan $0.125 untuk penulisan cache pada keduanya. Perbedaannya terletak pada batas harga tersebut. Haiku 5.5 naik menjadi $0.50/$2.50 untuk lebih dari 100K token; Luna mempertahankan tarif dasarnya hingga 272K token input, kemudian mengenakan biaya 2x input dan 1.5x output. Pada tabel peluncuran Anthropic, Haiku 5.5 mendapatkan skor lebih tinggi di setiap baris yang dibandingkan. Pada bagan biaya Anthropic sendiri, Luna lebih murah per tugas di setiap tingkat upaya GDPval-AA dan pada empat dari lima di OSWorld; di OSWorld medium, Haiku 5.5 sedikit lebih murah.

tombol

Di bawah ini: harga, spesifikasi, benchmark bersama dan siapa yang menjalankannya, kurva biaya per upaya, dan perutean berdasarkan beban kerja. Untuk setiap model secara terpisah, lihat apa itu Claude Haiku 5.5 dan apa itu GPT-6 Luna. Bagian terakhir mengirimkan prompt yang sama ke keduanya di Apidog.

Harga berdampingan

Per 1 Juta token Claude Haiku 5.5 GPT-6 Luna
Input, tingkat dasar $0.10 (prompt hingga 100K token) $0.10 (hingga 272K token input)
Output, tingkat dasar $0.50 $0.50
Pembacaan cache, tingkat dasar $0.01 $0.01
Penulisan cache, tingkat dasar $0.125 (5 menit) $0.125
Tingkat lebih tinggi, input / output $0.50 / $2.50 (lebih dari 100K) $0.20 / $0.75 (lebih dari 272K)
Tingkat lebih tinggi, pembacaan / penulisan cache $0.05 / $0.625 2x tarif cache
Batch $0.05 / $0.25 hingga 100K; $0.25 / $1.25 lebih dari itu 50% dari tarif Standar (Batch dan Flex)

Sumber: dokumen harga Anthropic dan halaman model GPT-6 Luna OpenAI. OpenAI menghargai ulang "permintaan penuh" di atas 272K. Anthropic menyatakan "prompt lebih dari 100.000 token membayar harga yang lebih tinggi," dikenakan biaya per permintaan berdasarkan panjang prompt.

Di bawah 100K token, biaya cocok baris demi baris. Antara 100K dan 272K, Haiku 5.5 adalah 5x Luna untuk input dan output. Di atas 272K, keduanya berada di tingkat yang lebih tinggi, dan Luna masih lebih murah.

Dua contoh, dihitung dalam token masing-masing vendor:

Anthropic mengatakan prompt hingga 100K token merupakan sekitar 90% dari permintaan Haiku 4.5. Jika lalu lintas Anda terlihat seperti itu, sebagian besar panggilan Anda berharga sama pada kedua model. Perhitungan lebih lanjut di harga Claude Haiku 5.5.

Tokenizers menggeser ambang batas

Satu token pada satu model belum tentu sama dengan token pada model lain. Tokenizer Haiku 5.5 yang diperbarui menghasilkan sekitar 30% lebih banyak token daripada Haiku 4.5 untuk teks yang sama, menurut Anthropic. Dalam thread peluncuran Hacker News, seorang komentator memperkirakan bahwa "100K token Claude modern setara dengan ~60-65K token GPT modern." Itu adalah perkiraan komunitas, bukan angka vendor. Jika ini benar, batas 100K Haiku tercapai lebih cepat dalam hal teks daripada yang ditunjukkan oleh angka mentah. Hitung prompt Anda sendiri pada kedua API dan baca setiap objek usage.

Spesifikasi

Claude Haiku 5.5 GPT-6 Luna
ID model API claude-haiku-5-5 gpt-6-luna
Jendela konteks 1 Juta token 1.050.000 token
Output maks 128K token (300K pada Batch dengan header beta) 128.000 token
Batas pengetahuan Juni 2026 18 Mei 2026
Tingkat upaya rendah, menengah (default), tinggi, sangat tinggi, maks tidak ada, rendah, menengah (default), tinggi, sangat tinggi, maks
Berpikir nonaktif thinking: {"type": "disabled"} pada upaya tinggi atau di bawahnya none upaya penalaran
Akses obrolan gratis Pengguna Claude.ai gratis dapat memilihnya Pengguna gratis dan Go di aplikasi desktop ChatGPT

Keduanya menggunakan medium secara default. Pada Haiku 5.5, parameter tersebut adalah output_config.effort; pada Luna, itu adalah reasoning.effort. Kedua jalur obrolan gratis ini bukan kunci API, jadi tidak dapat menggerakkan skrip, pekerjaan CI, atau agen. Lihat Claude Haiku 5.5 gratis dan GPT-6 Luna gratis.

Satu perbedaan caching penting dalam loop. Pada Haiku 5.5, mengubah effort tingkat atas di antara permintaan akan membatalkan cache prompt. OpenAI mengatakan mengubah upaya penalaran tidak lagi merusak cache pada model GPT-6 (caching prompt GPT-6).

Benchmark: Tabel Anthropic, dan siapa yang menjalankan setiap sel Luna

Setiap angka di bawah ini berasal dari postingan peluncuran Anthropic dan kartu sistemnya. Anthropic menyusun tabel, tetapi pihak yang berbeda menjalankan baris yang berbeda. Hasil Haiku 5.5 berada pada upaya maksimal, sebagian besar dirata-ratakan selama lima percobaan.

Benchmark Haiku 5.5 GPT-6 Luna Bagaimana sel Luna diperoleh
GDPval-AA v2.1 (Elo) 1620 1437 Dijalankan secara independen oleh Artificial Analysis
AA-Briefcase v1.1 (Elo) 1578 1336 Dijalankan secara independen oleh Artificial Analysis
OSWorld 2.1, subset offline 72.4% 48.9% Dijalankan oleh Anthropic pada 82 tugas yang sama melalui API OpenAI
Terminal-Bench 4.0 39.2% 16.4% Papan peringkat publik, Codex CLI pada upaya maks
FrontierCode 1.1 (Utama) 46.4% 42.4% Dijalankan oleh Cognition (Claude di Claude Code, GPT di Codex)
Chartography, tanpa alat 46.4% 29.1% Seperti yang dilaporkan secara publik oleh Surge AI

Baris-baris tersebut berbagi nama benchmark, bukan rangkaian pengujian: Terminal-Bench mengadu Haiku 5.5 di Claude Code melawan Luna di Codex CLI. OSWorld adalah yang paling mendekati terkontrol, karena Anthropic menjalankan kedua model pada tugas yang sama, tetapi itu masih satu vendor yang menjalankan model pesaing.

Belum ada perbandingan langsung yang independen. Hingga 8 Oktober 2026, Artificial Analysis tidak memiliki halaman Haiku 5.5, dan kami tidak menemukan hasil Haiku 5.5 di Vals, LMArena, SWE-bench, atau Aider. Papan peringkat AA pada hari itu mencantumkan GPT-6 Luna (maks) dengan Indeks Intelijen 38 dan 129 token output per detik. Hasil lengkap Haiku 5.5: benchmark Claude Haiku 5.5.

Biaya per percobaan pada setiap tingkat upaya

Tabel peluncuran menunjukkan setiap model pada tingkat maksimal. Halaman peluncuran Anthropic juga memplot setiap tingkat upaya terhadap biaya, dengan Luna pada dua grafik.

OSWorld 2.1 (subset offline), skor kredit parsial / biaya per percobaan:

Upaya Haiku 5.5 GPT-6 Luna
Rendah 42.0% / $0.0695 19.2% / $0.038
Menengah 53.3% / $0.1257 37.5% / $0.1261
Tinggi 61.3% / $0.1827 42.3% / $0.1435
Sangat Tinggi 67.6% / $0.2792 44.8% / $0.1672
Maks 72.4% / $0.6111 48.9% / $0.205

GDPval-AA v2.1, Elo / biaya per tugas:

Upaya Haiku 5.5 GPT-6 Luna
Rendah 1125 / $0.01167 1036 / $0.0038
Menengah 1277 / $0.03042 1262 / $0.02
Tinggi 1420 / $0.08938 1344 / $0.03
Sangat Tinggi 1513 / $0.26725 1364 / $0.05
Maks 1620 / $0.86593 1437 / $0.09

Luna berbiaya lebih rendah di setiap tingkat upaya pada GDPval-AA dan pada tingkat rendah, tinggi, sangat tinggi, dan maksimal pada OSWorld. Pada OSWorld medium, Haiku 5.5 sedikit lebih murah ($0.1257 vs $0.1261). Haiku 5.5 mendapatkan skor lebih tinggi di setiap tingkat. Bandingkan pada pengeluaran yang sama:

Jadi dalam penggunaan komputer, Haiku 5.5 membeli lebih banyak skor per dolar dalam pengujian Anthropic. Dalam pekerjaan pengetahuan, keduanya dekat pada pengeluaran yang sama, dan batas bawah Luna menang ketika "cukup baik" adalah tujuannya.

Perutean: model mana untuk beban kerja mana

Anthropic menempatkan Haiku 5.5 untuk "tugas dengan cakupan sempit" dan menyatakan Sonnet 5.5 dan Opus 5.5 "tetap menjadi pilihan yang lebih baik untuk tugas pengkodean agen yang kompleks." Kedua model di sini dibangun untuk volume.

Beban Kerja Mulai dengan Mengapa
Klasifikasi, perutean, ekstraksi di bawah 100K token Keduanya; uji keduanya Harga identik; pilih berdasarkan akurasi untuk label Anda
Q&A dokumen panjang, 100K hingga 272K token GPT-6 Luna Tarif dasar berlaku hingga 272K; Haiku 5.5 adalah 5x di atas 100K
Otomatisasi browser dan desktop Claude Haiku 5.5 Skor OSWorld lebih tinggi pada biaya yang sama
Subagen di bawah Opus 5.5 atau Sonnet 5.5 Claude Haiku 5.5 Claude Code model: haiku frontmatter (Haiku 5.5 di Anthropic API)
Biaya terendah per panggilan GPT-6 Luna Harga terendah: $0.038 (OSWorld) dan $0.0038 (GDPval-AA) pada tingkat rendah
Penyusunan kerja pengetahuan pada upaya tinggi Keduanya; uji keduanya Dalam 17 Elo pada pengeluaran yang sama di GDPval-AA

Lihat Claude Haiku 5.5 di Claude Code untuk subagen dan GPT-6 Luna untuk beban kerja API bervolume tinggi untuk pipeline QPS tinggi. Berasal dari Haiku 4.5? Haiku 5.5 vs Haiku 4.5 mencantumkan lima error 400 baru.

Uji keduanya berdampingan di Apidog

Perbandingan langsung yang menyelesaikannya berjalan pada prompt Anda. Di Apidog, buat satu proyek dengan dua permintaan dan prompt yang sama:

  1. Simpan ANTHROPIC_API_KEY dan kunci OpenAI Anda sebagai variabel lingkungan.
  2. Tambahkan permintaan Haiku 5.5 di bawah, lalu permintaan Luna dengan prompt dan upaya yang sama.
  3. Pastikan bahwa stop_reason Haiku bukan "refusal" (tidak ada fallback sisi server) dan bahwa usage tetap di bawah anggaran token Anda.
  4. Jalankan keduanya pada upaya rendah, menengah, dan tinggi, dan simpan setiap respons untuk membandingkan token, latensi, dan output.
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 2048,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."}
    ]
  }'

Jangan sertakan temperature, top_p, dan top_k: nilai non-default mengembalikan error 400 pada Haiku 5.5. Panduan: cara menggunakan API Claude Haiku 5.5. Untuk set evaluasi, lihat menguji aplikasi LLM.

FAQ

Apakah Claude Haiku 5.5 dan GPT-6 Luna memiliki harga yang sama? Ya, untuk prompt Haiku hingga 100K token: $0.10/$0.50, pembacaan cache $0.01, penulisan cache $0.125. Di atas itu, Haiku 5.5 berharga $0.50/$2.50 sementara Luna tetap pada tarif dasar hingga 272K.

Model mana yang mendapat skor lebih tinggi? Haiku 5.5, pada setiap baris yang dibandingkan di tabel peluncuran Anthropic. Anthropic menyusun tabel tersebut; belum ada perbandingan langsung yang independen.

Mana yang lebih murah per tugas? Biasanya Luna: di setiap tingkat upaya pada grafik GDPval-AA Anthropic dan empat dari lima di OSWorld (pada tingkat menengah, Haiku 5.5 lebih murah $0.0004). Pada pengeluaran yang sama, Haiku 5.5 unggul di OSWorld; GDPval-AA mendekati.

Apakah salah satunya gratis? Hanya dalam obrolan: Pengguna Claude.ai gratis dapat memilih Haiku 5.5, dan pengguna gratis serta Go mendapatkan Luna di aplikasi desktop ChatGPT. Keduanya tidak memberi Anda kunci API. Lihat Claude Haiku 5.5 gratis.

Pilih berdasarkan panjang prompt, lalu uji

Periksa panjang prompt Anda terlebih dahulu. Di bawah 100K token, harga seri dan akurasi yang menentukan, di mana angka Anthropic mendukung Haiku 5.5. Antara 100K dan 272K, ambang batas Luna menghemat uang pada setiap panggilan. Kemudian jalankan keduanya pada permintaan nyata pada dua atau tiga tingkat upaya: unduh Apidog, masukkan kedua permintaan dalam satu proyek, dan biarkan angka usage yang menentukan.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.