Claude Haiku 5.5 dan GPT-6 Luna memiliki harga daftar yang sama: $0.10/$0.50 per juta token input/output untuk prompt Haiku hingga 100K token, dengan $0.01 untuk pembacaan cache dan $0.125 untuk penulisan cache pada keduanya. Perbedaannya terletak pada batas harga tersebut. Haiku 5.5 naik menjadi $0.50/$2.50 untuk lebih dari 100K token; Luna mempertahankan tarif dasarnya hingga 272K token input, kemudian mengenakan biaya 2x input dan 1.5x output. Pada tabel peluncuran Anthropic, Haiku 5.5 mendapatkan skor lebih tinggi di setiap baris yang dibandingkan. Pada bagan biaya Anthropic sendiri, Luna lebih murah per tugas di setiap tingkat upaya GDPval-AA dan pada empat dari lima di OSWorld; di OSWorld medium, Haiku 5.5 sedikit lebih murah.
Di bawah ini: harga, spesifikasi, benchmark bersama dan siapa yang menjalankannya, kurva biaya per upaya, dan perutean berdasarkan beban kerja. Untuk setiap model secara terpisah, lihat apa itu Claude Haiku 5.5 dan apa itu GPT-6 Luna. Bagian terakhir mengirimkan prompt yang sama ke keduanya di Apidog.
Harga berdampingan
| Per 1 Juta token | Claude Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Input, tingkat dasar | $0.10 (prompt hingga 100K token) | $0.10 (hingga 272K token input) |
| Output, tingkat dasar | $0.50 | $0.50 |
| Pembacaan cache, tingkat dasar | $0.01 | $0.01 |
| Penulisan cache, tingkat dasar | $0.125 (5 menit) | $0.125 |
| Tingkat lebih tinggi, input / output | $0.50 / $2.50 (lebih dari 100K) | $0.20 / $0.75 (lebih dari 272K) |
| Tingkat lebih tinggi, pembacaan / penulisan cache | $0.05 / $0.625 | 2x tarif cache |
| Batch | $0.05 / $0.25 hingga 100K; $0.25 / $1.25 lebih dari itu | 50% dari tarif Standar (Batch dan Flex) |
Sumber: dokumen harga Anthropic dan halaman model GPT-6 Luna OpenAI. OpenAI menghargai ulang "permintaan penuh" di atas 272K. Anthropic menyatakan "prompt lebih dari 100.000 token membayar harga yang lebih tinggi," dikenakan biaya per permintaan berdasarkan panjang prompt.
Di bawah 100K token, biaya cocok baris demi baris. Antara 100K dan 272K, Haiku 5.5 adalah 5x Luna untuk input dan output. Di atas 272K, keduanya berada di tingkat yang lebih tinggi, dan Luna masih lebih murah.
Dua contoh, dihitung dalam token masing-masing vendor:
- Prompt 150K-token, output 2K. Haiku 5.5: 0.15 × $0.50 + 0.002 × $2.50 = $0.080. Luna: 0.15 × $0.10 + 0.002 × $0.50 = $0.016.
- Prompt 300K-token, output 2K. Haiku 5.5: 0.30 × $0.50 + 0.002 × $2.50 = $0.155. Luna: 0.30 × $0.20 + 0.002 × $0.75 = $0.0615.
Anthropic mengatakan prompt hingga 100K token merupakan sekitar 90% dari permintaan Haiku 4.5. Jika lalu lintas Anda terlihat seperti itu, sebagian besar panggilan Anda berharga sama pada kedua model. Perhitungan lebih lanjut di harga Claude Haiku 5.5.
Tokenizers menggeser ambang batas
Satu token pada satu model belum tentu sama dengan token pada model lain. Tokenizer Haiku 5.5 yang diperbarui menghasilkan sekitar 30% lebih banyak token daripada Haiku 4.5 untuk teks yang sama, menurut Anthropic. Dalam thread peluncuran Hacker News, seorang komentator memperkirakan bahwa "100K token Claude modern setara dengan ~60-65K token GPT modern." Itu adalah perkiraan komunitas, bukan angka vendor. Jika ini benar, batas 100K Haiku tercapai lebih cepat dalam hal teks daripada yang ditunjukkan oleh angka mentah. Hitung prompt Anda sendiri pada kedua API dan baca setiap objek usage.
Spesifikasi
| Claude Haiku 5.5 | GPT-6 Luna | |
|---|---|---|
| ID model API | claude-haiku-5-5 |
gpt-6-luna |
| Jendela konteks | 1 Juta token | 1.050.000 token |
| Output maks | 128K token (300K pada Batch dengan header beta) | 128.000 token |
| Batas pengetahuan | Juni 2026 | 18 Mei 2026 |
| Tingkat upaya | rendah, menengah (default), tinggi, sangat tinggi, maks | tidak ada, rendah, menengah (default), tinggi, sangat tinggi, maks |
| Berpikir nonaktif | thinking: {"type": "disabled"} pada upaya tinggi atau di bawahnya |
none upaya penalaran |
| Akses obrolan gratis | Pengguna Claude.ai gratis dapat memilihnya | Pengguna gratis dan Go di aplikasi desktop ChatGPT |
Keduanya menggunakan medium secara default. Pada Haiku 5.5, parameter tersebut adalah output_config.effort; pada Luna, itu adalah reasoning.effort. Kedua jalur obrolan gratis ini bukan kunci API, jadi tidak dapat menggerakkan skrip, pekerjaan CI, atau agen. Lihat Claude Haiku 5.5 gratis dan GPT-6 Luna gratis.
Satu perbedaan caching penting dalam loop. Pada Haiku 5.5, mengubah effort tingkat atas di antara permintaan akan membatalkan cache prompt. OpenAI mengatakan mengubah upaya penalaran tidak lagi merusak cache pada model GPT-6 (caching prompt GPT-6).
Benchmark: Tabel Anthropic, dan siapa yang menjalankan setiap sel Luna
Setiap angka di bawah ini berasal dari postingan peluncuran Anthropic dan kartu sistemnya. Anthropic menyusun tabel, tetapi pihak yang berbeda menjalankan baris yang berbeda. Hasil Haiku 5.5 berada pada upaya maksimal, sebagian besar dirata-ratakan selama lima percobaan.
| Benchmark | Haiku 5.5 | GPT-6 Luna | Bagaimana sel Luna diperoleh |
|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 1437 | Dijalankan secara independen oleh Artificial Analysis |
| AA-Briefcase v1.1 (Elo) | 1578 | 1336 | Dijalankan secara independen oleh Artificial Analysis |
| OSWorld 2.1, subset offline | 72.4% | 48.9% | Dijalankan oleh Anthropic pada 82 tugas yang sama melalui API OpenAI |
| Terminal-Bench 4.0 | 39.2% | 16.4% | Papan peringkat publik, Codex CLI pada upaya maks |
| FrontierCode 1.1 (Utama) | 46.4% | 42.4% | Dijalankan oleh Cognition (Claude di Claude Code, GPT di Codex) |
| Chartography, tanpa alat | 46.4% | 29.1% | Seperti yang dilaporkan secara publik oleh Surge AI |
Baris-baris tersebut berbagi nama benchmark, bukan rangkaian pengujian: Terminal-Bench mengadu Haiku 5.5 di Claude Code melawan Luna di Codex CLI. OSWorld adalah yang paling mendekati terkontrol, karena Anthropic menjalankan kedua model pada tugas yang sama, tetapi itu masih satu vendor yang menjalankan model pesaing.
Belum ada perbandingan langsung yang independen. Hingga 8 Oktober 2026, Artificial Analysis tidak memiliki halaman Haiku 5.5, dan kami tidak menemukan hasil Haiku 5.5 di Vals, LMArena, SWE-bench, atau Aider. Papan peringkat AA pada hari itu mencantumkan GPT-6 Luna (maks) dengan Indeks Intelijen 38 dan 129 token output per detik. Hasil lengkap Haiku 5.5: benchmark Claude Haiku 5.5.
Biaya per percobaan pada setiap tingkat upaya
Tabel peluncuran menunjukkan setiap model pada tingkat maksimal. Halaman peluncuran Anthropic juga memplot setiap tingkat upaya terhadap biaya, dengan Luna pada dua grafik.
OSWorld 2.1 (subset offline), skor kredit parsial / biaya per percobaan:
| Upaya | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Rendah | 42.0% / $0.0695 | 19.2% / $0.038 |
| Menengah | 53.3% / $0.1257 | 37.5% / $0.1261 |
| Tinggi | 61.3% / $0.1827 | 42.3% / $0.1435 |
| Sangat Tinggi | 67.6% / $0.2792 | 44.8% / $0.1672 |
| Maks | 72.4% / $0.6111 | 48.9% / $0.205 |
GDPval-AA v2.1, Elo / biaya per tugas:
| Upaya | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Rendah | 1125 / $0.01167 | 1036 / $0.0038 |
| Menengah | 1277 / $0.03042 | 1262 / $0.02 |
| Tinggi | 1420 / $0.08938 | 1344 / $0.03 |
| Sangat Tinggi | 1513 / $0.26725 | 1364 / $0.05 |
| Maks | 1620 / $0.86593 | 1437 / $0.09 |
Luna berbiaya lebih rendah di setiap tingkat upaya pada GDPval-AA dan pada tingkat rendah, tinggi, sangat tinggi, dan maksimal pada OSWorld. Pada OSWorld medium, Haiku 5.5 sedikit lebih murah ($0.1257 vs $0.1261). Haiku 5.5 mendapatkan skor lebih tinggi di setiap tingkat. Bandingkan pada pengeluaran yang sama:
- OSWorld: pada tingkat menengah, Haiku 5.5 berbiaya $0.1257 per percobaan dibandingkan Luna $0.1261 dan mencetak 53.3% dibandingkan Luna 37.5%. Haiku pada tingkat menengah juga mengalahkan Luna pada tingkat maksimal (48.9%) dengan biaya lebih rendah.
- GDPval-AA: Luna pada tingkat maksimal (1437, $0.09) dan Haiku 5.5 pada tingkat tinggi (1420, $0.08938) berbiaya sekitar sama dan berbeda 17 Elo.
Jadi dalam penggunaan komputer, Haiku 5.5 membeli lebih banyak skor per dolar dalam pengujian Anthropic. Dalam pekerjaan pengetahuan, keduanya dekat pada pengeluaran yang sama, dan batas bawah Luna menang ketika "cukup baik" adalah tujuannya.
Perutean: model mana untuk beban kerja mana
Anthropic menempatkan Haiku 5.5 untuk "tugas dengan cakupan sempit" dan menyatakan Sonnet 5.5 dan Opus 5.5 "tetap menjadi pilihan yang lebih baik untuk tugas pengkodean agen yang kompleks." Kedua model di sini dibangun untuk volume.
| Beban Kerja | Mulai dengan | Mengapa |
|---|---|---|
| Klasifikasi, perutean, ekstraksi di bawah 100K token | Keduanya; uji keduanya | Harga identik; pilih berdasarkan akurasi untuk label Anda |
| Q&A dokumen panjang, 100K hingga 272K token | GPT-6 Luna | Tarif dasar berlaku hingga 272K; Haiku 5.5 adalah 5x di atas 100K |
| Otomatisasi browser dan desktop | Claude Haiku 5.5 | Skor OSWorld lebih tinggi pada biaya yang sama |
| Subagen di bawah Opus 5.5 atau Sonnet 5.5 | Claude Haiku 5.5 | Claude Code model: haiku frontmatter (Haiku 5.5 di Anthropic API) |
| Biaya terendah per panggilan | GPT-6 Luna | Harga terendah: $0.038 (OSWorld) dan $0.0038 (GDPval-AA) pada tingkat rendah |
| Penyusunan kerja pengetahuan pada upaya tinggi | Keduanya; uji keduanya | Dalam 17 Elo pada pengeluaran yang sama di GDPval-AA |
Lihat Claude Haiku 5.5 di Claude Code untuk subagen dan GPT-6 Luna untuk beban kerja API bervolume tinggi untuk pipeline QPS tinggi. Berasal dari Haiku 4.5? Haiku 5.5 vs Haiku 4.5 mencantumkan lima error 400 baru.
Uji keduanya berdampingan di Apidog
Perbandingan langsung yang menyelesaikannya berjalan pada prompt Anda. Di Apidog, buat satu proyek dengan dua permintaan dan prompt yang sama:
- Simpan
ANTHROPIC_API_KEYdan kunci OpenAI Anda sebagai variabel lingkungan. - Tambahkan permintaan Haiku 5.5 di bawah, lalu permintaan Luna dengan prompt dan upaya yang sama.
- Pastikan bahwa
stop_reasonHaiku bukan"refusal"(tidak ada fallback sisi server) dan bahwausagetetap di bawah anggaran token Anda. - Jalankan keduanya pada upaya rendah, menengah, dan tinggi, dan simpan setiap respons untuk membandingkan token, latensi, dan output.
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 2048,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."}
]
}'
Jangan sertakan temperature, top_p, dan top_k: nilai non-default mengembalikan error 400 pada Haiku 5.5. Panduan: cara menggunakan API Claude Haiku 5.5. Untuk set evaluasi, lihat menguji aplikasi LLM.
FAQ
Apakah Claude Haiku 5.5 dan GPT-6 Luna memiliki harga yang sama? Ya, untuk prompt Haiku hingga 100K token: $0.10/$0.50, pembacaan cache $0.01, penulisan cache $0.125. Di atas itu, Haiku 5.5 berharga $0.50/$2.50 sementara Luna tetap pada tarif dasar hingga 272K.
Model mana yang mendapat skor lebih tinggi? Haiku 5.5, pada setiap baris yang dibandingkan di tabel peluncuran Anthropic. Anthropic menyusun tabel tersebut; belum ada perbandingan langsung yang independen.
Mana yang lebih murah per tugas? Biasanya Luna: di setiap tingkat upaya pada grafik GDPval-AA Anthropic dan empat dari lima di OSWorld (pada tingkat menengah, Haiku 5.5 lebih murah $0.0004). Pada pengeluaran yang sama, Haiku 5.5 unggul di OSWorld; GDPval-AA mendekati.
Apakah salah satunya gratis? Hanya dalam obrolan: Pengguna Claude.ai gratis dapat memilih Haiku 5.5, dan pengguna gratis serta Go mendapatkan Luna di aplikasi desktop ChatGPT. Keduanya tidak memberi Anda kunci API. Lihat Claude Haiku 5.5 gratis.
Pilih berdasarkan panjang prompt, lalu uji
Periksa panjang prompt Anda terlebih dahulu. Di bawah 100K token, harga seri dan akurasi yang menentukan, di mana angka Anthropic mendukung Haiku 5.5. Antara 100K dan 272K, ambang batas Luna menghemat uang pada setiap panggilan. Kemudian jalankan keduanya pada permintaan nyata pada dua atau tiga tingkat upaya: unduh Apidog, masukkan kedua permintaan dalam satu proyek, dan biarkan angka usage yang menentukan.
