GPT-6.1 Sol dan Claude Sonnet 5.5 sama-sama seharga $2 per juta token input dan $10 per juta token output, dan keduanya diluncurkan selisih satu hari: Sonnet 5.5 pada 28 September 2026, dan GPT-6.1 Sol pada 29 September. Tidak ada vendor yang membandingkan satu sama lain. OpenAI membandingkan GPT-6.1 Sol dengan Claude Opus 5.5 dan Fable 5.1, dan Anthropic membandingkan Sonnet 5.5 dengan GPT-6 Sol, Sol versi sebelumnya. Cara jujur untuk memilih adalah dengan menjalankan keduanya pada tugas Anda sendiri dan membandingkan biaya per tugas, bukan harga per token.
Di bawah ini: spesifikasi dan harga berdampingan, apa yang diklaim setiap vendor dan terhadap model mana, angka pihak ketiga (semuanya pada GPT-6 Sol, bukan 6.1), dan metode untuk menjalankan perbandingan sendiri di Apidog. Untuk setiap model secara terpisah, lihat apa itu GPT-6.1 Sol dan apa itu Claude Sonnet 5.5.
GPT-6.1 Sol vs Claude Sonnet 5.5: spesifikasi dan harga
Sumber: halaman harga OpenAI, gambaran umum Sonnet 5.5 dan harga Anthropic, ditambah halaman model GPT-6.1 Sol yang ditautkan di bawah ini.
| GPT-6.1 Sol | Claude Sonnet 5.5 | |
|---|---|---|
| ID Model | gpt-6.1-sol |
claude-sonnet-5-5 (Bedrock: anthropic.claude-sonnet-5-5) |
| Dirilis | 29 Sep 2026 | 28 Sep 2026 |
| Input / output per 1Jt | $2 / $10 | $2 / $10 |
| Pembacaan cache per 1Jt | $0.10 | $0.20 |
| Penulisan cache per 1Jt | $2.50 | $2.50 (5 menit), $4 (1 jam) |
| Batch per 1Jt | $1 / $5 | $1 / $5 |
| Prompt di atas 272K token input | $4 input, $0.20 di-cache, $15 output untuk seluruh permintaan | Tidak ada premium di seluruh jendela 1Jt |
| Tingkat lebih cepat | Cepat seharga $4 / $20; Ultrafast "segera hadir" | Mode cepat tidak tersedia |
| Jendela konteks | 1.050.000 (maks input 922.000) | 1Jt |
| Output maks | 128.000 | 128K (300K pada Batch dengan header beta) |
| Batas pengetahuan | 30 Apr 2026 | Juni 2026 |
| Tingkat usaha | low, medium (default), high, xhigh, max; tidak ada none |
low, medium, high (default API), xhigh, max; berpikir tidak dapat dimatikan (pengaturan terendah: between_tools) |
| Bentuk API | Responses (dengan alat), Chat Completions (tanpa alat), Batch | Messages, Batch |
| Platform lain | OpenRouter (openai/gpt-6.1-sol) |
Bedrock, Google Cloud, Microsoft Foundry, Claude Platform di AWS |
| Akses gratis | Tidak ada. Plus, Pro, Business, Enterprise dan Edu mendapatkannya di ChatGPT Work dan Codex (bukan Chat; Enterprise dan Edu setelah admin mengaktifkannya, per dokumen model); tidak ada tingkat API gratis | Siapa pun dapat mengobrol dengannya di Claude.ai; API menagih per token |
Dua baris paling penting untuk biaya. Pembacaan cache GPT-6.1 Sol biayanya setengah dari Sonnet 5.5, jadi menggunakan kembali prompt sistem yang panjang lebih murah di OpenAI. Di atas 272K token input, keseimbangan bergeser: halaman model GPT-6.1 Sol menetapkan harga permintaan penuh pada 2x input dan tingkat cache serta 1.5x output, sementara Sonnet 5.5 tetap pada $2 dan $10. Sebuah prompt 400.000 token dengan jawaban 5.000 token berharga sekitar $1.68 pada GPT-6.1 Sol dan $0.85 pada Sonnet 5.5, tanpa cache.
Apa yang diklaim setiap vendor, dan terhadap model mana
| OpenAI tentang GPT-6.1 Sol | Anthropic tentang Claude Sonnet 5.5 | |
|---|---|---|
| Dibandingkan dengan | GPT-6 Sol, GPT-6 Astra, Claude Opus 5.5, Claude Fable 5.1 | Sonnet 5, Opus 5.5, GPT-6 Sol (GPT-5.6 Sol di dua grafik) |
| Termasuk model lain | Tidak | Tidak (GPT-6.1 Sol belum ada) |
| Headline | "Kecerdasan mendekati Astra" dengan seperlima harga token standar Astra | 30%+ lebih cepat dari Sonnet 5, hingga 30% lebih murah per tugas |
| Siapa yang menjalankan angka | OpenAI (hasil kompetitor dari laporan publik, sesuai catatan kakinya) | Anthropic, ditambah Cognition, Cursor, Artificial Analysis, dan Surge AI untuk tolok ukur yang disebutkan |
Postingan peluncuran GPT-6.1 Sol OpenAI menyatakan hasil yang dilaporkan OpenAI ini dalam teksnya:
- AutomationBench 1.0.6, usaha medium: +2.2 pp di atas Opus 5.5 dengan biaya sekitar sepertiga, dan +4.8 pp di atas GPT-6 Sol.
- Terminal-Bench Science 0.1, usaha maksimal: $5.47 per tugas, dibandingkan $23.21 untuk Opus 5.5. GPT-6 Astra masih mencetak skor tertinggi, yaitu 68.1%.
- OSWorld 2.0 offline, usaha maksimal: +7 pp di atas GPT-6 Sol dengan biaya kurang dari separuh.
Postingan peluncuran Sonnet 5.5 Anthropic menyertakan kolom GPT-6 Sol:
- FrontierCode 1.1, dijalankan oleh Cognition: Sonnet 5.5 mencetak 52.1% pada xhigh (46.2% pada maks) versus 49.3% untuk GPT-6 Sol. Pada usaha tinggi, Anthropic mengatakan Sonnet 5.5 menyamai skor terbaik GPT-6 Sol dengan biaya sekitar seperlima.
- GDPval-AA v2.1 dan AA-Briefcase v1.1, dijalankan oleh Artificial Analysis: 1844 versus 1487, dan 1811 versus 1483.
Rincian tolok ukur Sonnet 5.5 mencakup sisa tabel Anthropic.
Opus 5.5 muncul di kedua grafik, dan kedua vendor melaporkan AutomationBench dan Terminal-Bench Science, jadi menarik untuk menjembatani keduanya. Angka-angka tidak sejalan. OpenAI melaporkan AutomationBench 1.0.6 pada usaha medium dalam harnesnya sendiri, sementara tabel ringkasan kartu sistem Anthropic menjalankan model Claude-nya pada usaha maksimal (Sonnet 5.5 44.7, Opus 5.5 42.5; GPT-6 Sol 32.0). Anthropic memberikan Sonnet 5.5 59.9% pada Terminal-Bench Science, tetapi teks OpenAI tidak memberikan skor mentah untuk GPT-6.1 Sol. Dan OpenAI menguji penggunaan komputer pada OSWorld 2.0 offline, Anthropic pada OSWorld 2.1. Perbandingan GPT-6 Sol vs Claude Opus 5.5 menghadapi tembok yang sama.
Apa yang diukur pihak ketiga (pada GPT-6 Sol, bukan 6.1)
Setiap perbandingan pihak ketiga dalam hasil pencarian memasangkan Sonnet 5.5 dengan GPT-6 Sol. Yang paling lengkap adalah Artificial Analysis, yang Indeks Kecerdasannya v4.3.2 mengumpulkan 10 evaluasi:
| Usaha | Indeks Sonnet 5.5 | Biaya Sonnet 5.5 per tugas | Indeks GPT-6 Sol | Biaya GPT-6 Sol per tugas |
|---|---|---|---|---|
| medium | 41 | $0.59 | 40 | $0.25 |
| high | 47 | $1.08 | 43 | $0.38 |
| xhigh | 52 | $2.74 | 44 | $0.52 |
| max | 56 | $7.60 | 48 | $1.05 |
Pada usaha maksimal, halaman yang sama mengukur Sonnet 5.5 pada 138 token output per detik dan GPT-6 Sol pada 76. Sonnet 5.5 mencetak skor lebih tinggi dan biaya lebih mahal per tugas pada setiap usaha yang ditunjukkan, meskipun harga daftar identik; konsumsi token adalah perbedaannya. Sonnet 5.5 pada high (47, $1.08) berada di samping GPT-6 Sol pada max (48, $1.05).
Data grafik Anthropic sendiri memiliki dua sisi. Pada AA-Briefcase, GPT-6 Sol berbiaya lebih murah per tugas pada setiap usaha ($0.34 versus $1.64 pada medium) sementara Sonnet 5.5 mencetak skor lebih tinggi. Pada FrontierCode, Sonnet 5.5 pada high mencapai 49.4% seharga $0.42 per tugas, dibandingkan 49.3% GPT-6 Sol pada max seharga $2.07.
Semua ini adalah Sol yang lebih lama. OpenAI mengatakan GPT-6.1 Sol mengalahkan GPT-6 Sol pada usaha yang sama atau lebih rendah pada beberapa tolok ukur, jadi harapkan barisnya bergeser setelah pihak ketiga mengujinya.
Di mana masing-masing kemungkinan lebih kuat, berdasarkan kerangka kerja vendor sendiri
GPT-6.1 Sol. OpenAI mengemukakannya untuk "pengodean kompleks, penggunaan komputer, dan pekerjaan profesional ketika Anda menginginkan kinerja mendekati Astra dengan biaya lebih rendah." Keuntungan yang disebutkan adalah pada otomatisasi agen, penggunaan komputer, dan tugas-tugas sains, ditambah lebih sedikit kesalahan faktual pada usaha rendah. Pada harga, ia lebih menyukai beban kerja yang banyak menggunakan cache di bawah 272K token input, dan ia satu-satunya dari keduanya yang memiliki tingkat kecepatan berbayar (Cepat).
Claude Sonnet 5.5. Anthropic mengemukakannya untuk tugas sehari-hari yang cakupannya jelas, perbaikan bug, dan dokumen, slide, serta spreadsheet yang dipoles, dan mengatakan Opus 5.5 "tetap jelas lebih kuat pada pekerjaan kompleks dan terbuka" (lihat Sonnet 5.5 vs Opus 5.5). Kekuatan yang dilaporkan adalah pengodean agen (70.6% pada Terminal-Bench 4.0 pada maks, dijalankan Anthropic), pekerjaan pengetahuan, dan penggunaan komputer (80.1% sebagian pada OSWorld 2.1). Pada harga, ia lebih menyukai prompt di atas 272K token, dan ia berjalan di Bedrock, Google Cloud, dan Microsoft Foundry.
Dua perilaku akan menyimpangkan tes yang naif. Usaha default berbeda (medium untuk GPT-6.1 Sol, high untuk Sonnet 5.5 pada API), jadi bandingkan pengaturan yang sesuai. Dan keduanya tidak memperhitungkan knob sampling: Sonnet 5.5 mengembalikan 400 pada temperature, top_p, atau top_k non-default, dan panduan GPT-6 OpenAI mengatakan untuk menurunkan temperature dan top_p ketika usaha bukan none. Kontrol variasi dengan menjalankan berulang kali.
Jalankan perbandingan sendiri di Apidog
Pilih 20 hingga 50 tugas dari lalu lintas riil Anda dengan jawaban yang dapat diperiksa, seperti bidang JSON atau label. Kemudian di Apidog:
- Buat lingkungan dengan
OPENAI_API_KEYdanANTHROPIC_API_KEYsebagai rahasia, ditambahEFFORT. - Simpan dua permintaan yang berbagi variabel
{{prompt}}. Bentuknya berbeda (referensi Responses, referensi Messages); perbandingan format API menjelaskan alasannya:
POST https://api.openai.com/v1/responses
Authorization: Bearer {{OPENAI_API_KEY}}
Content-Type: application/json
{"model": "gpt-6.1-sol", "reasoning": {"effort": "{{EFFORT}}"},
"max_output_tokens": 25000, "input": "{{prompt}}"}
POST https://api.anthropic.com/v1/messages
x-api-key: {{ANTHROPIC_API_KEY}}
anthropic-version: 2023-06-01
content-type: application/json
{"model": "claude-sonnet-5-5", "max_tokens": 25000,
"output_config": {"effort": "{{EFFORT}}"},
"messages": [{"role": "user", "content": "{{prompt}}"}]}
- Tambahkan penegasan untuk setiap bentuk, lalu satu lagi pada jawaban itu sendiri terhadap kolom
expected:
| Periksa | Respons OpenAI | Pesan Anthropic |
|---|---|---|
| Selesai normal | $.status sama dengan completed |
$.stop_reason sama dengan end_turn |
| Jawaban ada | $.output[*].type berisi message |
$.content[*].type berisi text |
| Token output, termasuk penalaran | $.usage.output_tokens |
$.usage.output_tokens |
| Pembacaan cache | $.usage.input_tokens_details.cached_tokens |
$.usage.cache_read_input_tokens |
| Penulisan cache | $.usage.input_tokens_details.cache_write_tokens |
$.usage.cache_creation_input_tokens |
- Harga setiap respons dalam skrip pasca-pemrosesan.
input_tokensOpenAI termasuk token yang di-cache dan token penulisan cache, jadi kurangkan sebelum menerapkan tarif $2 (caching prompt OpenAI).input_tokensAnthropic hanya menghitung token setelah breakpoint cache terakhir (caching prompt Anthropic). Terapkan aturan 272K di sisi OpenAI. - Masukkan kedua permintaan dalam satu skenario pengujian, jaga prompt tetap dalam satu baris, tanpa tanda kutip ganda, dalam CSV, dan jalankan dari CLI Apidog pada setiap usaha yang Anda pedulikan:
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
-d prompts.csv --env-var "EFFORT=medium" -r cli,junit
Bagi total pengeluaran dengan jumlah tugas yang berhasil: itulah biaya Anda per tugas. Jalankan setidaknya medium dan high pada keduanya, karena nama usaha yang sama tidak dikalibrasi dengan cara yang sama di seluruh vendor. Untuk detail permintaan, lihat panduan API GPT-6.1 Sol dan cara menggunakan API Claude Sonnet 5.5.
FAQ
Apakah GPT-6.1 Sol lebih murah dari Claude Sonnet 5.5? Harga daftar yang sama, $2/$10 per 1Jt. Pembacaan cache GPT-6.1 Sol lebih murah; Sonnet 5.5 lebih murah di atas 272K token input. Biaya sebenarnya tergantung pada token yang digunakan per tugas.
Mana yang lebih baik dalam pengodean? Tidak ada tolok ukur bersama. Anthropic melaporkan Sonnet 5.5 di atas GPT-6 Sol pada FrontierCode; OpenAI melaporkan GPT-6.1 Sol mengalahkan skor DeepSWE terbaik GPT-6 Sol sebesar 6.4 pp. Uji pada repo Anda sendiri.
Mana yang lebih cepat? Artificial Analysis mengukur Sonnet 5.5 pada 138 token per detik dan GPT-6 Sol pada 76, keduanya pada usaha maksimal. Belum ada angka pihak ketiga untuk GPT-6.1 Sol.
Apakah ada yang gratis? GPT-6.1 Sol tidak memiliki tingkat gratis. Sonnet 5.5 tersedia di aplikasi obrolan Claude.ai, tetapi API menagih per token. Lihat cara menggunakan Claude Sonnet 5.5 secara gratis.
Pilih dengan menjalankan keduanya
Ambil sepuluh tugas dari backlog Anda, jalankan kedua model pada medium dan high, dan bandingkan biaya per tugas yang berhasil. Unduh Apidog untuk menjaga pasangan tersebut sebagai satu skenario yang dapat Anda jalankan ulang ketika Artificial Analysis menerbitkan angka GPT-6.1 Sol atau salah satu vendor mengirimkan snapshot baru.
