GPT-6.1 Sol และ Claude Sonnet 5.5 มีราคาเท่ากันที่ 2 ดอลลาร์ต่อล้านโทเค็นอินพุต และ 10 ดอลลาร์ต่อล้านโทเค็นเอาต์พุต และเปิดตัวห่างกันเพียงวันเดียว: Sonnet 5.5 เมื่อวันที่ 28 กันยายน 2026 และ GPT-6.1 Sol เมื่อวันที่ 29 กันยายน ผู้จำหน่ายทั้งสองไม่ได้เปรียบเทียบประสิทธิภาพของโมเดลตนเองกับของอีกฝ่าย OpenAI เปรียบเทียบ GPT-6.1 Sol กับ Claude Opus 5.5 และ Fable 5.1 ในขณะที่ Anthropic เปรียบเทียบ Sonnet 5.5 กับ GPT-6 Sol ซึ่งเป็น Sol รุ่นก่อนหน้า วิธีที่ซื่อสัตย์ในการเลือกคือการทดลองใช้ทั้งสองโมเดลกับงานของคุณเอง และเปรียบเทียบต้นทุนต่องาน ไม่ใช่ราคาต่อโทเค็น
ด้านล่างนี้: ข้อมูลจำเพาะและราคาเปรียบเทียบกัน, สิ่งที่ผู้จำหน่ายแต่ละรายอ้างและเปรียบเทียบกับโมเดลใด, ตัวเลขจากบุคคลที่สาม (ทั้งหมดเป็นของ GPT-6 Sol ไม่ใช่ 6.1) และวิธีการเปรียบเทียบด้วยตัวคุณเองใน Apidog สำหรับแต่ละโมเดล สามารถดูข้อมูลเพิ่มเติมได้ที่ GPT-6.1 Sol คืออะไร และ Claude Sonnet 5.5 คืออะไร
GPT-6.1 Sol เทียบกับ Claude Sonnet 5.5: ข้อมูลจำเพาะและราคา
แหล่งที่มา: หน้าข้อมูลราคา ของ OpenAI, ภาพรวม Sonnet 5.5 และ ราคา ของ Anthropic รวมถึงหน้าโมเดล GPT-6.1 Sol ที่เชื่อมโยงไว้ด้านล่าง
| GPT-6.1 Sol | Claude Sonnet 5.5 | |
|---|---|---|
| รหัสโมเดล | gpt-6.1-sol |
claude-sonnet-5-5 (Bedrock: anthropic.claude-sonnet-5-5) |
| เปิดตัว | 29 ก.ย. 2026 | 28 ก.ย. 2026 |
| อินพุต / เอาต์พุต ต่อ 1M | $2 / $10 | $2 / $10 |
| การอ่านแคช ต่อ 1M | $0.10 | $0.20 |
| การเขียนแคช ต่อ 1M | $2.50 | $2.50 (5 นาที), $4 (1 ชั่วโมง) |
| แบตช์ ต่อ 1M | $1 / $5 | $1 / $5 |
| พร้อมท์ที่เกิน 272K โทเค็นอินพุต | อินพุต $4, แคช $0.20, เอาต์พุต $15 สำหรับการร้องขอทั้งหมด | ไม่มีค่าพรีเมียมภายในช่วง 1M |
| ระดับความเร็วสูงขึ้น | Fast ที่ $4 / $20; Ultrafast “เร็วๆ นี้” | โหมด Fast ไม่พร้อมใช้งาน |
| หน้าต่างบริบท | 1,050,000 (อินพุตสูงสุด 922,000) | 1M |
| เอาต์พุตสูงสุด | 128,000 | 128K (300K สำหรับ Batch พร้อมส่วนหัวเบต้า) |
| วันที่ตัดข้อมูล | 30 เม.ย. 2026 | มิ.ย. 2026 |
| ระดับความพยายาม | low, medium (ค่าเริ่มต้น), high, xhigh, max; ไม่มี none |
low, medium, high (ค่าเริ่มต้น API), xhigh, max; การคิดไม่สามารถปิดได้ (การตั้งค่าต่ำสุด: between_tools) |
| รูปแบบ API | Responses (พร้อมเครื่องมือ), Chat Completions (ไม่มีเครื่องมือ), Batch | Messages, Batch |
| แพลตฟอร์มอื่น ๆ | OpenRouter (openai/gpt-6.1-sol) |
Bedrock, Google Cloud, Microsoft Foundry, Claude Platform บน AWS |
| การเข้าถึงฟรี | ไม่มี. ผู้ใช้ Plus, Pro, Business, Enterprise และ Edu สามารถใช้งานได้ใน ChatGPT Work และ Codex (ไม่รวม Chat; Enterprise และ Edu เมื่อผู้ดูแลระบบเปิดใช้งานตาม เอกสารโมเดล); ไม่มี API แบบฟรี | ทุกคนสามารถสนทนากับได้ที่ Claude.ai; แต่ API จะเรียกเก็บเงินตามโทเค็น |
สองแถวมีความสำคัญต่อต้นทุนมากที่สุด การอ่านแคชของ GPT-6.1 Sol มีราคาถูกกว่า Sonnet 5.5 ครึ่งหนึ่ง ดังนั้นการใช้พรอมต์ระบบที่ยาวซ้ำๆ จะถูกกว่าบน OpenAI เมื่อเกิน 272K โทเค็นอินพุต ราคาจะกลับกัน: หน้าโมเดล GPT-6.1 Sol กำหนดราคาคำขอทั้งหมดเป็น 2 เท่าของอัตราอินพุตและแคช และ 1.5 เท่าของเอาต์พุต ในขณะที่ Sonnet 5.5 ยังคงอยู่ที่ 2 ดอลลาร์และ 10 ดอลลาร์ พรอมต์ขนาด 400,000 โทเค็นพร้อมคำตอบ 5,000 โทเค็นมีค่าใช้จ่ายประมาณ 1.68 ดอลลาร์บน GPT-6.1 Sol และ 0.85 ดอลลาร์บน Sonnet 5.5 โดยไม่ได้ใช้แคช
สิ่งที่ผู้จำหน่ายแต่ละรายอ้าง และเปรียบเทียบกับโมเดลใด
| OpenAI เกี่ยวกับ GPT-6.1 Sol | Anthropic เกี่ยวกับ Claude Sonnet 5.5 | |
|---|---|---|
| เปรียบเทียบกับ | GPT-6 Sol, GPT-6 Astra, Claude Opus 5.5, Claude Fable 5.1 | Sonnet 5, Opus 5.5, GPT-6 Sol (GPT-5.6 Sol ในสองแผนภูมิ) |
| รวมโมเดลอื่น ๆ ด้วยหรือไม่ | ไม่ | ไม่ (GPT-6.1 Sol ยังไม่มีอยู่ในขณะนั้น) |
| หัวข้อข่าว | “ความฉลาดใกล้เคียง Astra” ในราคาโทเค็นเพียงหนึ่งในห้าของราคามาตรฐานของ Astra | เร็วกว่า Sonnet 5 30%+ ลดต้นทุนต่องานได้สูงสุด 30% |
| ใครเป็นผู้จัดทำตัวเลข | OpenAI (ผลการทดสอบคู่แข่งจากรายงานสาธารณะ ตามเชิงอรรถ) | Anthropic รวมถึง Cognition, Cursor, Artificial Analysis และ Surge AI สำหรับเกณฑ์มาตรฐานที่ระบุ |
โพสต์เปิดตัว GPT-6.1 Sol ของ OpenAI ระบุผลลัพธ์ที่ OpenAI รายงานไว้ในข้อความดังนี้:
- AutomationBench 1.0.6, ความพยายามระดับปานกลาง: ดีกว่า Opus 5.5 +2.2 เปอร์เซ็นต์พอยต์ ในราคาประมาณหนึ่งในสาม และดีกว่า GPT-6 Sol +4.8 เปอร์เซ็นต์พอยต์
- Terminal-Bench Science 0.1, ความพยายามสูงสุด: 5.47 ดอลลาร์ต่องาน เทียบกับ 23.21 ดอลลาร์สำหรับ Opus 5.5. GPT-6 Astra ยังคงได้คะแนนสูงสุดที่ 68.1%
- OSWorld 2.0 ออฟไลน์, ความพยายามสูงสุด: ดีกว่า GPT-6 Sol +7 เปอร์เซ็นต์พอยต์ ด้วยต้นทุนที่น้อยกว่าครึ่งหนึ่ง
โพสต์เปิดตัว Sonnet 5.5 ของ Anthropic มีคอลัมน์ของ GPT-6 Sol ด้วย:
- FrontierCode 1.1, ดำเนินการโดย Cognition: Sonnet 5.5 ได้คะแนน 52.1% ที่ระดับ xhigh (46.2% ที่ max) เทียบกับ 49.3% สำหรับ GPT-6 Sol ที่ความพยายามสูง Anthropic กล่าวว่า Sonnet 5.5 มีคะแนนเท่ากับคะแนนที่ดีที่สุดของ GPT-6 Sol ในราคาประมาณหนึ่งในห้า
- GDPval-AA v2.1 และ AA-Briefcase v1.1, ดำเนินการโดย Artificial Analysis: 1844 เทียบกับ 1487 และ 1811 เทียบกับ 1483
รายละเอียดเกณฑ์มาตรฐาน Sonnet 5.5 ครอบคลุมส่วนที่เหลือของตาราง Anthropic
Opus 5.5 ปรากฏในทั้งสองแผนภูมิ และผู้จำหน่ายทั้งสองรายงาน AutomationBench และ Terminal-Bench Science ดังนั้นจึงเป็นเรื่องที่น่าสนใจที่จะเชื่อมโยงข้อมูลทั้งสองชุดเข้าด้วยกัน แต่ตัวเลขไม่ตรงกัน OpenAI รายงาน AutomationBench 1.0.6 ที่ความพยายามระดับปานกลางในระบบของตนเอง ในขณะที่ตารางสรุป System Card ของ Anthropic รันโมเดล Claude ของตนที่ความพยายามสูงสุด (Sonnet 5.5 44.7, Opus 5.5 42.5; GPT-6 Sol 32.0) Anthropic ให้คะแนน Sonnet 5.5 ที่ 59.9% ใน Terminal-Bench Science แต่ข้อความของ OpenAI ไม่ได้ให้คะแนนดิบสำหรับ GPT-6.1 Sol และ OpenAI ทดสอบการใช้งานคอมพิวเตอร์บน OSWorld 2.0 แบบออฟไลน์ ส่วน Anthropic บน OSWorld 2.1 การ เปรียบเทียบ GPT-6 Sol กับ Claude Opus 5.5 ก็ประสบปัญหาเดียวกัน
สิ่งที่บุคคลที่สามวัดผล (บน GPT-6 Sol ไม่ใช่ 6.1)
การเปรียบเทียบจากบุคคลที่สามทุกรายการในผลการค้นหาจับคู่ Sonnet 5.5 กับ GPT-6 Sol ที่สมบูรณ์ที่สุดคือ Artificial Analysis ซึ่ง Intelligence Index v4.3.2 รวบรวมการประเมิน 10 รายการ:
| ความพยายาม | ดัชนี Sonnet 5.5 | ต้นทุน Sonnet 5.5 ต่องาน | ดัชนี GPT-6 Sol | ต้นทุน GPT-6 Sol ต่องาน |
|---|---|---|---|---|
| medium | 41 | $0.59 | 40 | $0.25 |
| high | 47 | $1.08 | 43 | $0.38 |
| xhigh | 52 | $2.74 | 44 | $0.52 |
| max | 56 | $7.60 | 48 | $1.05 |
ที่ความพยายามสูงสุด หน้าเดียวกันนี้วัดผล Sonnet 5.5 ที่ 138 โทเค็นเอาต์พุตต่อวินาที และ GPT-6 Sol ที่ 76 Sonnet 5.5 ได้คะแนนสูงกว่าและมีต้นทุนต่องานมากกว่าในทุกระดับความพยายามที่แสดง แม้ว่าราคาที่ระบุจะเท่ากัน การใช้โทเค็นคือความแตกต่าง Sonnet 5.5 ที่ระดับสูง (47, $1.08) อยู่ถัดจาก GPT-6 Sol ที่ระดับสูงสุด (48, $1.05)
ข้อมูลแผนภูมิของ Anthropic เองก็มีทั้งสองด้าน บน AA-Briefcase, GPT-6 Sol มีต้นทุนต่องานน้อยกว่าในทุกระดับความพยายาม (0.34 ดอลลาร์เทียบกับ 1.64 ดอลลาร์ที่ระดับปานกลาง) ในขณะที่ Sonnet 5.5 ได้คะแนนสูงกว่า บน FrontierCode, Sonnet 5.5 ที่ระดับสูงทำได้ 49.4% ด้วยต้นทุน 0.42 ดอลลาร์ต่องาน เทียบกับ 49.3% ของ GPT-6 Sol ที่ระดับสูงสุดด้วยต้นทุน 2.07 ดอลลาร์
ทั้งหมดนี้เป็นข้อมูลของ Sol รุ่นเก่า OpenAI กล่าวว่า GPT-6.1 Sol เหนือกว่า GPT-6 Sol ด้วยความพยายามที่เท่ากันหรือต่ำกว่าในเกณฑ์มาตรฐานหลายรายการ ดังนั้นคาดว่าอันดับของมันจะเปลี่ยนไปเมื่อบุคคลที่สามทำการทดสอบ
แต่ละรุ่นอาจจะแข็งแกร่งกว่าในด้านใด (ตามการนำเสนอของผู้จำหน่ายเอง)
GPT-6.1 Sol. OpenAI นำเสนอสำหรับ “การเขียนโค้ดที่ซับซ้อน, การใช้งานคอมพิวเตอร์ และงานระดับมืออาชีพ เมื่อคุณต้องการประสิทธิภาพใกล้เคียง Astra ในราคาที่ถูกลง” ข้อได้เปรียบที่ระบุคือด้านระบบอัตโนมัติแบบ agentic, การใช้งานคอมพิวเตอร์ และงานวิทยาศาสตร์ รวมถึงข้อผิดพลาดด้านข้อมูลที่ลดลงในระดับความพยายามต่ำ ในด้านราคา โมเดลนี้เหมาะกับเวิร์กโหลดที่เน้นแคชซึ่งมีอินพุตโทเค็นไม่เกิน 272K และเป็นเพียงหนึ่งในสองโมเดลที่มีระดับความเร็วแบบเสียเงิน (Fast)
Claude Sonnet 5.5. Anthropic นำเสนอสำหรับงานประจำวันที่กำหนดขอบเขตได้ดี, การแก้ไขข้อผิดพลาด, เอกสารที่จัดทำอย่างดี, สไลด์ และสเปรดชีต และกล่าวว่า Opus 5.5 “ยังคงแข็งแกร่งกว่าอย่างเห็นได้ชัดในงานที่ซับซ้อนและปลายเปิด” (ดู Sonnet 5.5 เทียบกับ Opus 5.5) จุดแข็งที่รายงานคือการเขียนโค้ดแบบ agentic (70.6% ใน Terminal-Bench 4.0 ที่ max, ดำเนินการโดย Anthropic), งานความรู้ และการใช้งานคอมพิวเตอร์ (80.1% บางส่วนใน OSWorld 2.1) ในด้านราคา โมเดลนี้เหมาะกับพรอมต์ที่เกิน 272K โทเค็น และสามารถรันบน Bedrock, Google Cloud และ Microsoft Foundry
พฤติกรรมสองอย่างอาจทำให้การทดสอบที่ไม่ซับซ้อนคลาดเคลื่อนได้ ระดับความพยายามเริ่มต้นแตกต่างกัน (medium สำหรับ GPT-6.1 Sol, high สำหรับ Sonnet 5.5 บน API) ดังนั้นควรเปรียบเทียบการตั้งค่าที่ตรงกัน และทั้งสองไม่รองรับการปรับแต่งการสุ่ม: Sonnet 5.5 จะคืนค่าเป็น 400 หากใช้ temperature, top_p หรือ top_k ที่ไม่ใช่ค่าเริ่มต้น และ คำแนะนำของ GPT-6 ของ OpenAI ระบุให้ลด temperature และ top_p ลงเมื่อระดับความพยายามไม่ใช่ none ควบคุมความผันแปรด้วยการรันซ้ำหลายครั้ง
ทดลองเปรียบเทียบด้วยตัวเองใน Apidog
เลือกงาน 20 ถึง 50 งานจากทราฟฟิกจริงของคุณที่มีคำตอบที่ตรวจสอบได้ เช่น ฟิลด์ JSON หรือป้ายกำกับ จากนั้นใน Apidog:
- สร้างสภาพแวดล้อมที่มี
OPENAI_API_KEYและANTHROPIC_API_KEYเป็นความลับ (secrets) รวมถึงEFFORT - บันทึกการร้องขอสองรายการที่ใช้ตัวแปร
{{prompt}}ร่วมกัน รูปแบบแตกต่างกัน (เอกสารอ้างอิง Responses, เอกสารอ้างอิง Messages); การเปรียบเทียบรูปแบบ API อธิบายเหตุผล:
POST https://api.openai.com/v1/responses
Authorization: Bearer {{OPENAI_API_KEY}}
Content-Type: application/json
{"model": "gpt-6.1-sol", "reasoning": {"effort": "{{EFFORT}}"},
"max_output_tokens": 25000, "input": "{{prompt}}"}
POST https://api.anthropic.com/v1/messages
x-api-key: {{ANTHROPIC_API_KEY}}
anthropic-version: 2023-06-01
content-type: application/json
{"model": "claude-sonnet-5-5", "max_tokens": 25000,
"output_config": {"effort": "{{EFFORT}}"},
"messages": [{"role": "user", "content": "{{prompt}}"}]}
- เพิ่มการยืนยันสำหรับแต่ละรูปแบบ จากนั้นเพิ่มการยืนยันคำตอบเทียบกับคอลัมน์
expected:
| ตรวจสอบ | การตอบกลับของ OpenAI | ข้อความ Anthropic |
|---|---|---|
| เสร็จสิ้นตามปกติ | $.status เท่ากับ completed |
$.stop_reason เท่ากับ end_turn |
| มีคำตอบ | $.output[*].type มี message |
$.content[*].type มี text |
| โทเค็นเอาต์พุต รวมการให้เหตุผล | $.usage.output_tokens |
$.usage.output_tokens |
| การอ่านแคช | $.usage.input_tokens_details.cached_tokens |
$.usage.cache_read_input_tokens |
| การเขียนแคช | $.usage.input_tokens_details.cache_write_tokens |
$.usage.cache_creation_input_tokens |
- กำหนดราคาการตอบกลับแต่ละครั้งในสคริปต์หลังการประมวลผล
input_tokensของ OpenAI รวมโทเค็นที่ถูกแคชและโทเค็นที่เขียนแคช ดังนั้นให้ลบออกก่อนที่จะใช้อัตรา 2 ดอลลาร์ (การแคชพรอมต์ของ OpenAI)input_tokensของ Anthropic นับเฉพาะโทเค็นหลังจากจุดหยุดแคชล่าสุด (การแคชพรอมต์ของ Anthropic) ใช้กฎ 272K กับฝั่ง OpenAI - ใส่คำขอทั้งสองลงในสถานการณ์การทดสอบเดียว เก็บพรอมต์ไว้ในบรรทัดเดียว โดยไม่มีเครื่องหมายอัญประกาศคู่ ในไฟล์ CSV และรันจาก Apidog CLI ที่ระดับความพยายามแต่ละระดับที่คุณสนใจ:
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
-d prompts.csv --env-var "EFFORT=medium" -r cli,junit
หารค่าใช้จ่ายทั้งหมดด้วยจำนวนงานที่ผ่าน: นั่นคือต้นทุนต่องานของคุณ รันอย่างน้อย medium และ high ทั้งสองโมเดล เนื่องจากชื่อระดับความพยายามเดียวกันไม่ได้ถูกปรับเทียบในลักษณะเดียวกันในผู้จำหน่ายแต่ละราย สำหรับรายละเอียดคำขอ โปรดดู คู่มือ API ของ GPT-6.1 Sol และ วิธีใช้ Claude Sonnet 5.5 API
คำถามที่พบบ่อย
- GPT-6.1 Sol ถูกกว่า Claude Sonnet 5.5 หรือไม่? ราคาที่ระบุเท่ากัน, 2 ดอลลาร์/10 ดอลลาร์ต่อ 1M การอ่านแคชของ GPT-6.1 Sol ถูกกว่า; Sonnet 5.5 ถูกกว่าสำหรับอินพุตโทเค็นที่เกิน 272K ต้นทุนจริงขึ้นอยู่กับโทเค็นที่ใช้ต่องาน
- โมเดลใดดีกว่าในการเขียนโค้ด? ไม่มีเกณฑ์มาตรฐานร่วมกัน Anthropic รายงานว่า Sonnet 5.5 เหนือกว่า GPT-6 Sol ใน FrontierCode; OpenAI รายงานว่า GPT-6.1 Sol เอาชนะคะแนน DeepSWE ที่ดีที่สุดของ GPT-6 Sol ได้ 6.4 เปอร์เซ็นต์พอยต์ ทดสอบกับ repository ของคุณเอง
- โมเดลใดเร็วกว่า? Artificial Analysis วัด Sonnet 5.5 ได้ 138 โทเค็นต่อวินาที และ GPT-6 Sol ได้ 76 โทเค็นต่อวินาที ทั้งคู่ที่ความพยายามสูงสุด ยังไม่มีตัวเลขจากบุคคลที่สามสำหรับ GPT-6.1 Sol
- มีโมเดลใดฟรีหรือไม่? GPT-6.1 Sol ไม่มีระดับฟรี Sonnet 5.5 มีให้ใช้งานในแอปแชท Claude.ai แต่ API จะเรียกเก็บเงินตามโทเค็น ดู วิธีใช้ Claude Sonnet 5.5 ฟรี
เลือกด้วยการทดลองใช้งานทั้งสอง
นำงานสิบงานจากรายการที่ต้องทำของคุณ รันทั้งสองโมเดลที่ระดับ medium และ high และเปรียบเทียบต้นทุนต่องานที่ผ่าน ดาวน์โหลด Apidog เพื่อเก็บคู่โมเดลนี้ไว้เป็นหนึ่งในสถานการณ์ที่คุณสามารถรันซ้ำได้เมื่อ Artificial Analysis เผยแพร่ตัวเลขของ GPT-6.1 Sol หรือผู้จำหน่ายรายใดรายหนึ่งออกสแนปช็อตใหม่
