GPT-6.1 Sol ปะทะ Claude Sonnet 5.5: ราคา $2/$10 เท่ากัน, เปิดตัวห่างกันแค่วันเดียว, ไร้เกณฑ์มาตรฐานร่วม

GPT-6.1 Sol เทียบกับ Claude Sonnet 5.5: ราคา $2/$10 เท่ากัน, เปิดตัวห่างกันแค่วันเดียว, ไม่มีเกณฑ์มาตรฐานที่ใช้ร่วมกัน. ข้อมูลจำเพาะ, การกล่าวอ้างของผู้พัฒนา, และวิธีทดสอบทั้งสองด้วยตัวคุณเอง.

Medy Evrard

30 September 2026

GPT-6.1 Sol ปะทะ Claude Sonnet 5.5: ราคา $2/$10 เท่ากัน, เปิดตัวห่างกันแค่วันเดียว, ไร้เกณฑ์มาตรฐานร่วม

Apidog สำหรับองค์กร

การติดตั้งแบบ On-Premises

SSO & RBAC

รองรับมาตรฐาน SOC 2

สำรวจ Apidog Enterprise

GPT-6.1 Sol และ Claude Sonnet 5.5 มีราคาเท่ากันที่ 2 ดอลลาร์ต่อล้านโทเค็นอินพุต และ 10 ดอลลาร์ต่อล้านโทเค็นเอาต์พุต และเปิดตัวห่างกันเพียงวันเดียว: Sonnet 5.5 เมื่อวันที่ 28 กันยายน 2026 และ GPT-6.1 Sol เมื่อวันที่ 29 กันยายน ผู้จำหน่ายทั้งสองไม่ได้เปรียบเทียบประสิทธิภาพของโมเดลตนเองกับของอีกฝ่าย OpenAI เปรียบเทียบ GPT-6.1 Sol กับ Claude Opus 5.5 และ Fable 5.1 ในขณะที่ Anthropic เปรียบเทียบ Sonnet 5.5 กับ GPT-6 Sol ซึ่งเป็น Sol รุ่นก่อนหน้า วิธีที่ซื่อสัตย์ในการเลือกคือการทดลองใช้ทั้งสองโมเดลกับงานของคุณเอง และเปรียบเทียบต้นทุนต่องาน ไม่ใช่ราคาต่อโทเค็น

ด้านล่างนี้: ข้อมูลจำเพาะและราคาเปรียบเทียบกัน, สิ่งที่ผู้จำหน่ายแต่ละรายอ้างและเปรียบเทียบกับโมเดลใด, ตัวเลขจากบุคคลที่สาม (ทั้งหมดเป็นของ GPT-6 Sol ไม่ใช่ 6.1) และวิธีการเปรียบเทียบด้วยตัวคุณเองใน Apidog สำหรับแต่ละโมเดล สามารถดูข้อมูลเพิ่มเติมได้ที่ GPT-6.1 Sol คืออะไร และ Claude Sonnet 5.5 คืออะไร

GPT-6.1 Sol เทียบกับ Claude Sonnet 5.5: ข้อมูลจำเพาะและราคา

แหล่งที่มา: หน้าข้อมูลราคา ของ OpenAI, ภาพรวม Sonnet 5.5 และ ราคา ของ Anthropic รวมถึงหน้าโมเดล GPT-6.1 Sol ที่เชื่อมโยงไว้ด้านล่าง

GPT-6.1 Sol Claude Sonnet 5.5
รหัสโมเดล gpt-6.1-sol claude-sonnet-5-5 (Bedrock: anthropic.claude-sonnet-5-5)
เปิดตัว 29 ก.ย. 2026 28 ก.ย. 2026
อินพุต / เอาต์พุต ต่อ 1M $2 / $10 $2 / $10
การอ่านแคช ต่อ 1M $0.10 $0.20
การเขียนแคช ต่อ 1M $2.50 $2.50 (5 นาที), $4 (1 ชั่วโมง)
แบตช์ ต่อ 1M $1 / $5 $1 / $5
พร้อมท์ที่เกิน 272K โทเค็นอินพุต อินพุต $4, แคช $0.20, เอาต์พุต $15 สำหรับการร้องขอทั้งหมด ไม่มีค่าพรีเมียมภายในช่วง 1M
ระดับความเร็วสูงขึ้น Fast ที่ $4 / $20; Ultrafast “เร็วๆ นี้” โหมด Fast ไม่พร้อมใช้งาน
หน้าต่างบริบท 1,050,000 (อินพุตสูงสุด 922,000) 1M
เอาต์พุตสูงสุด 128,000 128K (300K สำหรับ Batch พร้อมส่วนหัวเบต้า)
วันที่ตัดข้อมูล 30 เม.ย. 2026 มิ.ย. 2026
ระดับความพยายาม low, medium (ค่าเริ่มต้น), high, xhigh, max; ไม่มี none low, medium, high (ค่าเริ่มต้น API), xhigh, max; การคิดไม่สามารถปิดได้ (การตั้งค่าต่ำสุด: between_tools)
รูปแบบ API Responses (พร้อมเครื่องมือ), Chat Completions (ไม่มีเครื่องมือ), Batch Messages, Batch
แพลตฟอร์มอื่น ๆ OpenRouter (openai/gpt-6.1-sol) Bedrock, Google Cloud, Microsoft Foundry, Claude Platform บน AWS
การเข้าถึงฟรี ไม่มี. ผู้ใช้ Plus, Pro, Business, Enterprise และ Edu สามารถใช้งานได้ใน ChatGPT Work และ Codex (ไม่รวม Chat; Enterprise และ Edu เมื่อผู้ดูแลระบบเปิดใช้งานตาม เอกสารโมเดล); ไม่มี API แบบฟรี ทุกคนสามารถสนทนากับได้ที่ Claude.ai; แต่ API จะเรียกเก็บเงินตามโทเค็น

สองแถวมีความสำคัญต่อต้นทุนมากที่สุด การอ่านแคชของ GPT-6.1 Sol มีราคาถูกกว่า Sonnet 5.5 ครึ่งหนึ่ง ดังนั้นการใช้พรอมต์ระบบที่ยาวซ้ำๆ จะถูกกว่าบน OpenAI เมื่อเกิน 272K โทเค็นอินพุต ราคาจะกลับกัน: หน้าโมเดล GPT-6.1 Sol กำหนดราคาคำขอทั้งหมดเป็น 2 เท่าของอัตราอินพุตและแคช และ 1.5 เท่าของเอาต์พุต ในขณะที่ Sonnet 5.5 ยังคงอยู่ที่ 2 ดอลลาร์และ 10 ดอลลาร์ พรอมต์ขนาด 400,000 โทเค็นพร้อมคำตอบ 5,000 โทเค็นมีค่าใช้จ่ายประมาณ 1.68 ดอลลาร์บน GPT-6.1 Sol และ 0.85 ดอลลาร์บน Sonnet 5.5 โดยไม่ได้ใช้แคช

สิ่งที่ผู้จำหน่ายแต่ละรายอ้าง และเปรียบเทียบกับโมเดลใด

OpenAI เกี่ยวกับ GPT-6.1 Sol Anthropic เกี่ยวกับ Claude Sonnet 5.5
เปรียบเทียบกับ GPT-6 Sol, GPT-6 Astra, Claude Opus 5.5, Claude Fable 5.1 Sonnet 5, Opus 5.5, GPT-6 Sol (GPT-5.6 Sol ในสองแผนภูมิ)
รวมโมเดลอื่น ๆ ด้วยหรือไม่ ไม่ ไม่ (GPT-6.1 Sol ยังไม่มีอยู่ในขณะนั้น)
หัวข้อข่าว “ความฉลาดใกล้เคียง Astra” ในราคาโทเค็นเพียงหนึ่งในห้าของราคามาตรฐานของ Astra เร็วกว่า Sonnet 5 30%+ ลดต้นทุนต่องานได้สูงสุด 30%
ใครเป็นผู้จัดทำตัวเลข OpenAI (ผลการทดสอบคู่แข่งจากรายงานสาธารณะ ตามเชิงอรรถ) Anthropic รวมถึง Cognition, Cursor, Artificial Analysis และ Surge AI สำหรับเกณฑ์มาตรฐานที่ระบุ

โพสต์เปิดตัว GPT-6.1 Sol ของ OpenAI ระบุผลลัพธ์ที่ OpenAI รายงานไว้ในข้อความดังนี้:

โพสต์เปิดตัว Sonnet 5.5 ของ Anthropic มีคอลัมน์ของ GPT-6 Sol ด้วย:

รายละเอียดเกณฑ์มาตรฐาน Sonnet 5.5 ครอบคลุมส่วนที่เหลือของตาราง Anthropic

Opus 5.5 ปรากฏในทั้งสองแผนภูมิ และผู้จำหน่ายทั้งสองรายงาน AutomationBench และ Terminal-Bench Science ดังนั้นจึงเป็นเรื่องที่น่าสนใจที่จะเชื่อมโยงข้อมูลทั้งสองชุดเข้าด้วยกัน แต่ตัวเลขไม่ตรงกัน OpenAI รายงาน AutomationBench 1.0.6 ที่ความพยายามระดับปานกลางในระบบของตนเอง ในขณะที่ตารางสรุป System Card ของ Anthropic รันโมเดล Claude ของตนที่ความพยายามสูงสุด (Sonnet 5.5 44.7, Opus 5.5 42.5; GPT-6 Sol 32.0) Anthropic ให้คะแนน Sonnet 5.5 ที่ 59.9% ใน Terminal-Bench Science แต่ข้อความของ OpenAI ไม่ได้ให้คะแนนดิบสำหรับ GPT-6.1 Sol และ OpenAI ทดสอบการใช้งานคอมพิวเตอร์บน OSWorld 2.0 แบบออฟไลน์ ส่วน Anthropic บน OSWorld 2.1 การ เปรียบเทียบ GPT-6 Sol กับ Claude Opus 5.5 ก็ประสบปัญหาเดียวกัน

สิ่งที่บุคคลที่สามวัดผล (บน GPT-6 Sol ไม่ใช่ 6.1)

การเปรียบเทียบจากบุคคลที่สามทุกรายการในผลการค้นหาจับคู่ Sonnet 5.5 กับ GPT-6 Sol ที่สมบูรณ์ที่สุดคือ Artificial Analysis ซึ่ง Intelligence Index v4.3.2 รวบรวมการประเมิน 10 รายการ:

ความพยายาม ดัชนี Sonnet 5.5 ต้นทุน Sonnet 5.5 ต่องาน ดัชนี GPT-6 Sol ต้นทุน GPT-6 Sol ต่องาน
medium 41 $0.59 40 $0.25
high 47 $1.08 43 $0.38
xhigh 52 $2.74 44 $0.52
max 56 $7.60 48 $1.05

ที่ความพยายามสูงสุด หน้าเดียวกันนี้วัดผล Sonnet 5.5 ที่ 138 โทเค็นเอาต์พุตต่อวินาที และ GPT-6 Sol ที่ 76 Sonnet 5.5 ได้คะแนนสูงกว่าและมีต้นทุนต่องานมากกว่าในทุกระดับความพยายามที่แสดง แม้ว่าราคาที่ระบุจะเท่ากัน การใช้โทเค็นคือความแตกต่าง Sonnet 5.5 ที่ระดับสูง (47, $1.08) อยู่ถัดจาก GPT-6 Sol ที่ระดับสูงสุด (48, $1.05)

ข้อมูลแผนภูมิของ Anthropic เองก็มีทั้งสองด้าน บน AA-Briefcase, GPT-6 Sol มีต้นทุนต่องานน้อยกว่าในทุกระดับความพยายาม (0.34 ดอลลาร์เทียบกับ 1.64 ดอลลาร์ที่ระดับปานกลาง) ในขณะที่ Sonnet 5.5 ได้คะแนนสูงกว่า บน FrontierCode, Sonnet 5.5 ที่ระดับสูงทำได้ 49.4% ด้วยต้นทุน 0.42 ดอลลาร์ต่องาน เทียบกับ 49.3% ของ GPT-6 Sol ที่ระดับสูงสุดด้วยต้นทุน 2.07 ดอลลาร์

ทั้งหมดนี้เป็นข้อมูลของ Sol รุ่นเก่า OpenAI กล่าวว่า GPT-6.1 Sol เหนือกว่า GPT-6 Sol ด้วยความพยายามที่เท่ากันหรือต่ำกว่าในเกณฑ์มาตรฐานหลายรายการ ดังนั้นคาดว่าอันดับของมันจะเปลี่ยนไปเมื่อบุคคลที่สามทำการทดสอบ

แต่ละรุ่นอาจจะแข็งแกร่งกว่าในด้านใด (ตามการนำเสนอของผู้จำหน่ายเอง)

GPT-6.1 Sol. OpenAI นำเสนอสำหรับ “การเขียนโค้ดที่ซับซ้อน, การใช้งานคอมพิวเตอร์ และงานระดับมืออาชีพ เมื่อคุณต้องการประสิทธิภาพใกล้เคียง Astra ในราคาที่ถูกลง” ข้อได้เปรียบที่ระบุคือด้านระบบอัตโนมัติแบบ agentic, การใช้งานคอมพิวเตอร์ และงานวิทยาศาสตร์ รวมถึงข้อผิดพลาดด้านข้อมูลที่ลดลงในระดับความพยายามต่ำ ในด้านราคา โมเดลนี้เหมาะกับเวิร์กโหลดที่เน้นแคชซึ่งมีอินพุตโทเค็นไม่เกิน 272K และเป็นเพียงหนึ่งในสองโมเดลที่มีระดับความเร็วแบบเสียเงิน (Fast)

Claude Sonnet 5.5. Anthropic นำเสนอสำหรับงานประจำวันที่กำหนดขอบเขตได้ดี, การแก้ไขข้อผิดพลาด, เอกสารที่จัดทำอย่างดี, สไลด์ และสเปรดชีต และกล่าวว่า Opus 5.5 “ยังคงแข็งแกร่งกว่าอย่างเห็นได้ชัดในงานที่ซับซ้อนและปลายเปิด” (ดู Sonnet 5.5 เทียบกับ Opus 5.5) จุดแข็งที่รายงานคือการเขียนโค้ดแบบ agentic (70.6% ใน Terminal-Bench 4.0 ที่ max, ดำเนินการโดย Anthropic), งานความรู้ และการใช้งานคอมพิวเตอร์ (80.1% บางส่วนใน OSWorld 2.1) ในด้านราคา โมเดลนี้เหมาะกับพรอมต์ที่เกิน 272K โทเค็น และสามารถรันบน Bedrock, Google Cloud และ Microsoft Foundry

พฤติกรรมสองอย่างอาจทำให้การทดสอบที่ไม่ซับซ้อนคลาดเคลื่อนได้ ระดับความพยายามเริ่มต้นแตกต่างกัน (medium สำหรับ GPT-6.1 Sol, high สำหรับ Sonnet 5.5 บน API) ดังนั้นควรเปรียบเทียบการตั้งค่าที่ตรงกัน และทั้งสองไม่รองรับการปรับแต่งการสุ่ม: Sonnet 5.5 จะคืนค่าเป็น 400 หากใช้ temperature, top_p หรือ top_k ที่ไม่ใช่ค่าเริ่มต้น และ คำแนะนำของ GPT-6 ของ OpenAI ระบุให้ลด temperature และ top_p ลงเมื่อระดับความพยายามไม่ใช่ none ควบคุมความผันแปรด้วยการรันซ้ำหลายครั้ง

ทดลองเปรียบเทียบด้วยตัวเองใน Apidog

เลือกงาน 20 ถึง 50 งานจากทราฟฟิกจริงของคุณที่มีคำตอบที่ตรวจสอบได้ เช่น ฟิลด์ JSON หรือป้ายกำกับ จากนั้นใน Apidog:

  1. สร้างสภาพแวดล้อมที่มี OPENAI_API_KEY และ ANTHROPIC_API_KEY เป็นความลับ (secrets) รวมถึง EFFORT
  2. บันทึกการร้องขอสองรายการที่ใช้ตัวแปร {{prompt}} ร่วมกัน รูปแบบแตกต่างกัน (เอกสารอ้างอิง Responses, เอกสารอ้างอิง Messages); การเปรียบเทียบรูปแบบ API อธิบายเหตุผล:
POST https://api.openai.com/v1/responses
Authorization: Bearer {{OPENAI_API_KEY}}
Content-Type: application/json

{"model": "gpt-6.1-sol", "reasoning": {"effort": "{{EFFORT}}"},
 "max_output_tokens": 25000, "input": "{{prompt}}"}
POST https://api.anthropic.com/v1/messages
x-api-key: {{ANTHROPIC_API_KEY}}
anthropic-version: 2023-06-01
content-type: application/json

{"model": "claude-sonnet-5-5", "max_tokens": 25000,
 "output_config": {"effort": "{{EFFORT}}"},
 "messages": [{"role": "user", "content": "{{prompt}}"}]}
  1. เพิ่มการยืนยันสำหรับแต่ละรูปแบบ จากนั้นเพิ่มการยืนยันคำตอบเทียบกับคอลัมน์ expected:
ตรวจสอบ การตอบกลับของ OpenAI ข้อความ Anthropic
เสร็จสิ้นตามปกติ $.status เท่ากับ completed $.stop_reason เท่ากับ end_turn
มีคำตอบ $.output[*].type มี message $.content[*].type มี text
โทเค็นเอาต์พุต รวมการให้เหตุผล $.usage.output_tokens $.usage.output_tokens
การอ่านแคช $.usage.input_tokens_details.cached_tokens $.usage.cache_read_input_tokens
การเขียนแคช $.usage.input_tokens_details.cache_write_tokens $.usage.cache_creation_input_tokens
  1. กำหนดราคาการตอบกลับแต่ละครั้งในสคริปต์หลังการประมวลผล input_tokens ของ OpenAI รวมโทเค็นที่ถูกแคชและโทเค็นที่เขียนแคช ดังนั้นให้ลบออกก่อนที่จะใช้อัตรา 2 ดอลลาร์ (การแคชพรอมต์ของ OpenAI) input_tokens ของ Anthropic นับเฉพาะโทเค็นหลังจากจุดหยุดแคชล่าสุด (การแคชพรอมต์ของ Anthropic) ใช้กฎ 272K กับฝั่ง OpenAI
  2. ใส่คำขอทั้งสองลงในสถานการณ์การทดสอบเดียว เก็บพรอมต์ไว้ในบรรทัดเดียว โดยไม่มีเครื่องหมายอัญประกาศคู่ ในไฟล์ CSV และรันจาก Apidog CLI ที่ระดับความพยายามแต่ละระดับที่คุณสนใจ:
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
  -d prompts.csv --env-var "EFFORT=medium" -r cli,junit

หารค่าใช้จ่ายทั้งหมดด้วยจำนวนงานที่ผ่าน: นั่นคือต้นทุนต่องานของคุณ รันอย่างน้อย medium และ high ทั้งสองโมเดล เนื่องจากชื่อระดับความพยายามเดียวกันไม่ได้ถูกปรับเทียบในลักษณะเดียวกันในผู้จำหน่ายแต่ละราย สำหรับรายละเอียดคำขอ โปรดดู คู่มือ API ของ GPT-6.1 Sol และ วิธีใช้ Claude Sonnet 5.5 API

คำถามที่พบบ่อย

เลือกด้วยการทดลองใช้งานทั้งสอง

นำงานสิบงานจากรายการที่ต้องทำของคุณ รันทั้งสองโมเดลที่ระดับ medium และ high และเปรียบเทียบต้นทุนต่องานที่ผ่าน ดาวน์โหลด Apidog เพื่อเก็บคู่โมเดลนี้ไว้เป็นหนึ่งในสถานการณ์ที่คุณสามารถรันซ้ำได้เมื่อ Artificial Analysis เผยแพร่ตัวเลขของ GPT-6.1 Sol หรือผู้จำหน่ายรายใดรายหนึ่งออกสแนปช็อตใหม่

ฝึกการออกแบบ API แบบ Design-first ใน Apidog

ค้นพบวิธีที่ง่ายขึ้นในการสร้างและใช้ API