OpenAI ลดราคา API สำหรับโมเดล GPT-5.6 สองในสามรุ่นเมื่อวันที่ 30 กรกฎาคม 2026 GPT-5.6 Luna มีราคาลดลง 80% เหลือ $0.20 ต่อล้านโทเค็นขาเข้า และ $1.20 ต่อล้านโทเค็นขาออก GPT-5.6 Terra ลดลง 20% เหลือ $2 สำหรับขาเข้า และ $12 สำหรับขาออก GPT-5.6 Sol ซึ่งเป็นโมเดลการให้เหตุผลระดับเรือธง ยังคงราคาเดิมที่ $5 และ $30 แต่ได้เพิ่มโหมด Fast ใหม่ที่ทำงานเร็วขึ้น 2.5 เท่าในราคาเป็นสองเท่าของราคามาตรฐาน
หากคุณสร้างโมเดลต้นทุนของคุณตาม ราคาเปิดตัว GPT-5.6 การคำนวณนั้นล้าสมัยแล้ว โพสต์นี้จะกล่าวถึงอัตราราคาใหม่ เหตุผลที่ OpenAI ลดราคา การเปรียบเทียบตัวเลขกับ Gemini Flash ของ Google และสิ่งที่คุณควรเปลี่ยนแปลงในการกำหนดเส้นทาง API ของคุณในสัปดาห์นี้ และเนื่องจากวิธีที่เร็วที่สุดในการเปรียบเทียบต้นทุนโมเดลคือการทดสอบคำขอเดียวกันกับแต่ละระดับ เครื่องมืออย่าง Apidog ทำให้การส่งพรอมต์เดียวกันผ่าน Sol, Terra และ Luna แบบเคียงข้างกัน และวัดปริมาณการใช้โทเค็นก่อนที่คุณจะตัดสินใจทำได้ง่ายขึ้น
อัตราค่าบริการใหม่ของ GPT-5.6
นี่คือข้อมูลเปรียบเทียบก่อนและหลังแบบเต็ม ต่อล้านโทเค็น:
| โมเดล | ขาเข้าเก่า | ขาเข้าใหม่ | ขาออกเก่า | ขาออกใหม่ | การเปลี่ยนแปลง |
|---|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $5.00 | $30.00 | $30.00 | ไม่มีการเปลี่ยนแปลง |
| GPT-5.6 Terra | $2.50 | $2.00 | $15.00 | $12.00 | -20% |
| GPT-5.6 Luna | $1.00 | $0.20 | $6.00 | $1.20 | -80% |
ราคาใหม่มีผลบังคับใช้ตั้งแต่วันที่ 30 กรกฎาคม 2026 และใช้กับ API ระดับมาตรฐาน ส่วนต่างระหว่างราคาต่ำสุดและสูงสุดของตระกูลโมเดลนี้เพิ่มขึ้นจาก 5 เท่าเมื่อ เปิดตัวทั่วไปในวันที่ 9 กรกฎาคม เป็น 25 เท่าในวันนี้ ส่วนต่างนี้เปลี่ยนการตัดสินใจในการกำหนดเส้นทาง สามสัปดาห์ที่แล้ว การส่งงานไปที่ Luna แทน Sol ช่วยประหยัดค่าใช้จ่ายได้ 80% ตอนนี้ประหยัดได้ถึง 96%
ส่วนลดการแคชพรอมต์ยังคงใช้ได้เพิ่มเติมจากอัตราเหล่านี้ OpenAI ยังไม่ได้เผยแพร่ราคาอินพุตที่แคชแยกต่างหากสำหรับอัตรา Luna และ Terra ใหม่ในการประกาศ ดังนั้นโปรดตรวจสอบ หน้าการกำหนดราคาอย่างเป็นทางการ ก่อนที่คุณจะอัปเดตการคาดการณ์การเรียกเก็บเงินที่ขึ้นอยู่กับการอ่านแคช
เกิดอะไรขึ้นกับ Sol
ราคาตามรายการของ Sol ไม่เปลี่ยนแปลง แต่ตัวเลือกความเร็วได้เปลี่ยนไป OpenAI ได้เปิดตัวโหมด Fast สำหรับ Sol: สร้างโทเค็นได้เร็วขึ้น 2.5 เท่าในราคาเป็นสองเท่าของอัตรามาตรฐาน โหมด Fast จะมาแทนที่ระดับ Priority Processing เดิม ดังนั้น หากปริมาณการใช้งานจริงของคุณยังคงทำงานบน Priority Processing ในวันนี้ คุณจะต้องย้ายการกำหนดค่าและตรวจสอบรายการในใบแจ้งหนี้อีกครั้ง
การตีความเชิงปฏิบัติ: OpenAI กำลังแบ่งกลุ่ม Sol ตามความหน่วงแฝงแทนที่จะลดราคา ทีมที่ต้องการความสามารถในการให้เหตุผลระดับเรือธงด้วยความเร็วแบบโต้ตอบจะต้องจ่ายเพิ่มสำหรับสิ่งนี้ คนอื่นๆ จะถูกผลักให้เลือกใช้โมเดลระดับรองลงมา ซึ่งเป็นผลจากนโยบายการลดราคา
ทำไม OpenAI ถึงลดราคา
OpenAI ระบุว่าการลดราคาเป็นผลมาจากการเพิ่มประสิทธิภาพที่ส่งผ่านไปยังผู้ใช้ ไม่ใช่การลดราคาเพื่อดึงดูดลูกค้า การประกาศระบุถึงปัจจัยสี่ประการ:
- การปรับปรุงการกำหนดเส้นทางฮาร์ดแวร์ทั่วทั้งกลุ่มการอนุมาน (inference fleet)
- ซอฟต์แวร์การอนุมานสำหรับการใช้งานจริงที่ดีขึ้น
- อัลกอริทึมการแคชบริบทที่ฉลาดขึ้น
- เคอร์เนลโค้ดสำหรับการใช้งานจริงที่เขียนใหม่โดย GPT-5.6 Sol เอง
ข้อสุดท้ายนี้เป็นรายละเอียดที่ควรจดจำ OpenAI กล่าวว่า Sol ได้เขียนเคอร์เนลบริการใหม่ด้วยตนเอง ลดภาระค่าใช้จ่ายในการให้บริการแบบ end-to-end ลง 20% และปรับปรุงประสิทธิภาพการสร้างโทเค็นได้มากกว่า 15% “การทำให้ปัญญาประดิษฐ์ขั้นสูงมีอยู่มากมายและเข้าถึงได้ง่ายขึ้นเป็นหัวใจสำคัญของภารกิจของ OpenAI” บริษัทกล่าวในการประกาศ ไม่ว่าคุณจะคิดอย่างไรกับการกำหนดกรอบภารกิจนี้ กลไกมีความชัดเจน: โมเดลนี้มีราคาถูกพอที่จะให้บริการได้ ทำให้ OpenAI สามารถลดราคา Luna ลง 80% และยังคงรักษากำไรได้
นอกจากนี้ยังมีแรงผลักดันด้านการแข่งขันที่ชัดเจน รายงานของ VentureBeat ระบุว่าการลดราคาเป็นการตอบโต้โดยตรงต่อ Gemini Flash ของ Google ราคาตามรายการรวมของ Luna (ขาเข้าบวกขาออก) ตอนนี้อยู่ที่ $1.40 ต่อล้านโทเค็น ซึ่งต่ำกว่าทั้ง Gemini 3.5 Flash-Lite ที่ $2.80 และ Gemini 3.6 Flash ที่ $9 ส่วนปลายราคาถูกของเทคโนโลยีคือที่ที่ปริมาณการใช้งานอยู่ และ OpenAI ต้องการส่วนแบ่งตลาดนี้คืนมา
การลดราคาหมายถึงอะไรสำหรับภาระงานของคุณ
การลดราคา Luna 80% คือสิ่งที่จะเปลี่ยนการตัดสินใจด้านสถาปัตยกรรม ไม่ใช่การลดราคา Terra 20% การเปลี่ยนแปลงที่ชัดเจนบางประการ:
- วงจร Agent มีราคาถูกลง ภาระงานแบบ Agent (Agentic workloads) ใช้โทเค็นจำนวนมากในกระบวนการที่ยาวนาน: วางแผน, เรียกใช้เครื่องมือ, อ่านผลลัพธ์, ลองใหม่ ในราคา $1 สำหรับขาเข้า และ $6 สำหรับขาออก การรันวงจรเหล่านี้บน Luna ก็ยังพอรับได้ แต่ในราคา $0.20 และ $1.20 มันกลายเป็นค่าเริ่มต้น การประกาศของ OpenAI เองระบุว่าวงจร Agent ที่ซับซ้อนคือภาระงานที่ราคาใหม่ของ Luna ปลดล็อก
- การจำแนกประเภท การดึงข้อมูล และการสรุป จะย้ายไปสู่ระดับที่ต่ำกว่า หากคุณยังคงใช้สิ่งเหล่านี้บน Terra เพราะรู้สึกว่าคุณภาพของ Luna ยังไม่เพียงพอ ให้ลองประเมินใหม่ คุณภาพไม่เปลี่ยนแปลง แต่ราคาเปลี่ยนไป ภาระงานที่เคยมีค่าใช้จ่าย $100 ต่อวันบน Terra ตอนนี้มีค่าใช้จ่ายประมาณ $11 บน Luna ด้วยอัตราใหม่
- Terra เป็นค่าเริ่มต้นที่ถูกลงเพื่อปกป้อง การวิเคราะห์ Sol vs Terra vs Luna ของเราแนะนำ Terra เป็นค่าเริ่มต้นที่สมเหตุสมผลสำหรับงานประจำวัน คำแนะนำนั้นยังคงใช้ได้ และตอนนี้มีค่าใช้จ่ายน้อยลง 20% ในการปฏิบัติตาม
- ระดับความพยายามยังคงสำคัญกว่าอัตราค่าบริการ GPT-5.6 มีระดับความพยายามในการให้เหตุผลหกระดับ และความพยายามที่สูงขึ้นจะสร้างโทเค็นขาออกมากขึ้น ซึ่งเป็นทิศทางที่แพงกว่าในทุกระดับ การลดราคาไม่สามารถแก้ไขการตั้งค่าความพยายามที่เกินความจำเป็นได้
วิธีตรวจสอบตัวเลขของคุณอีกครั้ง
อย่าเชื่อตัวเลขเปอร์เซ็นต์โดยไม่มีการตรวจสอบ ให้วัดปริมาณการใช้งานจริงของคุณ กระบวนการทำงานที่จะช่วยให้คุณพบสิ่งที่ไม่คาดคิดได้ตั้งแต่เนิ่นๆ:
- ดึงตัวอย่างพรอมต์ที่ใช้งานจริงที่เป็นตัวแทน
- ส่งคำขอเดียวกันไปยัง
gpt-5.6-luna,gpt-5.6-terraและgpt-5.6-solและบันทึกจำนวนโทเค็นต่อการตอบสนอง - คูณด้วยอัตราใหม่และเปรียบเทียบกับคุณภาพในชุดประเมินของคุณเอง
Apidog ทำให้ขั้นตอนที่ 2 รวดเร็ว: กำหนดปลายทางของการทำ Chat Completion เพียงครั้งเดียว เปลี่ยนรหัสโมเดลด้วยตัวแปรสภาพแวดล้อม และรันสถานการณ์การทดสอบเดียวกันกับทั้งสามระดับ ตัวแสดงการตอบสนองจะแสดงบล็อก usage ต่อการเรียกใช้ ดังนั้นคุณจะได้รับจำนวนโทเค็นขาเข้าและขาออกจริงแทนการประมาณการ หากคุณกำลังเชื่อมต่อ GPT-5.6 เข้ากับแอปเป็นครั้งแรก คู่มือการใช้ GPT-5.6 API ของเราจะอธิบายขั้นตอนการยืนยันตัวตน, รหัสโมเดล และรูปแบบคำขอ คุณยังสามารถจำลองปลายทางได้ในขณะที่รอการอนุมัติงบประมาณ จากนั้นเปลี่ยนไปใช้การรับส่งข้อมูลจริงโดยไม่ต้องเขียนการทดสอบใหม่ ดาวน์โหลด Apidog ฟรีเพื่อทำการเปรียบเทียบ
ภาพรวมที่ใหญ่ขึ้น: สงครามราคาได้เริ่มขึ้นแล้ว
นี่เป็นการเคลื่อนไหวราคาครั้งสำคัญครั้งที่สามในส่วนราคาถูกของเทคโนโลยีล้ำสมัยในช่วงฤดูร้อนนี้ Google ได้ปรับปรุง Gemini Flash ในเดือนกรกฎาคม, Anthropic เปิดตัว Claude Opus 5 ในราคาครึ่งหนึ่งของ Fable 5 และตอนนี้ OpenAI ได้ลดราคา Luna ให้ต่ำกว่า Gemini Flash ทั้งสองตัวเลือก คุณภาพของโมเดลยังคงแยกแยะรุ่นเรือธงออกจากกัน แต่ระดับที่ใช้งานได้จริงกำลังเข้าสู่กฎง่ายๆ: ใครถูกที่สุดในเดือนนี้ ผู้นั้นก็ชนะงานแบบแบตช์ (batch jobs)
สำหรับทีม API นั่นหมายความว่าการเลือกโมเดลไม่ใช่การตัดสินใจประจำปีอีกต่อไป สร้างการผสานรวมของคุณให้รหัสโมเดลเป็นค่าการกำหนดค่า รักษาชุดประเมินผลอย่างต่อเนื่อง และทำการเปรียบเทียบต้นทุนใหม่ทุกครั้งที่ผู้ให้บริการมีการเปลี่ยนแปลง ทีมที่ถือว่าการกำหนดเส้นทางโมเดลเป็นโครงสร้างพื้นฐาน พร้อมการทดสอบและการตรวจสอบ จะสามารถรับประโยชน์จากการลดราคาแต่ละครั้งได้ภายในไม่กี่วัน แทนที่จะเป็นหลายไตรมาส
คำถามที่พบบ่อย
ราคา API ใหม่ของ GPT-5.6 คืออะไร?
ณ วันที่ 30 กรกฎาคม 2026: Luna มีค่าใช้จ่าย $0.20 ต่อล้านโทเค็นขาเข้า และ $1.20 ต่อล้านโทเค็นขาออก; Terra มีค่าใช้จ่าย $2 และ $12; Sol ไม่เปลี่ยนแปลงที่ $5 และ $30 Sol ยังได้รับโหมด Fast ในราคาเป็นสองเท่าของอัตรามาตรฐานสำหรับการประมวลผลที่เร็วขึ้น 2.5 เท่า
GPT-5.6 Sol มีการลดราคาหรือไม่?
ไม่ อัตรามาตรฐานของ Sol ไม่เปลี่ยนแปลง การเปลี่ยนแปลงสำหรับ Sol เป็นไปในเชิงโครงสร้าง: โหมด Fast ใหม่มาแทนที่ระดับ Priority Processing โดยแลกกับราคาเป็นสองเท่าเพื่อความเร็วที่เพิ่มขึ้น 2.5 เท่า
GPT-5.6 Luna ตอนนี้ถูกกว่า Gemini Flash แล้วใช่ไหม?
ตามราคาที่ระบุ ใช่ อัตราการรวมขาเข้าและขาออกของ Luna อยู่ที่ $1.40 ต่อล้านโทเค็น เทียบกับ $2.80 สำหรับ Gemini 3.5 Flash-Lite และ $9 สำหรับ Gemini 3.6 Flash อย่างไรก็ตาม ราคาไม่ใช่คุณภาพ: ควรทดสอบทั้งสองกับชุดประเมินของคุณเองก่อนที่จะเปลี่ยน หากคุณต้องการเส้นทางฟรีเป็นอันดับแรก โปรดดู วิธีใช้ GPT-5.6 ฟรี
การลดราคามีผลบังคับใช้โดยอัตโนมัติหรือไม่?
ใช่ อัตราใหม่มีผลบังคับใช้กับการใช้งาน API มาตรฐานตั้งแต่วันที่ 30 กรกฎาคม 2026 โดยไม่จำเป็นต้องแก้ไขโค้ดใดๆ คุณจะต้องดำเนินการก็ต่อเมื่อคุณใช้ Priority Processing บน Sol ซึ่งกำลังจะถูกแทนที่ด้วยโหมด Fast
สิ่งที่ควรทำในสัปดาห์นี้
อัตราค่าบริการใหม่นี้ให้ประโยชน์แก่ทีมที่เคลื่อนไหวอย่างรวดเร็ว รันโมเดลต้นทุนของคุณใหม่ด้วยตัวเลขใหม่ ประเมินอีกครั้งว่า Luna สามารถรองรับภาระงานใดได้บ้างในราคาที่ต่ำกว่า Sol ถึง 96% และตรวจสอบว่าการลดราคา Terra 20% ส่งผลต่อเกณฑ์การกำหนดเส้นทางใดๆ หรือไม่ จากนั้นยืนยันด้วยปริมาณการใช้งานจริงแทนการคำนวณราคาตามรายการ: สถานการณ์การทดสอบหนึ่งรายการใน Apidog, สามรหัสโมเดล และตัวเลขการใช้งานจะบอกคุณอย่างชัดเจนว่าการลดราคานี้มีค่าสำหรับคุณเท่าไร
