Grok 4.6 เป็นโมเดลภาษาเชิงรุกของ xAI ที่เปิดตัวเมื่อวันที่ 12 สิงหาคม 2026 โดยต่อยอดจาก Grok 4.5 โดยมุ่งเน้นที่เอเจนต์ที่ทำงานต่อเนื่องยาวนาน (long-running agents), การเขียนโค้ดแบบเอเจนต์ (agentic coding) และงานแบบโต้ตอบหรือแบบภาพ (interactive or visual work) ซึ่งมีหน้าต่างบริบท (context window) ขนาด 500,000 โทเค็น ในราคา 2 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเค็น และ 6 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเค็น บนดัชนี Artificial Analysis Intelligence Index ได้คะแนน 61 ซึ่งเทียบเท่ากับ GPT-5.6 Sol ของ OpenAI และตามหลัง Claude Fable 5 ของ Anthropic เพียงหนึ่งคะแนน ทำให้เป็นโมเดลที่ถูกที่สุดในขณะนี้ที่อยู่ในระดับแนวหน้าของความฉลาด
นั่นคือคำตอบแบบหนึ่งย่อหน้า เนื้อหาที่เหลือของโพสต์นี้จะครอบคลุมถึงสิ่งที่เปลี่ยนแปลงไปจาก Grok 4.5 จริงๆ, ความหมายของตัวเลขเกณฑ์มาตรฐาน, คุณสามารถใช้โมเดลนี้ได้ที่ไหนในวันนี้ และความหมายสำหรับคุณหากคุณกำลังพัฒนาโดยใช้ LLM API หากคุณเป็นคนหนึ่งในนั้น Apidog มอบพื้นที่ทำงานฟรีให้คุณเพื่อออกแบบ ทดสอบ และจำลองการเรียก LLM API ซึ่งสะดวกสำหรับการทดลองใช้ Grok 4.6 โดยไม่ต้องเขียนไคลเอนต์ก่อน
สรุป
- เปิดตัว: 12 สิงหาคม 2026 โดย xAI
- จุดเน้น: เอเจนต์ที่ทำงานระยะยาว (long-horizon agents), การเขียนโค้ดหลายขั้นตอน (multi-step coding), งานแบบโต้ตอบและแบบภาพ (interactive and visual work) xAI ระบุว่าโมเดลจะทดสอบและตรวจสอบงานของตัวเองบ่อยขึ้นก่อนดำเนินการต่อ
- ข้อมูลจำเพาะ: หน้าต่างบริบท (context window) 500K, ข้อมูลล่าสุด ณ วันที่ 1 กุมภาพันธ์ 2026
- ราคา: $2 / อินพุต 1M, $6 / เอาต์พุต 1M รุ่นที่เร็วกว่ามีราคา 2 เท่า ในสัปดาห์แรกจะได้รับสิทธิ์ใช้งานฟรี 2 เท่าใน Grok Build และ Cursor
- เกณฑ์มาตรฐาน: ดัชนีความฉลาด 61 (เท่ากับ GPT-5.6 Sol) มีการเพิ่มขึ้นอย่างมากจาก 4.5 บน DeepSWE (54 → 65.9) และ APEX-Agents (47.1 → 57.5)
- สามารถใช้งานได้ที่: xAI API, Grok Build, Cursor, OpenRouter, Vercel และ Cloudflare
Grok 4.6 โดยสรุป
| คุณสมบัติ | Grok 4.6 |
|---|---|
| ผู้พัฒนา | xAI |
| วันที่เปิดตัว | 12 สิงหาคม 2026 |
| หน้าต่างบริบท | 500,000 โทเค็น |
| ข้อมูลล่าสุด ณ วันที่ | 1 กุมภาพันธ์ 2026 |
| ราคาอินพุต / เอาต์พุต | $2 / $6 ต่อ 1M โทเค็น |
| รุ่นความเร็วสูง | ราคา 2 เท่า |
| ดัชนีความฉลาด | 61 (GPT-5.6 Sol: 61, Claude Fable 5: 62) |
| ความพร้อมใช้งาน | xAI API, Cursor, Grok Build, OpenRouter, Vercel, Cloudflare |
อะไรคือสิ่งใหม่ที่แท้จริงเมื่อเทียบกับ Grok 4.5
Grok 4.6 ไม่ใช่การเปิดเผยสถาปัตยกรรม แต่เป็นเรื่องราวของการฝึกฝน ตามที่ xAI ระบุ โมเดลนี้ผ่านการฝึกฝนเพิ่มเติมที่ยาวนานกว่า Grok 4.5 โดยมีองค์ประกอบสามอย่างที่เป็นส่วนสำคัญ:
- ข้อมูลที่สร้างโดยโมเดลที่คัดสรรมาอย่างดีซึ่งมุ่งเป้าไปที่การให้เหตุผลและแนวคิดทางเทคนิคขั้นสูง
- ชุดข้อมูลทางวิศวกรรมคุณภาพสูง ซึ่งเป็นการต่อยอดจากการฝึกฝนการเขียนโค้ดอย่างเข้มข้นที่เริ่มขึ้นเมื่อ xAI เริ่มฝึกฝนโดยใช้เซสชันการพัฒนาจริง
- ตัวปรับปรุง (optimizer) และสูตรการฝึกฝนที่ได้รับการปรับปรุง โดยมีการสร้างเส้นทางการปรับแต่งแบบละเอียด (fine-tuning) ภายใต้การกำกับดูแลขึ้นใหม่ในด้านการให้เหตุผลและโดเมนเฉพาะทาง
การเปลี่ยนแปลงพฤติกรรมที่นักพัฒนาจะสังเกตเห็นคือการตรวจสอบตัวเอง ในระหว่างการทำงานของเอเจนต์ที่ยาวนาน Grok 4.6 จะตรวจสอบงานของตัวเองก่อนที่จะก้าวไปสู่ขั้นตอนถัดไป โดยการรันการทดสอบที่เพิ่งเขียนไป การอ่านไฟล์ที่เพิ่งแก้ไขซ้ำ แทนที่จะดำเนินการไปข้างหน้าโดยอาศัยข้อสันนิษฐานที่ยังไม่ได้ตรวจสอบ xAI ยังรายงานว่าความพยายามครั้งแรกในโครงการแบบโต้ตอบและแบบภาพนั้นดีขึ้น: แดชบอร์ด แอปขนาดเล็ก และงาน UI ออกมาใกล้เคียงกับการใช้งานได้จริงตั้งแต่ครั้งแรก
หากคุณสนใจแนวทางการฝึกฝนของ Grok 4.5 บทวิเคราะห์ของเราเกี่ยวกับ ความหมายของการฝึกฝนเซสชัน Cursor สำหรับนักพัฒนา จะครอบคลุมถึงต้นกำเนิดที่โมเดลนี้สร้างขึ้นมา
เกณฑ์มาตรฐาน พร้อมความแตกต่างที่สำคัญ
ตัวเลขการเปิดตัวจากผู้ขายสมควรได้รับการพิจารณาอย่างรอบคอบ แต่ความแตกต่างจาก 4.5 ไป 4.6 นั้นใหญ่พอที่จะมีความหมาย นี่คือภาพรวม รวมถึงสถานะของคู่แข่ง:

สามประเด็นสำคัญ:
- ช่องว่างของเอเจนต์ลดลง การเพิ่มขึ้น 10.4 จุดใน APEX-Agents ทำให้ Grok จาก "ตามหลังอย่างชัดเจน" มาอยู่ในระยะ 1.7 จุดจาก Fable 5 Max และนำหน้า GPT-5.6 Sol Max (56.7%) เล็กน้อย
- การเขียนโค้ดขนาดคลังข้อมูล (repository-scale coding) มีการปรับปรุงมากที่สุด DeepSWE ที่เพิ่มขึ้นเกือบ 12 จุดคือความแตกต่างระหว่างโมเดลที่สะดุดกับการเปลี่ยนแปลงหลายไฟล์ กับโมเดลที่สามารถแข่งขันได้ แม้ว่า Sol Max ยังคงนำหน้าในเกณฑ์นี้ด้วยส่วนต่างที่มากก็ตาม
- ตัวเลขที่เป็นอิสระสนับสนุนเรื่องราวนี้ Artificial Analysis วัดค่าใช้จ่ายเฉลี่ย $0.84 ต่อภารกิจในการประเมินเอเจนต์ ซึ่งต่ำที่สุดในบรรดาโมเดลระดับแนวหน้า และค่า Elo ที่ 1753 บน GDPval-AA v2 สำหรับงานความรู้ระดับมืออาชีพ
สำหรับข้อมูลเพิ่มเติมเกี่ยวกับวิธีการอ่านการเปิดเผยเกณฑ์มาตรฐานของ xAI และข้อควรระวังที่ใช้กับรุ่นก่อนหน้าด้วย โปรดดูที่ การวิเคราะห์เกณฑ์มาตรฐาน Grok 4.5 ของเรา
ราคา: คุ้มค่าที่สุดในแนวหน้า
Grok 4.6 ยังคงราคาเดียวกับ Grok 4.5: 2 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเค็น, 6 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเค็น เมื่อเทียบกับโมเดลที่ใช้เป็นเกณฑ์มาตรฐานในปัจจุบัน ถือว่ามีความแตกต่างอย่างมาก:
| โมเดล | ราคาเอาต์พุต / 1M โทเค็น |
|---|---|
| Grok 4.6 | $6 |
| Claude Opus 4.8 | $25 |
| GPT-5.6 Sol | $30 |
นั่นคือความแตกต่างถึง 5 เท่าในฝั่งเอาต์พุตเมื่อเทียบกับ GPT-5.6 Sol สำหรับโมเดลที่ได้คะแนนเท่ากันบนดัชนีความฉลาดรวม โทเค็นราคาถูกไม่ได้หมายถึงงานที่ถูกโดยอัตโนมัติ การทำงานที่ด้อยประสิทธิภาพที่ต้องมีการตรวจสอบและแก้ไขจะมีค่าใช้จ่ายมากกว่าค่าโทเค็น แต่ข้อมูลค่าใช้จ่ายต่อภารกิจที่เป็นอิสระชี้ให้เห็นว่าประสิทธิภาพเป็นของจริง ไม่ใช่แค่ราคาที่ถูกลงเท่านั้น
รุ่นความเร็วสูงที่มีราคา 2 เท่า ($4/$12) มีเป้าหมายสำหรับการใช้งานแบบโต้ตอบที่อ่อนไหวต่อเวลาแฝง และตั้งแต่วันที่ 19 สิงหาคม ผู้ใช้ Grok Build และ Cursor จะได้รับสิทธิ์ใช้งานฟรี 2 เท่าเพื่อทดสอบโมเดล
คุณสามารถใช้ Grok 4.6 ได้ที่ไหนในวันนี้
- xAI API ผ่าน console.x.ai ซึ่งเข้ากันได้กับ OpenAI คู่มือ API ของ Grok 4.5 ของเราสามารถนำมาใช้ได้โดยตรง เพียงแค่เปลี่ยนชื่อโมเดล
- Cursor มีให้เลือกเป็นตัวเลือกโมเดล; Cursor ได้เผยแพร่บันทึกการเปิดตัวของตนเองควบคู่ไปกับของ xAI
- Grok Build พื้นที่ทำงานแบบเอเจนต์ของ xAI พร้อมโบนัสการใช้งาน 2 เท่าในช่วงสัปดาห์เปิดตัว
- OpenRouter, Vercel และ Cloudflare สำหรับทีมที่ต้องการส่งต่อหลายโมเดลผ่านเกตเวย์เดียว; ระบุใน OpenRouter ว่า
x-ai/grok-4.6
ไม่มีการเปิดตัวสำหรับผู้บริโภคแยกต่างหากที่ต้องทำความเข้าใจ: นี่คือการเปิดตัวที่เน้นนักพัฒนาเป็นหลัก และวิธีที่เร็วที่สุดในการประเมินคือผ่าน API หรือ IDE ที่รองรับอยู่แล้ว
ข้อจำกัดและคำถามที่ยังไม่ได้รับคำตอบ
การประเมินในช่วงสัปดาห์เปิดตัวมีข้อควรระวังควบคู่ไปกับตัวเลขสำคัญ:
- เกณฑ์มาตรฐานส่วนใหญ่มาจากผู้ขายรายงาน. Artificial Analysis ได้เผยแพร่คะแนนอิสระที่โดยรวมแล้วสอดคล้องกัน แต่ตัวเลขการเขียนโค้ดเฉพาะ (DeepSWE, FrontierCode, CursorBench) มาจากตารางการเปิดตัวของ xAI เอง ตัวเลขการเปิดตัวของ Grok 4.5 ยังคงใช้ได้เพียงบางส่วนภายใต้การทดสอบอิสระ; จึงควรคาดการณ์ว่าอาจมีการถดถอยสู่ค่าเฉลี่ยบ้างในกรณีนี้
- หน้าต่างบริบทมีขนาดเล็กที่สุดในระดับแนวหน้า. 500K โทเค็นครอบคลุมงานจริงส่วนใหญ่ แต่ GPT-5.6 Sol เสนอ 1.05M และ Claude Fable 5 เสนอ 1M หากคุณประมวลผล monorepos ทั้งหมดหรือชุดเอกสารขนาดใหญ่ในการเรียกเพียงครั้งเดียว ช่องว่างนี้มีความสำคัญ
- Sol ยังคงนำหน้าในส่วนที่ยากที่สุด. การขาดดุล 7 จุดใน DeepSWE หมายความว่างานอัตโนมัติเต็มรูปแบบทั่วฐานโค้ดขนาดใหญ่ที่มีอยู่ยังคงแข็งแกร่งกว่าบน GPT-5.6 Sol Max และนั่นคืองานเอเจนต์ที่มีมูลค่าทางเศรษฐกิจมากที่สุด
- วุฒิภาวะของระบบนิเวศยังตามหลัง. การประมวลผลแบบแบตช์, ระดับการแคชพร้อมต์, และการควบคุมการใช้งานบนแพลตฟอร์ม xAI ยังใหม่กว่าเมื่อเทียบกับของ OpenAI และ Anthropic การเข้ากันได้กับ OpenAI ช่วยแก้ปัญหาได้ส่วนใหญ่ แต่ไม่ใช่ทั้งหมด
ไม่มีข้อจำกัดเหล่านี้ที่ทำให้ไม่ผ่านคุณสมบัติ สิ่งเหล่านี้กำหนดตำแหน่งที่ Grok 4.6 เหมาะสม: ตัวเลือกด้านราคาต่อประสิทธิภาพที่คุณควรพิจารณาอย่างจริงจัง ไม่ใช่ตัวเลือกที่คุณเลือกโดยอาศัยชื่อเสียง
ความหมายสำหรับนักพัฒนา API
มุมมองเชิงกลยุทธ์: ขณะนี้แนวหน้ามีคู่แข่งด้านราคาที่แท้จริงแล้ว จนกระทั่งการเปิดตัวครั้งนี้ การได้เอาต์พุตระดับ GPT-5.6 Sol หมายถึงการจ่ายเงิน 25-30 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเค็น Grok 4.6 ทำได้ในราคา 6 ดอลลาร์ ซึ่งเปลี่ยนการคำนวณในวงจรเอเจนต์โดยเฉพาะ เอเจนต์ที่เรียกใช้โมเดล 40 ครั้งต่อภารกิจจะรู้สึกถึงความแตกต่างของราคาเอาต์พุต 5 เท่าได้ทันที
ในทางปฏิบัติ API ที่เข้ากันได้กับ OpenAI หมายความว่าการประเมินจะใช้เวลาเพียงบ่ายวันเดียว ไม่ใช่การเร่งทำในเวลาอันสั้น ชี้ไคลเอนต์ที่คุณมีอยู่ไปยัง https://api.x.ai/v1 เรียกใช้งานจริงของคุณเทียบกับมัน แล้วเปรียบเทียบ ตั้งค่าการเปรียบเทียบนั้นใน Apidog และคุณสามารถเก็บคำขอของ GPT-5.6, Claude และ Grok 4.6 ไว้เคียงข้างกันในโปรเจกต์เดียว โดยมีสภาพแวดล้อมสำหรับผู้ให้บริการแต่ละราย และการยืนยันที่ตรวจสอบคุณภาพเอาต์พุต การใช้โทเค็น และเวลาแฝงของทั้งสาม ซึ่งเป็นหลักฐานที่เป็นประโยชน์ก่อนที่คุณจะนำภาระงานการผลิตไปใช้กับโมเดลใดโมเดลหนึ่ง
การเน้นที่เอเจนต์ของโมเดลยังเพิ่มความสำคัญของการเรียกใช้เครื่องมือที่ถูกต้อง หากการรวม Grok ของคุณเกี่ยวข้องกับการเรียกใช้ฟังก์ชัน ให้ทดสอบเพย์โหลดที่สร้างขึ้น ไม่ใช่แค่ข้อความที่เขียน
คำถามที่พบบ่อย
- Grok 4.6 คืออะไรในประโยคเดียว? เป็นโมเดลแนวหน้าของ xAI ที่เปิดตัวในเดือนสิงหาคม 2026 ปรับแต่งมาสำหรับเอเจนต์ที่ทำงานยาวนานและการเขียนโค้ด มีหน้าต่างบริบท 500K และคะแนนเกณฑ์มาตรฐานระดับแนวหน้าในราคาเอาต์พุตที่ประมาณหนึ่งในห้าของคู่แข่ง
- Grok 4.6 ดีกว่า GPT-5.6 หรือไม่? พวกมันได้คะแนนเท่ากันบนดัชนี Artificial Analysis Intelligence Index ที่ 61 GPT-5.6 Sol Max นำหน้าในการเขียนโค้ดขนาดคลังข้อมูล (DeepSWE); Grok 4.6 นำหน้าเล็กน้อยใน APEX-Agents และมีค่าใช้จ่ายน้อยกว่าประมาณ 5 เท่าต่อโทเค็นเอาต์พุต
- Grok 4.5 และ 4.6 แตกต่างกันอย่างไร? ราคาเท่ากัน API เดียวกัน แต่เป็นโมเดลที่ดีขึ้นอย่างเห็นได้ชัด: +11.9 จุดบน DeepSWE, +10.4 บน APEX-Agents และแนวโน้มใหม่ในการตรวจสอบตัวเองระหว่างงานที่ยาวนาน
- ฉันสามารถทดลองใช้ Grok 4.6 ได้ฟรีหรือไม่? Grok Build และ Cursor มีการใช้งานฟรี 2 เท่าในช่วงสัปดาห์เปิดตัว และวิธีการใน คู่มือการใช้ Grok 4.5 ฟรี ของเราสามารถนำไปใช้กับ 4.6 ได้ส่วนใหญ่
