Grok 4.6 là mô hình ngôn ngữ tiên tiến của xAI, được phát hành vào ngày 12 tháng 8 năm 2026. Nó được xây dựng dựa trên Grok 4.5 với trọng tâm vào các tác nhân chạy dài (long-running agents), mã hóa tự động (agentic coding) và công việc tương tác hoặc trực quan, cung cấp cửa sổ ngữ cảnh 500.000 token với giá 2 đô la cho mỗi triệu token đầu vào và 6 đô la cho mỗi triệu token đầu ra. Trên Chỉ số Trí tuệ Phân tích Nhân tạo (Artificial Analysis Intelligence Index), nó đạt 61 điểm, ngang bằng với GPT-5.6 Sol của OpenAI và kém Claude Fable 5 của Anthropic một điểm, khiến nó trở thành mô hình rẻ nhất hiện có ở ranh giới trí tuệ.
Đó là câu trả lời trong một đoạn văn. Phần còn lại của bài đăng này bao gồm những gì đã thực sự thay đổi so với Grok 4.5, ý nghĩa của các con số điểm chuẩn, nơi bạn có thể sử dụng mô hình này hôm nay và ý nghĩa của nó đối với bạn nếu bạn đang xây dựng dựa trên các API LLM. Nếu bạn thuộc nhóm sau, Apidog cung cấp cho bạn một không gian làm việc miễn phí để thiết kế, kiểm thử và mô phỏng các cuộc gọi API LLM, rất tiện lợi để trải nghiệm Grok 4.6 mà không cần viết ứng dụng khách trước.
TÓM TẮT
- Phát hành: 12 tháng 8 năm 2026, bởi xAI.
- Trọng tâm: tác nhân tầm nhìn dài hạn, mã hóa đa bước, công việc tương tác và trực quan. xAI cho biết mô hình tự kiểm thử và xác minh công việc của chính nó thường xuyên hơn trước khi tiếp tục.
- Thông số kỹ thuật: Cửa sổ ngữ cảnh 500K, thời điểm cắt kiến thức ngày 1 tháng 2 năm 2026.
- Giá cả: 2 đô la / 1 triệu token đầu vào, 6 đô la / 1 triệu token đầu ra. Một biến thể nhanh hơn có giá gấp đôi. Tuần đầu tiên đi kèm với 2 lần lượng sử dụng miễn phí trong Grok Build và Cursor.
- Điểm chuẩn: Chỉ số Trí tuệ 61 (ngang GPT-5.6 Sol), nhảy vọt lớn so với 4.5 trên DeepSWE (54 → 65.9) và APEX-Agents (47.1 → 57.5).
- Nơi có thể sử dụng: xAI API, Grok Build, Cursor, OpenRouter, Vercel và Cloudflare.
Grok 4.6 sơ lược
| Thông số | Grok 4.6 |
|---|---|
| Nhà phát triển | xAI |
| Ngày phát hành | 12 tháng 8 năm 2026 |
| Cửa sổ ngữ cảnh | 500.000 token |
| Thời điểm cắt kiến thức | 1 tháng 2 năm 2026 |
| Giá đầu vào / đầu ra | 2 đô la / 6 đô la mỗi 1 triệu token |
| Biến thể nhanh | Giá gấp đôi |
| Chỉ số Trí tuệ | 61 (GPT-5.6 Sol: 61, Claude Fable 5: 62) |
| Khả dụng tại | xAI API, Cursor, Grok Build, OpenRouter, Vercel, Cloudflare |
Có gì thực sự mới so với Grok 4.5
Grok 4.6 không phải là một tiết lộ kiến trúc, mà là một câu chuyện đào tạo. Theo xAI, mô hình đã trải qua một quá trình đào tạo bổ sung dài hơn so với Grok 4.5, với ba thành phần chính đã giúp thực hiện công việc nặng nhọc:
- Dữ liệu được tạo ra bởi mô hình, được tuyển chọn kỹ lưỡng, nhắm đến lý luận và các khái niệm kỹ thuật nâng cao.
- Bộ dữ liệu kỹ thuật chất lượng cao, tiếp tục chế độ "ăn" nhiều mã hóa đã bắt đầu khi xAI bắt đầu đào tạo trên các phiên phát triển thực tế.
- Một công cụ tối ưu hóa và công thức đào tạo được cải tiến, với các quỹ đạo tinh chỉnh có giám sát được tạo lại trên các lĩnh vực lý luận và chuyên biệt.
Thay đổi hành vi mà các nhà phát triển sẽ nhận thấy là khả năng tự xác minh. Trong các lần chạy tác nhân dài, Grok 4.6 kiểm tra công việc của chính nó trước khi chuyển sang bước tiếp theo, chạy thử nghiệm mà nó vừa viết, đọc lại tệp mà nó vừa chỉnh sửa, thay vì tiếp tục dựa trên một giả định chưa được xác minh. xAI cũng báo cáo những nỗ lực đầu tiên mạnh mẽ hơn trên các dự án tương tác và trực quan: các bảng điều khiển, ứng dụng nhỏ và công việc giao diện người dùng gần với khả năng sử dụng ngay từ lần thử đầu tiên.
Nếu phương pháp đào tạo của Grok 4.5 làm bạn quan tâm, phân tích chi tiết của chúng tôi về ý nghĩa của việc đào tạo theo phiên Cursor đối với các nhà phát triển sẽ bao gồm dòng dõi mà mô hình này được xây dựng dựa trên.
Các điểm chuẩn, với những thay đổi đáng kể
Các con số ra mắt của nhà cung cấp đáng được nghi ngờ, nhưng sự khác biệt từ 4.5 đến 4.6 đủ lớn để có ý nghĩa. Đây là bức tranh tổng thể, bao gồm vị trí của đối thủ cạnh tranh:

Ba điểm chính cần lưu ý:
- Khoảng cách tác nhân đã được thu hẹp. Bước nhảy vọt 10,4 điểm trên APEX-Agents giúp Grok từ "rõ ràng là tụt hậu" lên trong vòng 1,7 điểm so với Fable 5 Max, và nhỉnh hơn một chút so với GPT-5.6 Sol Max (56.7%).
- Mã hóa quy mô kho lưu trữ cải thiện nhiều nhất. DeepSWE tăng gần 12 điểm là sự khác biệt giữa một mô hình gặp khó khăn với các thay đổi đa tệp và một mô hình có khả năng cạnh tranh, mặc dù Sol Max vẫn dẫn đầu điểm chuẩn đó với biên độ lớn.
- Các con số độc lập ủng hộ câu chuyện này. Artificial Analysis đã đo chi phí trung bình 0,84 đô la mỗi tác vụ trong các đánh giá tác nhân của nó, thấp nhất trong số các mô hình cấp tiên tiến, và điểm Elo là 1753 trên GDPval-AA v2 cho công việc tri thức chuyên nghiệp.
Để biết ngữ cảnh về cách đọc các bản phát hành điểm chuẩn của xAI, và những cảnh báo cũng áp dụng cho thế hệ trước, hãy xem phân tích điểm chuẩn Grok 4.5 của chúng tôi.
Giá cả: yếu tố giá trị của ranh giới
Grok 4.6 giữ nguyên mức giá của Grok 4.5: 2 đô la cho mỗi triệu token đầu vào, 6 đô la cho mỗi triệu token đầu ra. So với các mô hình mà nó hiện đang được đo điểm chuẩn cùng, đó là một sự chênh lệch đáng kể:
| Mô hình | Giá đầu ra / 1 triệu token |
|---|---|
| Grok 4.6 | 6 đô la |
| Claude Opus 4.8 | 25 đô la |
| GPT-5.6 Sol | 30 đô la |
Đó là sự khác biệt gấp 5 lần ở đầu ra so với GPT-5.6 Sol cho một mô hình ngang bằng về chỉ số trí tuệ tổng hợp. Token rẻ không tự động có nghĩa là tác vụ rẻ, một lần chạy yếu kém cần xem xét và sửa chữa sẽ tốn nhiều hơn hóa đơn token của nó, nhưng dữ liệu chi phí cho mỗi tác vụ độc lập cho thấy hiệu quả là có thật, không chỉ là mức giá niêm yết thấp.
Biến thể nhanh hơn với giá gấp đôi (4 đô la / 12 đô la) nhắm đến việc sử dụng tương tác nhạy cảm với độ trễ. Và đến hết ngày 19 tháng 8, người dùng Grok Build và Cursor sẽ nhận được 2 lần lượng sử dụng miễn phí đi kèm để kiểm thử mô hình.
Nơi bạn có thể sử dụng Grok 4.6 hôm nay
- xAI API qua console.x.ai, tương thích OpenAI. Hướng dẫn API Grok 4.5 của chúng tôi áp dụng trực tiếp; chỉ cần thay đổi tên mô hình.
- Cursor, có sẵn dưới dạng một tùy chọn mô hình; Cursor đã công bố ghi chú ra mắt của riêng mình cùng với của xAI.
- Grok Build, không gian làm việc tác nhân riêng của xAI, với phần thưởng 2 lần lượng sử dụng trong tuần ra mắt.
- OpenRouter, Vercel và Cloudflare, dành cho các nhóm định tuyến nhiều mô hình qua một cổng duy nhất; được liệt kê là
x-ai/grok-4.6trên OpenRouter.
Không có đợt triển khai riêng biệt cho người tiêu dùng để phân tích ở đây: đây là bản phát hành ưu tiên nhà phát triển, và cách nhanh nhất để đánh giá nó là thông qua API hoặc một IDE đã tích hợp sẵn.
Hạn chế và câu hỏi mở
Đánh giá trong tuần ra mắt cần cung cấp cho bạn những cảnh báo cùng với các con số tiêu đề:
- Các điểm chuẩn chủ yếu do nhà cung cấp báo cáo. Artificial Analysis đã công bố các điểm số độc lập nhìn chung đồng ý, nhưng các con số mã hóa cụ thể (DeepSWE, FrontierCode, CursorBench) đến từ bảng ra mắt của xAI. Các số liệu ra mắt của Grok 4.5 chỉ đúng một phần dưới thử nghiệm độc lập; cũng nên giả định một số sự hồi quy về giá trị trung bình ở đây.
- Cửa sổ ngữ cảnh là nhỏ nhất ở ranh giới. 500K token bao phủ hầu hết các khối lượng công việc thực tế, nhưng GPT-5.6 Sol cung cấp 1,05 triệu và Claude Fable 5 cung cấp 1 triệu. Nếu bạn xử lý toàn bộ kho lưu trữ đơn (monorepos) hoặc bộ tài liệu khổng lồ trong một cuộc gọi, khoảng cách đó là đáng kể.
- Sol vẫn dẫn đầu ở những nơi khó khăn nhất. Thâm hụt 7 điểm DeepSWE có nghĩa là công việc hoàn toàn tự động trên các cơ sở mã lớn hiện có vẫn mạnh hơn trên GPT-5.6 Sol Max, và đó là khối lượng công việc tác nhân có giá trị kinh tế nhất.
- Sự trưởng thành của hệ sinh thái còn chậm. Xử lý hàng loạt, các cấp bộ đệm lời nhắc và kiểm soát sử dụng trên nền tảng xAI còn non trẻ hơn so với các đối tác của OpenAI và Anthropic. Khả năng tương thích OpenAI khắc phục hầu hết, nhưng không phải tất cả.
Không có điều nào trong số này là yếu tố loại trừ. Chúng định nghĩa vị trí của Grok 4.6: lựa chọn hiệu suất-giá mà bạn đánh giá nghiêm túc, không phải là lựa chọn mặc định bạn chấp nhận dựa trên danh tiếng.
Ý nghĩa đối với các nhà phát triển API
Góc nhìn chiến lược: ranh giới hiện có một đối thủ cạnh tranh về giá thực sự. Cho đến bản phát hành này, để đạt được đầu ra cấp độ GPT-5.6 Sol có nghĩa là phải trả 25–30 đô la cho mỗi triệu token đầu ra. Grok 4.6 làm điều đó với giá 6 đô la, điều này thay đổi cách tính toán về các vòng lặp tác nhân đặc biệt, một tác nhân thực hiện 40 cuộc gọi mô hình cho mỗi tác vụ sẽ cảm nhận ngay sự khác biệt gấp 5 lần về giá đầu ra.
Trên thực tế, API tương thích OpenAI có nghĩa là việc đánh giá nó chỉ tốn một buổi chiều, chứ không phải một đợt chạy nước rút. Hướng máy khách hiện có của bạn đến https://api.x.ai/v1, chạy khối lượng công việc thực tế của bạn với nó, và so sánh. Thiết lập so sánh đó trong Apidog và bạn có thể giữ các yêu cầu của GPT-5.6, Claude và Grok 4.6 cạnh nhau trong một dự án, với môi trường cho mỗi nhà cung cấp và các xác nhận kiểm tra chất lượng đầu ra, mức sử dụng token và độ trễ trên cả ba, bằng chứng hữu ích trước khi bạn cam kết một khối lượng công việc sản xuất cho bất kỳ mô hình nào trong số đó.
Trọng tâm tác nhân của mô hình cũng nâng cao yêu cầu về độ chính xác của cuộc gọi công cụ. Nếu tích hợp Grok của bạn liên quan đến việc gọi hàm, hãy kiểm tra các tải trọng mà nó tạo ra, không chỉ văn bản mà nó viết.
Câu hỏi thường gặp
Grok 4.6 là gì trong một câu? Mô hình tiên tiến của xAI ra mắt vào tháng 8 năm 2026, được tinh chỉnh cho các tác nhân chạy dài và mã hóa, với cửa sổ ngữ cảnh 500K và điểm chuẩn cấp tiên tiến với giá đầu ra bằng khoảng một phần năm so với đối thủ cạnh tranh.
Grok 4.6 có tốt hơn GPT-5.6 không? Chúng hòa nhau trên Chỉ số Trí tuệ Phân tích Nhân tạo ở mức 61. GPT-5.6 Sol Max dẫn đầu về mã hóa quy mô kho lưu trữ (DeepSWE); Grok 4.6 nhỉnh hơn về APEX-Agents và có giá thấp hơn khoảng 5 lần trên mỗi token đầu ra.
Sự khác biệt giữa Grok 4.5 và 4.6 là gì? Cùng giá, cùng API, mô hình tốt hơn đáng kể: +11,9 điểm trên DeepSWE, +10,4 trên APEX-Agents, và một xu hướng mới là tự xác minh trong các tác vụ dài.
Tôi có thể dùng thử Grok 4.6 miễn phí không? Grok Build và Cursor bao gồm 2 lần lượng sử dụng trong tuần ra mắt, và các phương pháp trong hướng dẫn của chúng tôi về cách sử dụng Grok 4.5 miễn phí phần lớn cũng áp dụng cho 4.6.
