xAI, hiện đang hoạt động dưới thương hiệu SpaceXAI, đã phát hành Grok 4.5 vào ngày 8 tháng 7 năm 2026. Công ty gọi đây là “mô hình thông minh nhất của SpaceXAI được xây dựng cho lập trình, các tác vụ đại lý và công việc tri thức,” và Elon Musk đã giới thiệu nó như là “một mô hình đẳng cấp Opus, nhưng nhanh hơn, hiệu quả về token hơn và chi phí thấp hơn.”
Các thông tin chính: 2 đô la cho mỗi triệu token đầu vào, 6 đô la cho mỗi triệu token đầu ra, cửa sổ ngữ cảnh 500 nghìn, 80 token mỗi giây, và một quá trình đào tạo đã tích hợp các phiên làm việc thực tế của nhà phát triển từ Cursor, trình chỉnh sửa mã AI mà SpaceX đã đồng ý mua lại vào tháng 6. Nó hiện đã có sẵn trong Grok Build, trong Cursor trên tất cả các gói, và thông qua API của xAI.
Hướng dẫn này bao gồm Grok 4.5 là gì, những con số đã công bố nói lên điều gì (bao gồm cả những điều mà hoạt động marketing của xAI không nhấn mạnh), và cách để bắt đầu sử dụng nó. Nếu bạn muốn kiểm tra điểm cuối trước khi tích hợp vào một ứng dụng, Apidog cho phép bạn gửi yêu cầu tới grok-4.5, kiểm tra các phản hồi dạng streaming và tạo API giả lập cho nhóm của bạn mà không cần viết một dòng mã client nào.
Grok 4.5 sơ lược
| Thông số kỹ thuật | Giá trị |
|---|---|
| ID mô hình | grok-4.5 (lưu ý dấu chấm) |
| Ngày phát hành | 8 tháng 7 năm 2026 |
| Cửa sổ ngữ cảnh | 500.000 token |
| Giá đầu vào | 2,00 đô la cho mỗi 1 triệu token |
| Giá đầu ra | 6,00 đô la cho mỗi 1 triệu token |
| Tốc độ | ~80 token/giây |
| Khả dụng | Grok Build (mặc định), Cursor (tất cả các gói), xAI API |
| Khả dụng tại EU | Chưa có; dự kiến giữa tháng 7 năm 2026 |
| Điểm cuối | https://api.x.ai/v1/responses |
Hai chi tiết trong bảng này đáng được xem xét kỹ hơn.
Đầu tiên, cửa sổ ngữ cảnh. Grok 4.5 đi kèm với cửa sổ ngữ cảnh 500 nghìn token, trong khi grok-4.3 cũ hơn, rẻ hơn cung cấp 1 triệu. Nếu khối lượng công việc của bạn là RAG tài liệu dài hoặc phân tích toàn bộ kho lưu trữ, mô hình trước đó chứa được nhiều hơn. xAI đang đặt cược rằng bạn sẽ đánh đổi ngữ cảnh để lấy khả năng.

Thứ hai, lưu ý về EU. Trang phát hành ghi rõ Grok 4.5 “chưa có sẵn tại EU trong bất kỳ sản phẩm SpaceXAI hoặc bảng điều khiển API nào,” với dự kiến khả dụng vào giữa tháng 7. Nếu bạn đang xây dựng cho người dùng châu Âu, hãy tính toán khoảng trống đó.
Có gì mới trong Grok 4.5
Được đào tạo cùng với Cursor
Thực tế nổi bật của bản phát hành này: Grok 4.5 “được đào tạo cùng với Cursor.” Theo thông báo của Cursor, trình chỉnh sửa đã đóng góp hàng nghìn tỷ token ghi lại “tương tác của người dùng với các cơ sở mã và công cụ phần mềm.” Điều đó có nghĩa là mô hình đã học từ các dấu vết gỡ lỗi, chỉnh sửa đa tệp và các chỉnh sửa mà nhà phát triển đã thực hiện khi một tác nhân mắc lỗi, chứ không chỉ từ mã tĩnh.
Đây là một chiến lược dữ liệu khác biệt so với hầu hết các phòng thí nghiệm sử dụng, và nó đặt ra những câu hỏi công bằng về sự đồng ý và quyền riêng tư. Chúng tôi phân tích chi tiết những điều đó trong bài viết bổ sung của chúng tôi về ý nghĩa của việc đào tạo dựa trên phiên Cursor đối với các nhà phát triển.
Học tăng cường ở quy mô lớn
xAI cho biết mô hình được đào tạo trên hàng chục nghìn GPU NVIDIA GB300, với học tăng cường bao gồm “hàng trăm nghìn tác vụ, tập trung vào kỹ thuật phần mềm đa bước.” Ngăn xếp chạy các triển khai tác nhân không đồng bộ trong nhiều giờ trong khi quá trình đào tạo vẫn tiếp tục. Mục tiêu, theo lời của xAI, là “trí thông minh trên mỗi token”: ít token hơn, thông minh hơn thay vì các chuỗi suy luận dài dòng.
Công việc văn phòng, không chỉ mã hóa
Grok 4.5 hiện là mô hình mặc định trong Grok Build, và xAI dành một lượng đáng ngạc nhiên trong thông báo để nói về bảng tính. Mô hình xây dựng các mô hình Excel đa trang tính với nghiên cứu web, tạo sơ đồ PowerPoint từ các hình dạng gốc, và soạn thảo văn bản trong Word thông qua các plugin Office của xAI. Cursor định hình nó là “lần đầu tiên chúng tôi xây dựng cho nhiều hơn là kỹ thuật phần mềm.”
Các điểm chuẩn, đọc một cách trung thực
xAI đã công bố bốn điểm chuẩn mã hóa. Dưới đây là bức tranh toàn cảnh, bao gồm các mô hình vượt trội hơn Grok 4.5 trên các biểu đồ của chính xAI:
| Điểm chuẩn | Grok 4.5 | Opus 4.8 (tối đa) | GPT 5.5 (xcao) | Fable (tối đa) |
|---|---|---|---|---|
| DeepSWE 1.0 (pass@1) | 62.0% | 55.75% | 64.31% | 66.1% |
| DeepSWE 1.1 | 53% | 59% | 67% | 70% |
| Terminal Bench 2.1 | 83.3% | 78.9% | 83.4% | 84.3% |
| SWE Bench Pro (giải quyết) | 64.7% | 69.2% | 58.6% | 80.4% |
Ba điều nổi bật.
So với Claude Opus 4.8, mô hình mà Musk coi là điểm so sánh, Grok 4.5 thắng hai trên bốn. Nó thắng DeepSWE 1.0 khoảng 6 điểm và vượt qua Terminal Bench 4.4 điểm, nhưng thua DeepSWE 1.1 6 điểm và SWE Bench Pro 4.5 điểm. “Đẳng cấp Opus” là một nhãn hiệu công bằng. “Đánh bại Opus” thì không. Chúng tôi thực hiện so sánh đối đầu đầy đủ trong Grok 4.5 đấu với Claude Opus 4.8.
Claude Fable 5 (tối đa) của Anthropic đứng đầu cả bốn biểu đồ, trên trang của chính xAI. Không ai tại xAI tuyên bố vị trí dẫn đầu tuyệt đối, và các biểu đồ cũng thẳng thắn về điều đó. Grok 4.5 cạnh tranh về chi phí và tốc độ, chứ không phải khả năng cao nhất.
Nguồn gốc rất quan trọng. xAI lưu ý rằng các số liệu của đối thủ cạnh tranh đến từ “các thẻ hệ thống được công bố hoặc bảng xếp hạng điểm chuẩn của các nhà phát triển tương ứng,” và các đánh giá DeepSWE được tạo bởi Datacurve với các lần chạy do các bên bên ngoài xử lý. Điều đó minh bạch hơn so với việc tự báo cáo thuần túy, nhưng tính đến thời điểm viết bài này vẫn chưa có đánh giá độc lập hoàn toàn từ bên thứ ba về Grok 4.5. Phần phân tích chuyên sâu về điểm chuẩn của chúng tôi theo dõi những gì đã được xác minh và những gì chưa.
Hiệu quả token là câu chuyện thực sự
Con số thú vị nhất trong bản phát hành không phải là điểm chuẩn. Đó là khối lượng đầu ra. Trên SWE Bench Pro, Grok 4.5 giải quyết các tác vụ sử dụng trung bình 15.954 token đầu ra. Opus 4.8 (tối đa) sử dụng 67.020 trên cùng điểm chuẩn, nhiều hơn khoảng 4,2 lần.
Token đầu ra là thứ bạn phải trả tiền với giá 6 đô la mỗi triệu, và chúng là thứ bạn phải chờ đợi với tốc độ 80 token mỗi giây. Một mô hình giải quyết tác vụ chỉ bằng một phần tư số token sẽ rẻ hơn và nhanh hơn theo những cách mà điểm số trên bảng xếp hạng không thể hiện. xAI tuyên bố “hiệu quả token cao gấp đôi so với các mô hình hàng đầu tương đương” nói chung, giải quyết các tác vụ “trong chưa đầy một nửa số bước.”
Đối với các khối lượng công việc tác nhân, nơi một phiên duy nhất có thể tiêu tốn hàng trăm nghìn token thông qua các lệnh gọi công cụ, điều này thay đổi cách tính chi phí nhiều hơn so với giá niêm yết. Chúng tôi phân tích các con số trong bài giải thích về giá của Grok 4.5.
Cách bắt đầu sử dụng Grok 4.5
Bạn có bốn cách, ba trong số đó hiện miễn phí:
- Grok Build. Grok 4.5 là mô hình mặc định, và xAI đang “cung cấp Grok 4.5 miễn phí trong thời gian giới hạn.”
- Cursor. Có sẵn trên tất cả các gói cho máy tính để bàn, web, iOS, CLI và SDK, với mức sử dụng gấp đôi trong tuần đầu tiên. Các bước thiết lập trong hướng dẫn Cursor của chúng tôi.
- Grok CLI. Cài đặt bằng
curl -fsSL https://x.ai/cli/install.sh | bash. - API. Lấy khóa từ bảng điều khiển xAI và gọi điểm cuối Phản hồi:
curl -s https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.5",
"input": "Summarize the breaking changes in this OpenAPI diff."
}'
Hướng dẫn đầy đủ, bao gồm streaming và kiểm thử dựa trên Apidog, có trong cách sử dụng API Grok 4.5. Nếu bạn không muốn tốn credit API trong khi khám phá, các cách miễn phí được đề cập trong cách sử dụng Grok 4.5 miễn phí.
Khi bạn đã gọi điểm cuối, Apidog giúp bạn giữ cho việc tích hợp trung thực: lưu yêu cầu với các biến môi trường cho khóa của bạn, xác nhận các trường phản hồi, A/B kiểm thử grok-4.5 so với grok-4.3 trên các lời nhắc thực tế của bạn, và tạo một mô hình giả lập (mock) của cấu trúc phản hồi để nhóm frontend của bạn không bị chặn trong khi bạn điều chỉnh lời nhắc. Tải Apidog miễn phí để làm theo.
Grok 4.5 phù hợp như thế nào trong bối cảnh mô hình năm 2026
Grok 4.5 nằm trong phân khúc tiền tuyến trung cấp đông đúc. Nó có giá thấp hơn Claude Opus 4.8 (5 đô la đầu vào / 25 đô la đầu ra mỗi triệu) và thấp hơn nhiều so với Claude Fable 5, trong khi vẫn đạt điểm gần bằng Opus trên các điểm chuẩn mã hóa. So với các đối thủ mã nguồn mở như GLM 5.2, nó thắng các đánh giá mã hóa đã công bố nhưng chi phí mỗi token cao hơn.
Lời chào hàng là trí thông minh trên mỗi đô la mỗi giây, chứ không phải là vị trí đứng đầu. Nếu điểm nghẽn của bạn là thông lượng tác nhân và chi tiêu API, lời chào hàng đó đáng để thử nghiệm. Nếu bạn cần khả năng suy luận cao nhất cho những vấn đề khó nhất, các biểu đồ mà xAI đã công bố sẽ chỉ cho bạn những nơi khác.
Để biết thông tin cơ bản về các mô hình mà nó đang cạnh tranh, hãy xem Claude Opus 4.8 là gì và bài viết trước đây của chúng tôi về Grok 4.1, theo dõi cách xAI đạt được điều này.
Câu hỏi thường gặp
Grok 4.5 có miễn phí để sử dụng không? Trong thời gian giới hạn, có, trong Grok Build và Cursor. Sử dụng API phải trả phí 2 đô la/6 đô la cho mỗi triệu token. Tất cả các cách truy cập miễn phí hiện tại được liệt kê trong hướng dẫn truy cập miễn phí của chúng tôi.
ID mô hình của Grok 4.5 là gì? grok-4.5, với một dấu chấm. Sử dụng grok-4-5 trong lệnh gọi API sẽ trả về lỗi không tìm thấy mô hình.
Cửa sổ ngữ cảnh của Grok 4.5 là bao nhiêu? 500.000 token. grok-4.3 cũ hơn cung cấp 1 triệu, vì vậy hãy chọn theo khối lượng công việc, không phải theo độ mới.
Grok 4.5 có tốt hơn Claude Opus 4.8 không? Nó thắng hai trong bốn điểm chuẩn mà xAI đã công bố và thua hai điểm còn lại, với mức giá đầu vào chỉ bằng khoảng 40% của Opus. Nhanh hơn và rẻ hơn, đúng vậy. Mạnh hơn trên mọi phương diện, thì không.
Tôi có thể sử dụng Grok 4.5 ở EU không? Chưa. xAI cho biết khả năng khả dụng tại EU trên các sản phẩm và bảng điều khiển API dự kiến vào giữa tháng 7 năm 2026.
