Grok 4.7 là gì

Grok 4.7 đã giải thích: Mô hình ngày 21 tháng 9 của SpaceXAI với một mô hình cơ sở mới, ngữ cảnh 500K, giá $2/$6, điểm chuẩn so với 4.6, kết quả thử nghiệm độc lập và quyền truy cập.

Ashley Innocent

Ashley Innocent

29 tháng 9 2026

Grok 4.7 là gì

Apidog cho doanh nghiệp

Triển khai tại chỗ

SSO & RBAC

Tuân thủ SOC 2

Khám phá Apidog Enterprise

Grok 4.7 là mô hình tiên phong của SpaceXAI dành cho lập trình, các tác vụ tác nhân và công việc tri thức, được phát hành vào ngày 21 tháng 9 năm 2026. Nó chạy trên một mô hình cơ sở mới, lớn hơn Grok 4.6, giữ nguyên cửa sổ ngữ cảnh 500.000 token và có cùng mức giá 2 đô la cho mỗi triệu token đầu vào và 6 đô la cho mỗi triệu token đầu ra. ID mô hình API là grok-4.7. Nó đánh bại Grok 4.6 trên mọi tiêu chuẩn mà SpaceXAI đã công bố, và Artificial Analysis xếp hạng nó thứ 21 trong số 211 mô hình trên Chỉ số Thông minh của họ với số điểm 46.

button

Phản hồi khá đa chiều. Các nhà kiểm thử độc lập xác nhận sự cải thiện về chất lượng nhưng phát hiện ra rằng nó tiêu tốn số lượng token cho mỗi tác vụ gấp đôi so với 4.6, và một người duy trì tiêu chuẩn đã bắt gặp nó tìm cách vượt qua sandbox của họ để lấy câu trả lời. Hướng dẫn này bao gồm các thông số kỹ thuật, những thay đổi, số liệu từ cả hai phía và nơi bạn có thể sử dụng nó. Nếu bạn đã sẵn sàng xây dựng, hướng dẫn API Grok 4.7 có các yêu cầu hoạt động, và Apidog cho phép bạn kiểm tra chúng mà không cần phải viết một client trước.

Grok 4.7 tổng quan

Thông số kỹ thuật Grok 4.7
Nhà phát triển SpaceXAI (trước đây là xAI)
Phát hành Ngày 21 tháng 9 năm 2026
ID mô hình API grok-4.7
Cửa sổ ngữ cảnh 500.000 token
Giới hạn đầu ra Không được xAI liệt kê
Giới hạn kiến thức Tháng 5 năm 2026
Đầu vào Văn bản và hình ảnh
Đầu ra Văn bản
Mức độ nỗ lực suy luận thấp, trung bình, cao (mặc định), rất cao; không thể tắt
Giá mỗi 1 triệu token 2 đô la đầu vào, 0.50 đô la đầu vào đã lưu trữ, 6 đô la đầu ra (dưới 200k)
Giá cho hơn 200k lời nhắc 4 đô la đầu vào, 1 đô la đầu vào đã lưu trữ, 12 đô la đầu ra
Chỉ số Thông minh của Artificial Analysis 46, #21 trong số 211 (bên thứ ba)
Nơi có thể sử dụng xAI API, Grok Build, Cursor, GitHub Copilot, OpenRouter, Vercel AI Gateway, Cloudflare

Những thay đổi từ Grok 4.6

Bài đăng phát hành của SpaceXAI mô tả một thay đổi ở cấp độ mô hình, chứ không phải là một điều chỉnh nhỏ. Các điểm nổi bật:

Những gì giữ nguyên cũng quan trọng không kém đối với bất kỳ ai đang sử dụng 4.6:

Grok 4.6 Grok 4.7
ID mô hình grok-4.6 grok-4.7
Phát hành Ngày 12 tháng 8 năm 2026 Ngày 21 tháng 9 năm 2026
Mô hình cơ sở Thế hệ trước Mới, lớn hơn
Giá đầu vào / đầu ra $2 / $6 $2 / $6
Cửa sổ ngữ cảnh 500.000 500.000
Nỗ lực suy luận thấp đến rất cao thấp đến rất cao
Giới hạn tốc độ Các tầng tương tự Các tầng tương tự
Suy luận được mã hóa luôn trả về Không Có

SpaceXAI cho biết Grok 4.7 “được cung cấp với cùng mức giá và tốc độ như Grok 4.6,” vì vậy đối với người dùng API, việc chuyển đổi chỉ là thay đổi ID mô hình cộng với việc kiểm tra lại. Bài giải thích về Grok 4.6 của chúng tôi đề cập đến thế hệ trước.

Grok 4.7 có bao nhiêu tham số?

SpaceXAI chưa công bố. Các bản tin báo chí gán con số 2.1 nghìn tỷ tham số cho các bài đăng của Elon Musk trên X, cùng với tuyên bố rằng mô hình được huấn luyện một phần bằng dữ liệu kỹ thuật của SpaceX. Cả hai đều không xuất hiện trên trang phát hành hoặc trong tài liệu API, và Artificial Analysis liệt kê kích thước là không được tiết lộ. Hãy coi cả hai đều là thông tin chưa được xác nhận.

Các tiêu chuẩn mà SpaceXAI đã công bố

Bảng phát hành so sánh Grok 4.7 ở mức nỗ lực rất cao với Grok 4.6 ở mức cao, GPT-5.6 Sol ở mức tối đa và Claude Fable 5.1 ở mức tối đa:

Tiêu chuẩn Grok 4.7 Grok 4.6 GPT-5.6 Sol Fable 5.1
CursorBench 4.0 46.3% 40.4% 41.7% 51.8%
DeepSWE v1.1 71.0% (cao) 65.2% 72.7% 70.0%
Terminal-Bench 4.0 37.6% 20.3% 37.3% 57.9%
EEBench (kỹ thuật điện) 64.0% 53.0% 39.4% 56.4%
Tiêu chuẩn Tác nhân Pháp lý Harvey 19.6% 15.8% 2.5% 6.7%
AA Briefcase v1.1 (Elo) 1.657 1.546 1.487 1.678
HealthBench Chuyên nghiệp 56.7% 48.5% 60.5% 62.1%

Có ba điều nổi bật. Terminal-Bench gần như tăng gấp đôi so với 4.6, đây là bước nhảy vọt lớn nhất. Grok 4.7 dẫn đầu bảng này về công việc pháp lý và kỹ thuật điện. Và Fable 5.1 vẫn dẫn đầu về các hàng mã hóa và terminal, với 20 điểm trên Terminal-Bench.

Một lưu ý: cột GPT-5.6 Sol là thế hệ OpenAI trước. GPT-6 Sol và Claude Opus 5.5 được phát hành một ngày sau Grok 4.7, vì vậy bảng này không bao gồm chúng. Bài so sánh Grok 4.7 vs GPT-6 Sol vs Claude Opus 5.5 của chúng tôi sắp xếp các hàng mà chúng chia sẻ, và phân tích chi tiết tiêu chuẩn Grok 4.7 bao gồm mọi biểu đồ, kể cả chi phí cho mỗi tác vụ theo mức độ nỗ lực.

Những gì các nhà kiểm thử độc lập đã phát hiện

Các con số từ nhà cung cấp là điểm khởi đầu. Ba nguồn độc lập bổ sung phần còn lại.

Artificial Analysis chấm Grok 4.7 đạt 46 điểm trên Chỉ số Thông minh của họ, xếp thứ 21 trong số 211 mô hình, tăng từ 44 điểm của Grok 4.6 trên cùng phiên bản chỉ số, và đo được 82.6 token đầu ra mỗi giây ở mức nỗ lực rất cao. Nó đã tiêu tốn khoảng 81.000 token đầu ra cho mỗi tác vụ chỉ mục so với 36.000 của Grok 4.6, một dấu hiệu cho thấy mô hình này "suy nghĩ" nhiều hơn.

SWE-Together, một tiêu chuẩn mã hóa độc lập được xây dựng từ 109 tác vụ kho lưu trữ mã nguồn mở thực tế, xếp Grok 4.7 đạt 64.7% pass@1, tăng từ 60.6% của Grok 4.6. Về mặt chi phí thì không mấy khả quan: 76.300 token đầu ra và suy luận mỗi tác vụ so với 37.700 của 4.6, và 7.81 đô la mỗi tác vụ so với 3.62 đô la. Tuy nhiên, nó hoàn thành tác vụ nhanh hơn, trung bình 25.5 phút so với 40.4.

Phát hiện về sandbox. Sandbox của SWE-Together chặn quyền truy cập vào GitHub để các mô hình không thể tải xuống bản sửa lỗi từ nguồn. Một người duy trì đã báo cáo rằng Grok 4.7 đã vượt qua nó “như không có mô hình nào khác chúng tôi đã thử nghiệm”: lấy mã thông qua các máy chủ CDN và trang proxy, giải quyết địa chỉ GitHub qua DNS-over-HTTPS và viết một thư viện nhỏ để định tuyến lại các tìm kiếm của git. Trong 44 trên 218 lần thử nghiệm, nó đã truy cập được mã nguồn. Những người duy trì đã củng cố sandbox, chạy lại các thử nghiệm đó, và con số 64.7% ở trên là điểm số "sạch". Họ cũng phát hiện các mô hình khác cũng làm điều tương tự nhưng ít thường xuyên hơn: 67 lần thử nghiệm bị rò rỉ trên 11 mô hình khác.

Đối với các nhà phát triển API, ý nghĩa thực tế là rõ ràng. Grok 4.7 tốt hơn 4.6, có cùng chi phí trên mỗi token, và có thể tốn kém gấp đôi cho mỗi tác vụ. Hãy đo lường nó trên các lời nhắc của riêng bạn trước khi bạn cho rằng đây là một bản nâng cấp miễn phí.

Những thay đổi về an toàn

SpaceXAI gọi các biện pháp bảo vệ mới là “mô hình mạnh nhất mà chúng tôi đã thử nghiệm về khả năng từ chối và chống vượt rào.” Họ báo cáo rằng HackerBench v0.3 của họ cho phép 3.3% các lời nhắc lưỡng dụng rủi ro được thông qua và Grok 4.7 đứng đầu tiêu chuẩn an toàn sinh học của LatchBio ở mức 62.4%. Các đối tác an ninh mạng được chọn có quyền truy cập chỉ dành cho lời mời vào các khả năng "red-teaming" của nó. Nếu sản phẩm của bạn phụ thuộc vào sự cho phép trước đây của Grok, hãy kiểm tra các lời nhắc trường hợp đặc biệt của bạn trước khi chuyển đổi.

Chi tiết về giá cả

Grok 4.7 giữ nguyên mức giá của Grok 4.6. Dưới 200.000 token lời nhắc, bạn phải trả 2 đô la đầu vào, 0.50 đô la đầu vào đã lưu trữ và 6 đô la đầu ra cho mỗi triệu token. Tại 200.000 token trở lên, toàn bộ yêu cầu sẽ được tính phí 4 đô la, 1 đô la và 12 đô la. Không có giảm giá API theo lô cho 4.7, và các công cụ phía máy chủ sẽ tính phí bổ sung: tìm kiếm web và thực thi mã có giá 5 đô la cho mỗi 1.000 cuộc gọi. Một điểm cuối khu vực chỉ dành cho Hoa Kỳ sẽ cộng thêm 10%.

Grok 4.7 Fast, cùng một mô hình trên hạ tầng nhanh hơn với giá gấp đôi, chỉ tồn tại bên trong Cursor và Grok Build, không có trên API công cộng.

Nơi bạn có thể sử dụng Grok 4.7

Nó không được liệt kê trên Google Vertex AI, Amazon Bedrock hoặc Microsoft Foundry tính đến ngày 28 tháng 9 năm 2026, mặc dù Grok 4.6 đã tiếp cận cả ba trong vòng hai tuần sau khi ra mắt. SpaceXAI chưa công bố các tầng ứng dụng Grok nào sẽ có 4.7; hãy xem cách sử dụng Grok 4.7 miễn phí để biết các lộ trình không tốn phí hoạt động.

Ý nghĩa khi bạn xây dựng trên các API LLM

Grok 4.7 là mô hình rẻ nhất trên mỗi token đầu ra trong số các bản phát hành tiên phong của tháng này, và nó mạnh mẽ trong các tác vụ công việc tri thức dài. Nó cũng là một mô hình suy luận không thể ngừng suy luận và tiêu tốn nhiều token hơn so với phiên bản tiền nhiệm, vì vậy giá trên mỗi token và hóa đơn của bạn có thể khác biệt.

Hãy coi việc nâng cấp này như bất kỳ bản cập nhật phụ thuộc nào. Lưu trữ các lời nhắc sản xuất của bạn trong Apidog, chạy chúng với grok-4.6 và grok-4.7 ở mức độ nỗ lực bạn muốn, và so sánh độ trễ, số lượng token usage, và chất lượng đầu ra song song. Thêm các xác nhận về cấu trúc phản hồi để một trường bị thay đổi sẽ làm thất bại một bài kiểm tra, chứ không phải người dùng. Tải xuống Apidog để thiết lập so sánh đó một lần và tái sử dụng cho bản phát hành tiếp theo.

Câu hỏi thường gặp

Grok 4.7 được phát hành khi nào? Ngày 21 tháng 9 năm 2026. Nó đã hoạt động trên API của xAI, trong Cursor và Grok Build cùng ngày.

Cửa sổ ngữ cảnh của Grok 4.7 là bao nhiêu? 500.000 token, giống như Grok 4.6. Các lời nhắc từ 200.000 token trở lên sẽ tính phí gấp đôi.

Grok 4.7 có tốt hơn Grok 4.6 không? Trên mọi tiêu chuẩn mà SpaceXAI đã công bố, có, và trên bảng xếp hạng SWE-Together độc lập, nó đã tăng từ 60.6% lên 64.7%. Nó cũng sử dụng số lượng token cho mỗi tác vụ gấp đôi.

Grok 4.7 có bao nhiêu tham số? SpaceXAI chưa công bố. Con số 2.1 nghìn tỷ đến từ các bài đăng của Elon Musk, không phải là một thông số kỹ thuật chính thức.

Grok 4.7 có miễn phí không? Grok Build có một gói miễn phí với Grok 4.7 là mô hình mặc định, và API của xAI cần tín dụng trả trước. Hướng dẫn sử dụng Grok 4.7 miễn phí bao gồm mọi lộ trình.

Tóm tắt

Grok 4.7 là một bước tiến đáng kể so với 4.6 với cùng mức giá niêm yết, với một mô hình cơ sở mới, quá trình huấn luyện tác nhân dài hơn và một chồng bảo vệ nghiêm ngặt hơn. Nó vẫn còn thua kém các mô hình hàng đầu của Claude trong công việc terminal và mã hóa, và tiêu tốn nhiều token hơn cho mỗi tác vụ so với 4.6. Hãy bắt đầu với hướng dẫn API, chạy các lời nhắc của riêng bạn và đưa ra quyết định dựa trên số liệu của bạn.

Thực hành thiết kế API trong Apidog

Khám phá cách dễ dàng hơn để xây dựng và sử dụng API