Moonshot AI đã phát hành Kimi K3 vào ngày 16 tháng 7 năm 2026 và gọi đây là mô hình mở đầu tiên trên thế giới trong phân khúc 3 nghìn tỷ tham số. Cách đặt vấn đề này đặt ra một câu hỏi rõ ràng: nếu các trọng số là mở và điểm chuẩn mạnh mẽ, liệu K3 có bắt kịp các mô hình tiên tiến đóng hay không? Moonshot đã trả lời thành thật trong bài đăng ra mắt Kimi K3 của mình, rằng hiệu suất của K3 “vẫn còn thua kém các mô hình độc quyền mạnh nhất, Claude Fable 5 và GPT-5.6 Sol.” Vậy đây không phải là một chiến thắng vang dội. Đây là một cuộc đối đầu giữa kẻ thách thức và người dẫn đầu: GPT-5.6 Sol giữ vương miện chất lượng hàng đầu, còn Kimi K3 cạnh tranh về tính mở, độ dài ngữ cảnh và giá cả.
GPT-5.6 Sol là phiên bản tiên phong của OpenAI trong dòng GPT-5.6, cùng với Terra và Luna; Kimi K3 là lựa chọn mô hình mở mạnh nhất trong phân khúc của nó, xếp thứ tư trên Chỉ số Thông minh Phân tích Nhân tạo. Cả hai đều cung cấp các API tương thích với OpenAI, vì vậy sau này chúng tôi sẽ chạy cùng một lời nhắc trên kimi-k3 và gpt-5.6-sol trong Apidog và so sánh chất lượng, độ trễ và chi phí.
TL;DR: nhận định nhanh
- Chọn GPT-5.6 Sol để có khả năng cao nhất về trí thông minh thô và khả năng suy luận trong hệ sinh thái đóng, được lưu trữ của OpenAI. Chính Moonshot cũng thừa nhận Sol vượt trội K3 về chất lượng hàng đầu.
- Chọn Kimi K3 để có trọng số mở, khả năng tự lưu trữ, cửa sổ ngữ cảnh 1 triệu token hoặc kiểm soát chi phí chặt chẽ. Đây là mô hình mở tốt nhất trong phân khúc hiện nay, với mức giá đầu vào "cache-hit" cạnh tranh.
- Khoảng cách thực tế: chưa có điểm chuẩn độc lập, khách quan nào so sánh K3 với Sol. Sol dẫn đầu về chất lượng theo lời của nhà cung cấp; K3 dẫn đầu về tính mở, ngữ cảnh và giá cả.
- Cả hai đều sử dụng API tương thích với OpenAI, do đó chi phí chuyển đổi thấp, điều này khiến việc thử nghiệm song song là bước đi thông minh nhất trước khi bạn cam kết.
Gặp gỡ hai mô hình
Kimi K3 là sản phẩm chủ lực mới của Moonshot AI, một mô hình Mixture-of-Experts (MoE) với tổng cộng 2.8 nghìn tỷ tham số được xây dựng trên các thành phần tùy chỉnh: Kimi Delta Attention, Attention Residuals và thiết kế Stable LatentMoE kích hoạt 16 chuyên gia trong số 896 chuyên gia trên mỗi token. Moonshot chưa công bố số lượng tham số hoạt động, vốn thường dự đoán chi phí và tốc độ suy luận, vì vậy hãy coi 2.8T là tổng dung lượng, chứ không phải số lượng tính toán trên mỗi token. K3 là một mô hình suy luận chấp nhận đầu vào văn bản và hình ảnh, trả về văn bản, với cửa sổ ngữ cảnh 1 triệu token, ID mô hình là kimi-k3, và trọng số dự kiến sẽ được công khai vào khoảng ngày 27 tháng 7 năm 2026. Bài giải thích Kimi K3 là gì trình bày về kiến trúc.

GPT-5.6 Sol là mô hình tiên phong đóng của OpenAI trong thế hệ GPT-5.6, có thể truy cập thông qua API và các sản phẩm của OpenAI nhưng không phải dưới dạng trọng số có thể tải xuống. OpenAI định vị Sol là thành viên có khả năng cao nhất trong dòng, với Terra và Luna ở các điểm chi phí và độ trễ khác nhau. Chúng tôi đề cập đến sự phân chia này trong GPT-5.6 Sol so với Terra so với Luna, và OpenAI ghi lại dòng sản phẩm hiện tại và giá cả trên tài liệu nền tảng của mình. Bởi vì OpenAI lặp lại các con số này theo thời gian, chúng tôi xác định các đặc điểm cụ thể của Sol một cách định tính.
So sánh nhanh
Trường hợp giá trị của Sol phụ thuộc vào cấu hình trực tiếp của OpenAI, ô sẽ ghi rõ điều đó thay vì đoán mò.
| Khía cạnh | Kimi K3 | GPT-5.6 Sol |
|---|---|---|
| Nhà phát triển | Moonshot AI | OpenAI |
| Ra mắt | 16 tháng 7 năm 2026 | Dòng GPT-5.6, 2026 |
| Mô hình truy cập | Trọng số mở (khoảng 27 tháng 7 năm 2026) | Đóng, chỉ qua API và sản phẩm |
| Kiến trúc | MoE, 2.8T tổng tham số, 16/896 chuyên gia hoạt động; số lượng hoạt động chưa công bố | Chưa công bố |
| Chất lượng hàng đầu | Tốt nhất trong số các mô hình mở; Chỉ số Thông minh AA 57, xếp thứ #4/189; thua Sol theo Moonshot | Dẫn đầu tiên phong; được Moonshot đặt vị trí cao hơn K3 |
| Cửa sổ ngữ cảnh | 1.000.000 token | Lớn; kiểm tra tài liệu mô hình của OpenAI |
| Phương thức đầu vào | Văn bản và hình ảnh | Đa phương thức; kiểm tra tài liệu mô hình của OpenAI |
| Tốc độ đầu ra | ~62 token/giây (Artificial Analysis) | Thay đổi theo cấp độ và tải; kiểm tra OpenAI |
| Giá đầu vào | $0.30/M cache-hit, $3.00/M cache-miss | Kiểm tra giá hiện tại của OpenAI |
| Giá đầu ra | $15.00/M | Kiểm tra giá hiện tại của OpenAI |
| Tự lưu trữ | Có, khi trọng số được phát hành | Không |
| Hệ sinh thái | Ứng dụng Kimi và API tương thích OpenAI | Công cụ, SDK và tích hợp của OpenAI |
| ID mô hình | kimi-k3 |
gpt-5.6-sol (xác nhận trong tài liệu OpenAI) |
Hai lưu ý. Điểm Chỉ số Thông minh là 57 đưa K3 lên vị trí thứ tư trong số 189 mô hình được theo dõi bởi Artificial Analysis, đáng chú ý đối với một mô hình mở, nhưng điều đó không có nghĩa là K3 vượt trội Sol tổng thể: chỉ số này tổng hợp nhiều đánh giá, và chính Moonshot thừa nhận Sol có chất lượng hàng đầu cao hơn. Các con số đối đầu hiện có là từ bảng ra mắt của Moonshot bên dưới, vì vậy hãy xem chúng mang tính định hướng cho đến khi một phòng thí nghiệm trung lập chạy lại. Chúng tôi sẽ cập nhật bài đăng điểm chuẩn Kimi K3 khi có các con số độc lập.
Trí thông minh thô và chất lượng
Đây là sân nhà của Sol. Các mô hình tiên phong của OpenAI thường dẫn đầu về các tác vụ suy luận khó nhất, tác vụ tác nhân và tác vụ lập trình, và chính ngôn ngữ của Moonshot cũng đặt Sol cao hơn K3 về khả năng tổng thể. Nếu khối lượng công việc của bạn nằm ở ranh giới những gì các mô hình hiện tại có thể làm, chẳng hạn như lập kế hoạch tác nhân đa bước hoặc tái cấu trúc kho lớn, thì chất lượng biên ở đỉnh cao của đường cong là nơi Sol thể hiện giá trị của mình.
Bây giờ hãy nhìn vào K3. Chỉ số Thông minh 57 và xếp hạng thứ tư có nghĩa là nó không phải là một kẻ về nhì xa vời; nó đang trong cuộc trò chuyện tiên phong. Đối với một phần lớn công việc sản xuất (tóm tắt, phân loại, trả lời RAG, soạn thảo, trợ giúp lập trình hàng ngày), khoảng cách giữa vị trí thứ tư và vị trí cao nhất đủ nhỏ để hầu hết người dùng sẽ không nhận thấy nó trong các bài kiểm tra mù. Thường thì cả hai mô hình đều đáp ứng được yêu cầu của tác vụ của bạn, và quyết định sau đó chuyển sang tính mở, ngữ cảnh và chi phí.
Moonshot đã công bố một bảng điểm chuẩn với một cột GPT-5.6 Sol. Đây là các con số do nhà cung cấp tự chạy ở cài đặt suy luận tối đa, không phải là một lần chạy lại độc lập, vì vậy hãy cân nhắc chúng với sự thận trọng.
| Điểm chuẩn | Kimi K3 | GPT-5.6 Sol |
|---|---|---|
| Terminal-Bench 2.1 | 88.3 | 88.8 |
| DeepSWE | 67.5 | 73.0 |
| BrowseComp | 91.2 | 90.4 |
| Automation Bench | 30.8 | 29.7 |
| SpreadsheetBench 2 | 34.8 | 32.4 |
Đọc một cách trung thực, đây là tỷ lệ 3-2 trên bảng của Moonshot. K3 vượt trội Sol về BrowseComp, Automation Bench và SpreadsheetBench 2, trong khi Sol thắng Terminal-Bench 2.1 một chút và giành DeepSWE, chỉ số lập trình tác nhân khó nhất ở đây, với tỷ số rõ ràng 73.0 so với 67.5. Hàng cuối cùng đó cho thấy: lợi thế của Sol xuất hiện ở những nơi độ khó của tác vụ là cao nhất, điều này phù hợp với thừa nhận của Moonshot rằng K3 vẫn thua Sol tổng thể.
Một điều kỳ lạ cần lưu ý: Artificial Analysis đã gắn cờ K3 là dài dòng, tạo ra 130 triệu token đầu ra trong quá trình chạy Chỉ số Thông minh so với mức trung bình 63 triệu. Vì K3 tính phí $15 cho mỗi triệu token đầu ra, các câu trả lời dài hơn sẽ tốn kém hơn, vì vậy hãy lập ngân sách cho độ dài đầu ra và thắt chặt các lời nhắc. Để đọc khả năng so với một đường cơ sở đã biết, Kimi K3 so với Claude Opus 4.8 áp dụng cùng một lăng kính cho mô hình của Anthropic.
Tính mở và khả năng tự lưu trữ
Đây là nơi K3 dẫn trước một cách quyết định. Trọng số của nó sẽ được mở vào khoảng ngày 27 tháng 7 năm 2026, và điều đó thay đổi những gì bạn có thể làm: chạy nó trên cơ sở hạ tầng của riêng bạn, giữ các lời nhắc và dữ liệu nhạy cảm khỏi máy chủ của bên thứ ba, tinh chỉnh trên miền của bạn, ghim một phiên bản để một bản cập nhật ngầm không bao giờ thay đổi đầu ra của bạn và tránh phí trên mỗi token ở quy mô lớn. Đối với các ngành công nghiệp được quản lý, môi trường cách ly hoặc các sản phẩm không thể gửi dữ liệu người dùng đến API bên ngoài, một mô hình mở là lựa chọn duy nhất phù hợp.
GPT-5.6 Sol không cung cấp bất kỳ điều nào trong số đó. Nó là đóng và được lưu trữ: bạn nhận được độ tin cậy và công cụ của OpenAI, nhưng mô hình sống trên máy chủ của OpenAI, bạn không thể kiểm tra hoặc sửa đổi nó, và giá cả, tính khả dụng và hành vi là của OpenAI để thay đổi. Nhiều nhóm chấp nhận sự đánh đổi đó, vì việc tự chạy một mô hình 3 nghìn tỷ tham số cần GPU nghiêm túc, một ngăn xếp suy luận và sức mạnh vận hành thực sự. Cách đặt vấn đề là kiểm soát so với tiện lợi: K3 trao cho bạn chìa khóa; Sol trao cho bạn một dịch vụ được vận hành tốt.
Cửa sổ ngữ cảnh và công việc tài liệu dài
Kimi K3 cung cấp cửa sổ ngữ cảnh 1 triệu token, khoảng 1.500 trang trong một yêu cầu, điều này loại bỏ rất nhiều việc phân đoạn và truy xuất cho phân tích toàn bộ cơ sở mã, bộ hợp đồng lớn hoặc quỹ đạo tác nhân dài. GPT-5.6 Sol cũng hỗ trợ một cửa sổ lớn; OpenAI công bố con số hiện tại trong tài liệu mô hình của mình, và chúng tôi sẽ không bịa ra một con số mà nó điều chỉnh qua các bản phát hành. Một cảnh báo: một cửa sổ lớn là dung lượng, không phải là sự đảm bảo về khả năng ghi nhớ hoàn hảo, vì vậy hãy đo lường độ chính xác trên tài liệu của riêng bạn thay vì tin tưởng vào tiêu đề.
Giá cả và kiểm soát chi phí
Kimi K3 tính phí $0.30 cho mỗi triệu token đầu vào có cache-hit, $3.00 cho mỗi triệu token đầu vào không cache-hit, và $15.00 cho mỗi triệu token đầu ra. Tỷ lệ cache-hit là điểm đáng chú ý: nếu ứng dụng của bạn tái sử dụng một lời nhắc hệ thống lớn hoặc ngữ cảnh tài liệu ổn định và nó được lưu trữ đệm, chi phí đầu vào của bạn sẽ giảm một bậc so với cache-miss. Điều đó thưởng cho việc tái sử dụng lời nhắc nhiều, chẳng hạn như trò chuyện trên một cơ sở tri thức cố định. Phân tích giá Kimi K3 sẽ tính toán chi tiết.
Giá của GPT-5.6 Sol do OpenAI đặt, và các mô hình đóng tiên phong thường có giá cao hơn. Hãy kiểm tra giá hiện tại của OpenAI so với hỗn hợp token của riêng bạn; hướng dẫn định giá GPT-5.6 bao gồm các cấp độ, và Terra và Luna cung cấp các điểm giá rẻ hơn khi giới hạn của Sol là quá mức. Điều rút ra không phải là K3 luôn rẻ hơn, mà là nó mang lại cho bạn hai đòn bẩy mà Sol không có: giá đầu vào cache-hit mạnh mẽ và tùy chọn bỏ qua phí trên mỗi token bằng cách tự lưu trữ.
Hệ sinh thái, công cụ và tốc độ
Hệ sinh thái của OpenAI là một lợi thế thực sự cho Sol. Các SDK, tài liệu, tích hợp và công cụ xung quanh chức năng gọi và đầu ra có cấu trúc của nó đã trưởng thành và được hỗ trợ rộng rãi, vì vậy nếu ngăn xếp của bạn đã chạy trên OpenAI, việc áp dụng Sol gần như miễn phí về mặt kỹ thuật; chúng tôi đề cập đến các mẫu gọi trong cách sử dụng API GPT-5.6. Kimi K3 thu hẹp khoảng cách đó: API của nó tương thích với OpenAI-SDK, vì vậy bạn chỉ cần thay đổi URL cơ sở và ID mô hình thành kimi-k3 và hầu hết mã vẫn hoạt động, đó là lý do tại sao một cuộc so sánh K3-với-Sol là thực tế chứ không phải là viết lại. K3 cũng tồn tại trong các sản phẩm của Moonshot, bao gồm Kimi Code và Kimi Work.
Về tốc độ, Artificial Analysis đã đo K3 ở khoảng 62 token mỗi giây với thời gian đến token đầu tiên gần 2 giây, thấp hơn mức trung bình khoảng 73 đối với các mô hình suy luận trong cùng phân khúc giá. Thông lượng của Sol thay đổi theo cấp độ và tải, vì vậy hãy đo tốc độ dưới sự đồng thời của riêng bạn, và đánh giá cả hai với tải trọng thực tế nếu độ trễ là quan trọng và người dùng phải đối mặt.
Ma trận quyết định
Điều này ánh xạ trục bạn quan tâm đến mô hình có xu hướng chiến thắng trên đó.
| Nếu ưu tiên của bạn là… | Nghiêng về | Tại sao |
|---|---|---|
| Chất lượng suy luận hàng đầu tuyệt đối | GPT-5.6 Sol | Được bài đăng ra mắt của Moonshot đặt vị trí cao hơn K3 |
| Trọng số mở và khả năng kiểm tra | Kimi K3 | Trọng số sẽ mở vào khoảng 27 tháng 7 năm 2026 |
| Tự lưu trữ hoặc triển khai cách ly | Kimi K3 | Sol chỉ đóng và được lưu trữ |
| Lưu trú dữ liệu và kiểm soát quyền riêng tư | Kimi K3 | Chạy nó trên cơ sở hạ tầng của riêng bạn |
| Ngữ cảnh rất dài (gần 1M token) | Kimi K3 | Cửa sổ 1M được công bố |
| Hệ sinh thái và công cụ trưởng thành | GPT-5.6 Sol | SDK và tích hợp của OpenAI |
| Đầu vào rẻ với khả năng tái sử dụng lời nhắc nhiều | Kimi K3 | Đầu vào cache-hit $0.30/M |
| Đơn giản hóa vận hành, không gánh nặng vận hành | GPT-5.6 Sol | Dịch vụ được quản lý hoàn toàn |
| Tinh chỉnh trên miền của riêng bạn | Kimi K3 | Trọng số mở cho phép điều đó |
| Rủi ro thấp nhất đối với các tác vụ tác nhân khó nhất | GPT-5.6 Sol | Khả năng tiên phong cao nhất |
Sol thắng ở cột chất lượng và tiện lợi; K3 thắng ở cột kiểm soát, ngữ cảnh và chi phí. Chúng là các hệ thống giá trị khác nhau, vì vậy một công cụ nội bộ nhạy cảm với quyền riêng tư và một sản phẩm tác nhân tiên phong sẽ chọn các mô hình đối lập một cách chính xác.
Các trường hợp sử dụng thực tế
Một công ty fintech đang xây dựng trợ lý tài liệu nội bộ. Các quy tắc tuân thủ cấm gửi dữ liệu khách hàng đến API bên ngoài, điều này loại bỏ Sol và hướng thẳng đến Kimi K3, với trọng số mở cho phép nhóm tự lưu trữ đằng sau tường lửa của họ. Cửa sổ ngữ cảnh 1M giúp xử lý các hồ sơ dài, và chất lượng là quá đủ, vì vậy khoảng cách nhỏ ở mức cao nhất không làm thay đổi quyết định.
Một startup đang phát hành một copilot lập trình tiên phong. Toàn bộ lời chào hàng của nó là xử lý các tác vụ tái cấu trúc mà các công cụ khác gặp khó khăn, vì vậy độ tin cậy biên của GPT-5.6 Sol trên các tác vụ khó là sản phẩm, và công cụ của OpenAI rút ngắn thời gian xây dựng. Nhóm chấp nhận trả phí cao và giữ kín. Để xem xét K3 về mặt lập trình, hãy xem Kimi K3 để lập trình.
Thử nghiệm cả hai trong Apidog
Cách tốt nhất để giải quyết cuộc tranh luận về chất lượng so với chi phí là chạy các lời nhắc của riêng bạn trên cả hai song song. Vì K3 và Sol đều tương thích với OpenAI, Apidog biến điều đó thành một bài tập chỉ trong năm phút. Tạo hai yêu cầu đến điểm cuối hoàn thành cuộc trò chuyện của mỗi nhà cung cấp: một với URL cơ sở được đặt là API của Moonshot và mô hình kimi-k3, cái kia hướng đến OpenAI với gpt-5.6-sol. Gửi cùng một lời nhắc cho cả hai và so sánh chất lượng phản hồi, mức sử dụng token và độ trễ. Lưu khóa API của bạn dưới dạng biến môi trường để không có gì bị rò rỉ vào phần nội dung yêu cầu. Tải Apidog để thiết lập, và Apidog trong VS Code giữ vòng lặp bên cạnh mã của bạn.
Kết luận
Kimi K3 và GPT-5.6 Sol không thực sự cạnh tranh cho cùng một công việc. Sol là lựa chọn hàng đầu về chất lượng và hệ sinh thái, và chính bài đăng ra mắt của Moonshot cũng thừa nhận rằng nó vượt trội hơn K3 về khả năng thô. K3 là lựa chọn về tính mở, ngữ cảnh dài và chi phí, và nó là mô hình mở mạnh nhất trong phân khúc của mình chứ không phải là một sự thỏa hiệp. Cần khả năng cao nhất và một dịch vụ được quản lý? Sol là lựa chọn an toàn hơn. Cần sở hữu trọng số, giữ dữ liệu nội bộ, làm việc với cửa sổ ngữ cảnh 1 triệu token, hoặc cắt giảm chi phí đầu vào bằng cách lưu trữ đệm? K3 phù hợp. Vì cả hai đều sử dụng cùng một phương ngữ API, hãy cho chúng cùng một lời nhắc, đo lường và để các con số của bạn quyết định.
Câu hỏi thường gặp
Liệu Kimi K3 có tốt hơn GPT-5.6 Sol không? Không phải về chất lượng hàng đầu tổng thể. Chính bài đăng ra mắt của Moonshot nói rằng K3 vẫn thua kém các mô hình độc quyền mạnh nhất, cụ thể là Claude Fable 5 và GPT-5.6 Sol. K3 dẫn đầu về tính mở, cửa sổ ngữ cảnh 1M của nó và sự linh hoạt về giá cả, nhưng nó không tuyên bố đánh bại Sol về trí thông minh thô.
Có bảng điểm chuẩn trực tiếp nào giữa K3 và Sol không? Có, nhưng cho đến nay chỉ là một bảng do nhà cung cấp tự chạy. Bài đăng ra mắt của Moonshot công bố một bảng trong đó K3 thắng BrowseComp, Automation Bench và SpreadsheetBench 2, còn Sol thắng Terminal-Bench 2.1 và DeepSWE. Đó là những con số của chính Moonshot, không phải là kết quả chạy lại độc lập, vì vậy hãy xem chúng mang tính định hướng.
Tôi có thể tự lưu trữ Kimi K3 không? Có, khi các trọng số được mở vào khoảng ngày 27 tháng 7 năm 2026. Điều đó cho phép bạn chạy K3 trên cơ sở hạ tầng của riêng mình, tinh chỉnh nó và giữ dữ liệu nội bộ. GPT-5.6 Sol chỉ là mô hình đóng và được lưu trữ.
Kimi K3 có giá bao nhiêu? K3 tính phí $0.30 cho mỗi triệu token đầu vào có cache-hit, $3.00 cho mỗi triệu token đầu vào không cache-hit, và $15.00 cho mỗi triệu token đầu ra. Tỷ lệ cache-hit thưởng cho các khối lượng công việc tái sử dụng một lời nhắc lớn, ổn định. Đối với Sol, hãy kiểm tra giá hiện tại của OpenAI.
