Gemini 3.7 Flash Thông số kỹ thuật và Giá bán

Thông số kỹ thuật Gemini 3.7 Flash tóm tắt: Ngữ cảnh 1 triệu token, đầu ra 64 nghìn token, đầu vào đa phương thức, hỗ trợ công cụ, điểm chuẩn so với 3.6 Flash, các bậc giá và kênh truy cập API.

Ashley Innocent

Ashley Innocent

19 tháng 8 2026

Gemini 3.7 Flash Thông số kỹ thuật và Giá bán

Apidog cho doanh nghiệp

Triển khai tại chỗ

SSO & RBAC

Tuân thủ SOC 2

Khám phá Apidog Enterprise

Google đã phát hành Gemini 3.7 Flash vào ngày 13 tháng 8 năm 2026, ba tuần sau 3.6 Flash và trong khi Gemini 3.5 Pro vẫn bị trì hoãn. Công ty gọi đây là “mẫu hình công việc thông minh nhất của chúng tôi”, và thông báo chính thức củng cố tuyên bố này với mức tăng điểm chuẩn từ 10 đến 16 điểm trong các tác vụ mã hóa và tác vụ tác tử. Nếu bạn xây dựng dựa trên Gemini API, đây sẽ là mẫu hình bạn sẽ sử dụng trong vài tháng tới.

Trang này là thẻ tham chiếu. Mọi thông số kỹ thuật, giá cả, chênh lệch điểm chuẩn và kênh truy cập đều được tổng hợp tại một nơi, trong các bảng mà bạn có thể lướt qua trong chưa đầy một phút. Khi bạn sẵn sàng viết mã, hướng dẫn bắt đầu nhanh Gemini 3.7 Flash API sẽ hướng dẫn từng bước qua cURL, Python và Node, và Apidog cung cấp cho bạn một không gian làm việc để gửi các yêu cầu kiểm tra đến điểm cuối trước khi bất kỳ đoạn mã nào được viết.

Hãy đánh dấu trang này. Các con số dưới đây sẽ thay đổi vào ngày 1 tháng 1 năm 2027, khi cửa sổ giá giới thiệu đóng lại, và chúng tôi sẽ cập nhật các bảng thường xuyên.

Tóm tắt

Bảng thông số kỹ thuật Gemini 3.7 Flash

Các con số cốt lõi, trực tiếp từ trang mẫu hình Gemini Flash của Google và các tài liệu ra mắt.

Thông số Giá trị
ID mẫu hình gemini-3.7-flash
Ngày phát hành 13 tháng 8 năm 2026
Cửa sổ ngữ cảnh đầu vào 1.000.000 token
Giới hạn token đầu ra 64.000 token
Phương thức đầu vào Văn bản, hình ảnh, video, âm thanh, PDF
Phương thức đầu ra Văn bản
Gọi hàm Có
Tìm kiếm như một công cụ Có
Sử dụng máy tính Có
Truy xuất ngữ cảnh dài (128k needle) 97.0%
An toàn Cập nhật biện pháp bảo vệ CBRN và mạng
Khả dụng Hơn 160 quốc gia
Điểm cuối API generativelanguage.googleapis.com (khóa AI Studio) hoặc aiplatform.googleapis.com (Vertex, OAuth)

Hai hàng đáng được xem xét kỹ hơn. Giới hạn đầu ra 64k là khá rộng rãi đối với một mẫu hình Flash; điều đó có nghĩa là việc viết lại toàn bộ tệp và các đầu ra có cấu trúc dài đều có thể nằm gọn trong một phản hồi duy nhất. Và hỗ trợ sử dụng máy tính đặt 3.7 Flash vào một nhóm nhỏ các mẫu hình có thể điều khiển trình duyệt trực tiếp, mặc dù đối với hầu hết các tác vụ tự động hóa sản xuất, một lệnh gọi API có cấu trúc vẫn hiệu quả hơn. Các đánh đổi được đề cập trong bài "sử dụng máy tính so với API có cấu trúc".

Tổng quan về giá

Google đã ra mắt 3.7 Flash với giá bằng một nửa giá ra mắt của 3.6 Flash, nhưng mức giảm giá này có ngày hết hạn.

Bậc Đầu vào (mỗi 1M token) Đầu ra (mỗi 1M token) Có hiệu lực
Giới thiệu $0.75 $3.75 Đến hết ngày 31 tháng 12 năm 2026
Tiêu chuẩn $1.50 $7.50 Từ ngày 1 tháng 1 năm 2027

Đó là mức tăng gấp đôi rõ ràng ở cả hai phía vào ngày đầu năm mới. Nếu khối lượng công việc của bạn tiêu tốn nhiều token, cửa sổ giới thiệu là thời điểm để đánh giá hiệu suất, tinh chỉnh lời nhắc và khóa các chiến lược lưu vào bộ nhớ cache trong khi các sai sót chỉ tốn một nửa chi phí. Để biết các ví dụ về chi phí, cách tính token trên khối lượng công việc thực tế và các chiến lược cắt giảm chi phí trước khi mức giá tiêu chuẩn áp dụng, hãy xem "Giải thích giá Gemini 3.7 Flash". Nguồn thông tin chính xác trực tiếp là trang giá Gemini API.

Điểm chuẩn: 3.6 Flash so với 3.7 Flash

Google đã công bố các điểm khác biệt so với 3.6 Flash trong các lĩnh vực mã hóa, phát triển web, hiểu tài liệu và tự động hóa tác tử. Khoảng cách là lớn đối với một bản phát hành điểm (point release) ra mắt ba tuần sau phiên bản tiền nhiệm, một điểm mà bài viết ra mắt của 9to5Google cũng đã lưu ý.

Điểm chuẩn Gemini 3.6 Flash Gemini 3.7 Flash Chênh lệch
DeepSWE v1.1 (mã hóa tác tử) 49.0% 65.3% +16.3
FrontierCode 1.1 Main 34.4% 43.6% +9.2
WebDev Arena (Elo) 1538 1588 +50
GDP.pdf (hiểu tài liệu) 22.0% 34.0% +12.0
AutomationBench (tự động hóa tác tử) 17.0% 30.4% +13.4
Harvey LAB-AA (pháp lý) n/a 90.7% n/a
Truy xuất 128k-needle n/a 97.0% n/a

Mô hình trên bảng: các khối lượng công việc tác tử đạt được nhiều nhất. Những cải tiến mà Google công bố phù hợp, gỡ lỗi tốt hơn, mã thử nghiệm đầu tiên dễ triển khai hơn, tư duy kỹ lưỡng hơn về lập kế hoạch nhiều bước và gọi công cụ, và tuân thủ hướng dẫn chặt chẽ hơn. Việc các con số đó so sánh với các mẫu hình của Anthropic và OpenAI như thế nào là một câu hỏi riêng, được trả lời trong bài "Gemini 3.7 Flash so với Claude so với GPT".

Nơi bạn có thể sử dụng Gemini 3.7 Flash

Bảy kênh truy cập khi ra mắt. Chọn theo vai trò.

Kênh Dành cho cái gì Ai sử dụng
Gemini API Truy cập lập trình với khóa AI Studio Nhà phát triển triển khai ứng dụng
Google AI Studio Môi trường thử nghiệm trên trình duyệt, lặp lại lời nhắc, quản lý khóa Nhà phát triển tạo mẫu
Ứng dụng Gemini Trò chuyện tiêu dùng trên web và di động Người dùng cuối
Gemini Spark Môi trường mã hóa tác tử Người đăng ký AI Pro và Ultra
Google Antigravity Nền tảng phát triển ưu tiên tác tử Các nhóm xây dựng tác tử tự hành
Android Studio Tích hợp IDE cho công việc Android Nhà phát triển di động
Gemini Enterprise Triển khai được quản lý với quyền kiểm soát của quản trị viên IT doanh nghiệp

Đối với công việc API, đường dẫn khóa AI Studio giúp bạn có một yêu cầu hoạt động trong vài phút. Vertex AI mang cùng một mẫu hình đằng sau OAuth với IAM, nhật ký kiểm tra và các điểm cuối khu vực khi bạn cần kiểm soát sản xuất.

Một yêu cầu làm việc tối thiểu

Lấy khóa từ AI Studio, xuất nó và gửi một yêu cầu.

export GEMINI_API_KEY="AIza..."

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [{
      "parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
    }],
    "generationConfig": {
      "temperature": 0.4,
      "maxOutputTokens": 1024
    }
  }'

Truyền phát (Streaming) đổi phương thức thành :streamGenerateContent?alt=sse trên cùng đường dẫn. Phản hồi trả về một mảng candidates với các phần văn bản và một khối usageMetadata với số lượng token mà bạn sẽ được tính phí.

Nếu bạn không muốn chỉnh sửa JSON thủ công trong terminal, Apidog nhập đặc tả API Ngôn ngữ Sáng tạo, ràng buộc GEMINI_API_KEY làm biến môi trường trên tiêu đề x-goog-api-key và hiển thị các luồng SSE trực tiếp. Lưu một phản hồi tốt làm ví dụ một lần và chạy lại các bài kiểm tra với đối tượng kiểm thử (fixture) thay vì điểm cuối trả phí.

Giới hạn tốc độ và cấp độ

Google đặt giới hạn tốc độ cho mỗi mẫu hình và mỗi cấp độ (miễn phí, trả theo mức sử dụng và cấp độ được cấp phép), và các con số này thay đổi đủ thường xuyên đến mức bất kỳ bảng nào được in ở đây sẽ trở nên lỗi thời. Kiểm tra tài liệu Gemini API chính thức để biết giới hạn số yêu cầu mỗi phút và số token mỗi phút hiện tại cho gemini-3.7-flash.

Hai quy tắc kinh nghiệm ổn định. Hạn mức miễn phí thông qua AI Studio đủ để tạo mẫu nhưng không đủ để triển khai sản phẩm. Và mã 429 với trạng thái RESOURCE_EXHAUSTED có nghĩa là bạn đã đạt giới hạn mỗi phút hoặc mỗi ngày; hãy lùi lại với chiến lược jitter, nhóm các yêu cầu lại nếu có thể, hoặc chuyển dự án sang cấp độ trả phí.

Liên kết nhanh

Câu hỏi thường gặp

Thông số kỹ thuật của Gemini 3.7 Flash là gì trong một câu?

Cửa sổ ngữ cảnh đầu vào 1M token, giới hạn đầu ra 64k token, đầu vào đa phương thức bao gồm văn bản, hình ảnh, video, âm thanh và PDF, đầu ra văn bản, cùng với hỗ trợ gọi hàm, tìm kiếm như một công cụ và sử dụng máy tính, có thể truy cập dưới dạng gemini-3.7-flash thông qua Gemini API.

Gemini 3.7 Flash có giá bao nhiêu?

0.75 đô la cho mỗi 1M token đầu vào và 3.75 đô la cho mỗi 1M token đầu ra cho đến hết ngày 31 tháng 12 năm 2026. Từ ngày 1 tháng 1 năm 2027, mức giá tiêu chuẩn sẽ được áp dụng: 1.50 đô la cho đầu vào và 7.50 đô la cho đầu ra. Mức giá giới thiệu bằng một nửa so với giá ra mắt của 3.6 Flash.

Tôi có cần thay đổi mã của mình để nâng cấp từ 3.6 Flash không?

Việc thay đổi bản thân nó chỉ là một dòng: đổi ID mẫu hình thành gemini-3.7-flash. Những thay đổi về hành vi mới là công việc thực sự, vì 3.7 suy nghĩ kỹ hơn về các lệnh gọi công cụ nhiều bước và tuân thủ hướng dẫn chặt chẽ hơn. Hướng dẫn di chuyển từ 3.6 sang 3.7 Flash bao gồm những gì cần kiểm tra hồi quy trước khi bạn chuyển đổi lưu lượng truy cập.

Tại sao Google lại phát hành 3.7 Flash trước Gemini 3.5 Pro?

Gemini 3.5 Pro vẫn bị trì hoãn, và Axios báo cáo rằng Google đang phát hành các bản cập nhật Flash trước mẫu hình chủ lực tiếp theo của mình thay vì giữ lại các cải tiến. Khoảng cách ba tuần giữa 3.6 và 3.7 Flash phù hợp với nhịp độ đó.

Có cách nào miễn phí để thử nó không?

Có. Gói miễn phí của AI Studio bao gồm hạn mức hàng ngày cho gemini-3.7-flash, đủ để kiểm tra lời nhắc và các nguyên mẫu nhỏ, và không yêu cầu tài khoản thanh toán cho đến khi bạn cần giới hạn tốc độ cao hơn. Hướng dẫn truy cập Gemini API miễn phí bao gồm phạm vi của gói miễn phí và những việc cần làm khi bạn đạt đến giới hạn của nó.

Vị trí của 3.7 Flash trong ngăn xếp của bạn

Hãy coi 3.7 Flash là mẫu hình Gemini mặc định cho các vòng lặp tác tử, trợ lý mã hóa, quy trình tài liệu và bất kỳ thứ gì thực hiện nhiều lệnh gọi công cụ mỗi phiên. Các cải tiến về điểm chuẩn nằm chính xác ở nơi các khối lượng công việc đó hoạt động, và giá giới thiệu biến bốn tháng rưỡi tới thành cửa sổ rẻ nhất để xây dựng. Hãy giữ lại đánh giá về khả năng lập luận đẳng cấp hàng đầu cho đến khi Gemini 3.5 Pro được phát hành; đối với mọi thứ khác, đây là mẫu hình công việc mà Google nói nó là.

Trước khi ID mẫu hình được đưa vào bất kỳ mã sản xuất nào, hãy kiểm tra điểm cuối. Tải xuống Apidog để giữ các yêu cầu Gemini, môi trường, kiểm tra luồng và các đối tượng phản hồi đã lưu của bạn trong một không gian làm việc, cùng với các bộ sưu tập cho mọi nhà cung cấp khác mà bạn đang đánh giá.

Thực hành thiết kế API trong Apidog

Khám phá cách dễ dàng hơn để xây dựng và sử dụng API