ในการเรียกใช้ Grok 4.7 ให้ส่งคำขอ POST ไปยัง https://api.x.ai/v1/responses โดยมี "model": "grok-4.7" และคีย์ xAI ของคุณเป็น Bearer token มีค่าใช้จ่าย 2 ดอลลาร์ต่อโทเค็นนำเข้าหนึ่งล้านรายการ, 0.50 ดอลลาร์ต่อโทเค็นนำเข้าที่แคชไว้หนึ่งล้านรายการ และ 6 ดอลลาร์ต่อโทเค็นเอาต์พุตหนึ่งล้านรายการสำหรับพรอมต์ที่มีโทเค็นต่ำกว่า 200,000 โทเค็น โดยมีหน้าต่างบริบท 500,000 โทเค็น SpaceXAI (บริษัทเดิมชื่อ xAI) ได้เปิดตัวเมื่อวันที่ 21 กันยายน 2026 ในราคาเดียวกับ Grok 4.6 ดังนั้นสำหรับการผสานรวมที่มีอยู่ส่วนใหญ่ การอัปเกรดจึงเป็นการเปลี่ยนแปลงเพียงบรรทัดเดียว
ด้านล่าง: คำขอแรก, ความพยายามในการให้เหตุผลและผลกระทบต่อค่าใช้จ่ายของคุณ, การให้เหตุผลที่เข้ารหัส, การแคช, การสตรีม, เครื่องมือ, ขีดจำกัดอัตรา และการตั้งค่าการทดสอบที่นำกลับมาใช้ใหม่ได้ใน Apidog สำหรับข้อมูลเบื้องหลังเกี่ยวกับโมเดล โปรดอ่าน Grok 4.7 คืออะไรและมีการเปลี่ยนแปลงอะไรบ้าง; เอกสารอ้างอิงอย่างเป็นทางการคือ หน้า Grok 4.7 ในเอกสาร xAI
ภาพรวม API ของ Grok 4.7
| คุณสมบัติ | ค่า |
|---|---|
| รหัสโมเดล | grok-4.7 |
| ปลายทาง (Endpoint) | POST https://api.x.ai/v1/responses (Chat Completions ยังคงทำงานเป็นปลายทางแบบเดิม) |
| หน้าต่างบริบท | 500,000 โทเค็น |
| ขีดจำกัดเอาต์พุต | ไม่มีระบุโดย xAI |
| อินพุต / แคช / เอาต์พุต, ต่ำกว่า 200k | 2.00 ดอลลาร์ / 0.50 ดอลลาร์ / 6.00 ดอลลาร์ ต่อ 1M โทเค็น |
| อินพุต / แคช / เอาต์พุต, 200k ขึ้นไป | 4.00 ดอลลาร์ / 1.00 ดอลลาร์ / 12.00 ดอลลาร์ ต่อ 1M โทเค็น |
| ระดับความพยายามในการให้เหตุผล | low, medium, high (ค่าเริ่มต้น), xhigh |
| อินพุต | ข้อความและรูปภาพ (JPG หรือ PNG, สูงสุด 20 MiB) |
| เครื่องมือ | การเรียกใช้ฟังก์ชัน, การค้นหาเว็บ, การค้นหา X, การดำเนินการโค้ด |
| ขีดจำกัดความรู้ | พฤษภาคม 2026 |
| Batch API | ไม่รองรับ |
ขั้นตอนที่ 1: รับคีย์และเติมเครดิต
สร้างบัญชีที่ console.x.ai, เติมเครดิต (API เป็นแบบเติมเงิน) และสร้างคีย์ คู่มือคีย์ API ของ Grok ของเราจะอธิบายหน้าจอคอนโซล เก็บคีย์ของคุณให้ห่างจากโค้ด:
export XAI_API_KEY="your-key-here"
ขั้นตอนที่ 2: สร้างคำขอแรกของคุณ
Responses API คือปลายทางหลักและเป็นปลายทางที่ตัวอย่างทุกตัวอย่างในเอกสาร xAI ใช้:
curl https://api.x.ai/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $XAI_API_KEY" \
-d '{
"model": "grok-4.7",
"input": "Review this function for bugs: function median(a){a.sort();return a[a.length/2]}"
}'
API ทำงานร่วมกับ OpenAI SDK ชี้ไคลเอ็นต์ไปยัง URL พื้นฐานของ xAI และเรียกใช้ responses.create:
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.XAI_API_KEY,
baseURL: "https://api.x.ai/v1",
});
const response = await client.responses.create({
model: "grok-4.7",
reasoning: { effort: "medium" },
input: [
{ role: "system", content: "You are a senior backend reviewer." },
{ role: "user", content: "Find the bug in: function median(a){a.sort();return a[a.length/2]}" },
],
});
console.log(response.output_text);
หากคุณต้องการใช้ไคลเอ็นต์อื่น โมเดลเดียวกันคือ grok-4.7 ใน xAI's Python SDK (xai_sdk), xai.responses('grok-4.7') ใน Vercel AI SDK และ xai/grok-4.7 ใน LiteLLM ข้อควรจำด้านความเข้ากันได้สองประการ: xAI ตอนนี้ระบุว่า Chat Completions เป็นปลายทางแบบเดิม และความเข้ากันได้กับ Anthropic SDK นั้นเลิกใช้งานแล้วโดยสมบูรณ์ โค้ดใหม่ควรกำหนดเป้าหมายไปที่ /v1/responses
ขั้นตอนที่ 3: เลือกระดับความพยายามในการให้เหตุผล
Grok 4.7 ให้เหตุผลเสมอ คุณไม่สามารถปิดได้ แต่คุณสามารถควบคุมความพยายามในการคิดได้ด้วย reasoning.effort บน Responses API (reasoning_effort ใน xAI SDK): low สำหรับการเรียกใช้เครื่องมือที่ไวต่อความหน่วง, medium สำหรับการวิเคราะห์และบริบทที่ยาว, high (ค่าเริ่มต้น) สำหรับปัญหาหลายขั้นตอนที่ซับซ้อน และ xhigh เมื่อคุณภาพสำคัญกว่าเวลาตอบสนอง
การตั้งค่านี้เป็นปัจจัยสำคัญที่สุดต่อค่าใช้จ่ายของคุณ หน้าเผยแพร่ของ SpaceXAI เผยแพร่ผลลัพธ์ CursorBench 4.0 ต่อระดับความพยายาม และความแตกต่างนั้นกว้างมาก:
| ความพยายาม | CursorBench 4.0 | ต้นทุนเฉลี่ยต่องาน | โทเค็นเอาต์พุตเฉลี่ยต่องาน |
|---|---|---|---|
| low | 33.1% | $1.58 | 15,677 |
| medium | 41.6% | $3.49 | 36,683 |
| high | 43.9% | $4.69 | 56,382 |
| xhigh | 46.3% | $6.01 | 70,141 |
การเปลี่ยนจาก low เป็น xhigh เพิ่มประสิทธิภาพได้ 13.2 คะแนน และมีค่าใช้จ่ายประมาณ 3.8 เท่าต่องาน เนื่องจากโมเดลสร้างโทเค็นเอาต์พุตได้มากกว่าประมาณ 4.5 เท่า เริ่มต้นที่ medium และเลื่อนระดับขึ้นเมื่อการทดสอบของคุณแสดงให้เห็นว่าคุณภาพพิเศษนั้นมีความสำคัญเท่านั้น
ข้อจำกัดเพิ่มเติม: โมเดลการให้เหตุผลจะปฏิเสธ presencePenalty, frequencyPenalty และ stop หาก wrapper เก่าๆ ยังคงส่งค่าใดค่าหนึ่งเหล่านี้ คำขอจะส่งคืนข้อผิดพลาด
ขั้นตอนที่ 4: จัดการการให้เหตุผลที่เข้ารหัสในการเรียกแบบหลายรอบ
นี่คือการเปลี่ยนแปลงพฤติกรรมที่น่าจะทำให้คุณประหลาดใจที่สุด บน Responses API, grok-4.7 จะส่งคืน reasoning.encrypted_content เสมอ แม้ว่ารายการ include ของคุณจะไม่ได้ร้องขอ คุณไม่สามารถอ่านการให้เหตุผลได้ แต่คุณสามารถส่งต่อไปได้
สำหรับการสนทนาแบบหลายรอบ ให้ส่งรายการการให้เหตุผลจากการตอบสนองก่อนหน้ากลับไปโดยไม่เปลี่ยนแปลงใน input ของคำขอถัดไป นั่นช่วยให้การให้เหตุผลของโมเดลยังคงสมบูรณ์ตลอดการสนทนา ห้ามแก้ไข, ตัดแต่ง หรือจัดเรียงรายการเหล่านั้นใหม่ หากโค้ดของคุณกรองอาร์เรย์ output ให้เหลือเฉพาะรายการ message ก่อนที่จะสร้างรอบถัดไป ตอนนี้มันจะละทิ้งบริบทที่ Grok 4.7 คาดว่าจะได้รับกลับมา พฤติกรรมของ Chat Completions ไม่มีการเปลี่ยนแปลง
ขั้นตอนที่ 5: ใช้ประโยชน์จากการแคช
อินพุตที่แคชไว้มีค่าใช้จ่าย 0.50 ดอลลาร์ต่อโทเค็นหนึ่งล้านรายการ เทียบกับ 2 ดอลลาร์สำหรับอินพุตใหม่ ซึ่งเป็นส่วนลด 75% แต่มีข้อแม้คือ: การเรียกใช้แคชที่สำเร็จต้องให้คำขอของคุณไปถึงเซิร์ฟเวอร์ที่มี prefix นั้นอยู่แล้ว SpaceXAI “แนะนำอย่างยิ่ง” ให้ตั้งค่า prompt_cache_key ในการเรียกใช้ Responses API (หรือเฮดเดอร์ x-grok-conv-id ใน Chat Completions) ซึ่งจะส่งคำขอของการสนทนาไปยังเซิร์ฟเวอร์เดียวกัน หากไม่มีสิ่งนี้ xAI เตือนว่า คุณมักจะต้องจ่ายราคาอินพุตเต็มสำหรับเซิร์ฟเวอร์ที่ไม่มีแคช
จัดเรียงพรอมต์สำหรับการนำกลับมาใช้ใหม่: พรอมต์ระบบ, สคีมาเครื่องมือ และเอกสารอ้างอิงก่อน ตามด้วยข้อความผู้ใช้ใหม่เป็นอันดับสุดท้าย สิ่งใดก็ตามที่เปลี่ยนแปลงใกล้จุดเริ่มต้นจะทำให้ prefix เสียหายและทำให้ส่วนลดหายไป
ขั้นตอนที่ 6: สตรีมการตอบกลับ
เพิ่ม "stream": true เพื่อรับเหตุการณ์ที่ส่งจากเซิร์ฟเวอร์แทนที่จะเป็น JSON body เพียงรายการเดียวเมื่อสิ้นสุด เนื่องจากความพยายามในการให้เหตุผลเปิดใช้งานอยู่เสมอ โมเดลอาจใช้เวลาคิดสักครู่ก่อนที่จะส่งโทเค็นคำตอบแรก และการเรียกที่ไม่ใช่การสตรีมอาจดูเหมือนค้างหรือเกิดข้อผิดพลาด HTTP timeout สั้นๆ Grok 4.7 สตรีมสรุปการให้เหตุผล คุณจึงสามารถแสดงความคืบหน้าในขณะที่โมเดลกำลังคิดได้
การเรียกใช้ฟังก์ชันเป็นข้อยกเว้น: ตามเอกสาร xAI การเรียกใช้ฟังก์ชันจะมาถึงทั้งหมดในชิ้นเดียว แยกวิเคราะห์เมื่อชิ้นนั้นมาถึง แทนที่จะประกอบอาร์กิวเมนต์จากส่วนต่าง คู่มือการทดสอบ LLM API ที่สตรีมผ่าน SSE ของเราแสดงวิธีการตรวจสอบลำดับเหตุการณ์ดิบใน Apidog
ขั้นตอนที่ 7: เพิ่มเครื่องมือ
การเรียกใช้ฟังก์ชันใช้รูปแบบเครื่องมือของ Responses API คุณอธิบายฟังก์ชัน Grok จะส่งคืนรายการ function_call คุณรันมัน และส่ง function_call_output กลับไปพร้อมกับ call_id ที่ตรงกัน:
curl https://api.x.ai/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $XAI_API_KEY" \
-d '{
"model": "grok-4.7",
"input": [{"role": "user", "content": "Has order 10482 shipped yet?"}],
"tools": [{
"type": "function",
"name": "get_order_status",
"description": "Look up the fulfillment status of an order",
"parameters": {
"type": "object",
"properties": { "order_id": {"type": "string"} },
"required": ["order_id"]
}
}]
}'
รองรับเอาต์พุตที่มีโครงสร้างด้วย คุณจึงสามารถเก็บคำตอบสุดท้ายไว้ใน JSON schema ได้
เครื่องมือฝั่งเซิร์ฟเวอร์ทำงานที่ฝั่งของ xAI: {"type": "web_search"} (การค้นหาเว็บ), การค้นหา X และการดำเนินการโค้ด พวกมันจะถูกเรียกเก็บเงินนอกเหนือจากโทเค็น: การค้นหาเว็บราคา 5 ดอลลาร์ต่อ 1,000 การเรียกใช้, การค้นหา X ราคา 5 ดอลลาร์ต่อ 1,000 โพสต์ และการดำเนินการโค้ดราคา 5 ดอลลาร์ต่อ 1,000 การเรียกใช้ ดังนั้นเอเจนต์ที่ค้นหาทุกรอบจะจ่ายค่าธรรมเนียมนั้นทุกรอบ การค้นหาเว็บยอมรับ allowed_domains และ excluded_domains (สูงสุดห้ารายการต่ออัน) หากไม่มีเครื่องมือค้นหา Grok 4.7 จะไม่มีข้อมูลสด ความรู้ของมันจะหยุดลงที่เดือนพฤษภาคม 2026
ระวังราคาที่กระโดดขึ้นเมื่อถึง 200k โทเค็น
ตารางราคามีสองแถวด้วยเหตุผล เมื่อพรอมต์ถึง 200,000 โทเค็น คำขอทั้งหมดจะถูกเรียกเก็บเงินในอัตราที่สูงขึ้น: อินพุต 4 ดอลลาร์, แคช 1 ดอลลาร์, เอาต์พุต 12 ดอลลาร์ ไม่ใช่แค่โทเค็นที่เกินขีดจำกัดเท่านั้นที่มีราคาแพงขึ้น
พรอมต์ 190,00็น โทเค็นพร้อมคำตอบ 4,000 โทเค็นมีค่าใช้จ่ายประมาณ 0.40 ดอลลาร์ พรอมต์ 210,000 โทเค็นพร้อมคำตอบเดียวกันมีค่าใช้จ่ายประมาณ 0.89 ดอลลาร์ อินพุตที่เพิ่มขึ้นประมาณ 10% ทำให้ค่าใช้จ่ายเพิ่มขึ้นมากกว่าสองเท่า
นับโทเค็นก่อนที่คุณจะส่ง สรุปประวัติเมื่อการสนทนาใกล้ถึงขีดจำกัด และใช้การบีบอัดบริบทของ xAI สำหรับลูปเอเจนต์ที่ยาวนาน ส่วนราคาถูกของหน้าต่าง 500,000 โทเค็นจะสิ้นสุดที่ 200,000 โทเค็น
ขีดจำกัดอัตราและข้อผิดพลาด 429
ขีดจำกัดจะปรับตามยอดการใช้จ่ายสะสมของคุณและตรงกับของ Grok 4.6:
| ระดับ (ยอดใช้จ่ายสะสม) | คำขอต่อวินาที | โทเค็นต่อนาที |
|---|---|---|
| T0 ($0) | 150 | 50M |
| T1 ($50) | 172 | 53M |
| T2 ($250) | 208 | 60M |
| T3 ($1,000) | 312 | 74M |
| T4 ($5,000) | 500 | 100M |
โทเค็นที่แคชไว้จะถูกนับรวมในโทเค็นต่อนาที หากเกิน คุณจะได้รับ HTTP 429 ลองใหม่ด้วย exponential backoff และ jitter แทนที่จะส่งคำขอรัวๆ; คู่มือเกี่ยวกับข้อผิดพลาดขีดจำกัดอัตราเกิน ของเราครอบคลุมรูปแบบเหล่านี้
การย้ายจาก Grok 4.6
การผสานรวมส่วนใหญ่ต้องการการเปลี่ยนแปลงเดียว: grok-4.6 กลายเป็น grok-4.7 ราคา, หน้าต่างบริบท, ขีดจำกัดอัตรา และระดับความพยายามยังคงเหมือนเดิม ทดสอบสามสิ่งอีกครั้งก่อนที่คุณจะย้ายทราฟฟิกจริง:
- การจัดการแบบหลายรอบ. ยืนยันว่าโค้ดของคุณส่งรายการการให้เหตุผลที่เข้ารหัสกลับไปโดยไม่เปลี่ยนแปลง
- โทเค็นต่องาน. โมเดลฐานใหม่ที่ใหญ่ขึ้นจะเปลี่ยนจำนวนโทเค็นที่งานใช้ไป แม้ว่าจะใช้อัตราต่อโทเค็นเท่าเดิมก็ตาม วัดพรอมต์จริงของคุณ
- การจับคู่ระดับความพยายาม. เอกสารของ Cursor ระบุว่าระดับความพยายามมีความแตกต่างกันมากกว่าใน Grok 4.6 ดังนั้นเส้นทางที่ปรับแต่งที่
mediumอาจทำงานแตกต่างกัน
คู่มือ API ของ Grok 4.6 ของเรายังคงใช้ได้กับทุกสิ่งที่ไม่ได้เปลี่ยนแปลง ข้อสังเกตสองประการ: https://us.api.x.ai/v1 จะเก็บการอนุมานไว้ในสหรัฐอเมริกาโดยมีค่าพรีเมียม 10% และ Grok 4.7 Fast (ราคา 2 เท่า) มีให้ใช้เฉพาะใน Cursor และ Grok Build เท่านั้น ไม่ใช่ใน Public API
ทดสอบ API ของ Grok 4.7 ใน Apidog
คำขอที่บันทึกไว้และสามารถทำซ้ำได้ดีกว่าคำสั่ง curl ในประวัติเชลล์ของคุณเมื่อคุณเปรียบเทียบระดับความพยายามหรือตรวจสอบการอัปเกรด
- สร้างสภาพแวดล้อมใน Apidog โดยตั้งค่า
base_urlเป็นhttps://api.x.ai/v1และจัดเก็บXAI_API_KEYเป็นตัวแปรลับ เพิ่มสภาพแวดล้อมที่สองสำหรับปลายทางในสหรัฐอเมริกาหากคุณต้องการ - บันทึกคำขอ:
POST {{base_url}}/responsesพร้อมเฮดเดอร์Authorization: Bearer {{XAI_API_KEY}}และพรอมต์จริงของคุณในส่วนเนื้อหา - เพิ่มการยืนยัน: สถานะคือ 200,
modelเท่ากับgrok-4.7,usageมีอยู่ และoutputมีรายการmessageสิ่งเหล่านี้จะดักจับคีย์ที่ไม่ถูกต้อง, รหัสโมเดลที่ไม่ถูกต้อง หรือรูปร่างการตอบกลับที่เปลี่ยนแปลงไปก่อนที่แอปของคุณจะทำ - โคลนตามระดับความพยายาม (
low,medium,high,xhigh) และรันทั้งสี่เป็นสถานการณ์ทดสอบเดียว คุณจะได้รับเวลาตอบสนองและการใช้งานโทเค็นเคียงข้างกันสำหรับพรอมต์ของคุณ ไม่ใช่ของเกณฑ์มาตรฐาน - จำลองปลายทางเมื่อรูปร่างการตอบกลับเสถียร เพื่อให้งานส่วนหน้าดำเนินต่อไปได้โดยไม่ต้องเสียเครดิต
เมื่อโมเดลถัดไปถูกปล่อยออกมา ให้เปลี่ยนตัวแปรเดียวแล้วรันใหม่ ดาวน์โหลด Apidog เพื่อตั้งค่า
คำถามที่พบบ่อย
รหัสโมเดล Grok 4.7 คืออะไร? grok-4.7 บนแพลตฟอร์มพันธมิตรคือ spacexai/grok-4.7 (Vercel AI Gateway) และ x-ai/grok-4.7 (OpenRouter)
API ของ Grok 4.7 มีค่าใช้จ่ายเท่าไร? 2 ดอลลาร์ต่อโทเค็นนำเข้าหนึ่งล้านรายการ, 0.50 ดอลลาร์สำหรับแคช และ 6 ดอลลาร์สำหรับเอาต์พุตสำหรับพรอมต์ที่ต่ำกว่า 200,000 โทเค็น และเพิ่มเป็นสองเท่าเมื่อถึง 200,000 โทเค็นขึ้นไป ไม่มีส่วนลดแบบแบตช์สำหรับ 4.7
ฉันสามารถปิดการให้เหตุผลได้หรือไม่? ไม่ได้ ใช้ความพยายามระดับ low เพื่อการตอบสนองที่เร็วที่สุดและถูกที่สุด
มี Grok 4.7 API ฟรีหรือไม่? API ของ xAI ทำงานบนเครดิตแบบเติมเงิน คู่มือการใช้ Grok 4.7 ฟรี ของเราครอบคลุมเส้นทางที่ไม่มีค่าใช้จ่ายที่มีอยู่จริง
Grok 4.7 เปรียบเทียบกับ GPT-6 Sol และ Claude Opus 5.5 อย่างไร? มีราคาเอาต์พุตต่ำที่สุดในสามตัวนี้ และตามหลัง Opus 5.5 ในเกณฑ์มาตรฐานการเขียนโค้ดที่ผู้ขายทั้งสองรายรายงาน การเปรียบเทียบสามทาง มีตัวเลขให้ดู
เริ่มต้นด้วยคำขอที่บันทึกไว้หนึ่งรายการ
ส่งคำขอ curl ด้านบน จากนั้นบันทึกใน Apidog พร้อมกับการยืนยันและสถานการณ์ระดับความพยายาม คุณจะได้รับต้นทุนพื้นฐานต่องานสำหรับพรอมต์ของคุณเองก่อนที่จะย้ายทราฟฟิก ในการเลือกระดับความพยายามเริ่มต้น โปรดอ่าน รายละเอียดเกณฑ์มาตรฐาน Grok 4.7 ถัดไป
