วิธีใช้งาน Grok 4.7 API

เรียกใช้งาน Grok 4.7 ผ่าน api.x.ai/v1/responses: รหัสโมเดล grok-4.7, ราคา $2/$6, ความพยายามในการประมวลผลเหตุผล, การประมวลผลเหตุผลแบบเข้ารหัส, การแคช, เครื่องมือ, และการจำกัดอัตราการเรียกใช้งาน

Medy Evrard

29 September 2026

วิธีใช้งาน Grok 4.7 API

Apidog สำหรับองค์กร

การติดตั้งแบบ On-Premises

SSO & RBAC

รองรับมาตรฐาน SOC 2

สำรวจ Apidog Enterprise

ในการเรียกใช้ Grok 4.7 ให้ส่งคำขอ POST ไปยัง https://api.x.ai/v1/responses โดยมี "model": "grok-4.7" และคีย์ xAI ของคุณเป็น Bearer token มีค่าใช้จ่าย 2 ดอลลาร์ต่อโทเค็นนำเข้าหนึ่งล้านรายการ, 0.50 ดอลลาร์ต่อโทเค็นนำเข้าที่แคชไว้หนึ่งล้านรายการ และ 6 ดอลลาร์ต่อโทเค็นเอาต์พุตหนึ่งล้านรายการสำหรับพรอมต์ที่มีโทเค็นต่ำกว่า 200,000 โทเค็น โดยมีหน้าต่างบริบท 500,000 โทเค็น SpaceXAI (บริษัทเดิมชื่อ xAI) ได้เปิดตัวเมื่อวันที่ 21 กันยายน 2026 ในราคาเดียวกับ Grok 4.6 ดังนั้นสำหรับการผสานรวมที่มีอยู่ส่วนใหญ่ การอัปเกรดจึงเป็นการเปลี่ยนแปลงเพียงบรรทัดเดียว

ปุ่ม

ด้านล่าง: คำขอแรก, ความพยายามในการให้เหตุผลและผลกระทบต่อค่าใช้จ่ายของคุณ, การให้เหตุผลที่เข้ารหัส, การแคช, การสตรีม, เครื่องมือ, ขีดจำกัดอัตรา และการตั้งค่าการทดสอบที่นำกลับมาใช้ใหม่ได้ใน Apidog สำหรับข้อมูลเบื้องหลังเกี่ยวกับโมเดล โปรดอ่าน Grok 4.7 คืออะไรและมีการเปลี่ยนแปลงอะไรบ้าง; เอกสารอ้างอิงอย่างเป็นทางการคือ หน้า Grok 4.7 ในเอกสาร xAI

ภาพรวม API ของ Grok 4.7

คุณสมบัติ ค่า
รหัสโมเดล grok-4.7
ปลายทาง (Endpoint) POST https://api.x.ai/v1/responses (Chat Completions ยังคงทำงานเป็นปลายทางแบบเดิม)
หน้าต่างบริบท 500,000 โทเค็น
ขีดจำกัดเอาต์พุต ไม่มีระบุโดย xAI
อินพุต / แคช / เอาต์พุต, ต่ำกว่า 200k 2.00 ดอลลาร์ / 0.50 ดอลลาร์ / 6.00 ดอลลาร์ ต่อ 1M โทเค็น
อินพุต / แคช / เอาต์พุต, 200k ขึ้นไป 4.00 ดอลลาร์ / 1.00 ดอลลาร์ / 12.00 ดอลลาร์ ต่อ 1M โทเค็น
ระดับความพยายามในการให้เหตุผล low, medium, high (ค่าเริ่มต้น), xhigh
อินพุต ข้อความและรูปภาพ (JPG หรือ PNG, สูงสุด 20 MiB)
เครื่องมือ การเรียกใช้ฟังก์ชัน, การค้นหาเว็บ, การค้นหา X, การดำเนินการโค้ด
ขีดจำกัดความรู้ พฤษภาคม 2026
Batch API ไม่รองรับ

ขั้นตอนที่ 1: รับคีย์และเติมเครดิต

สร้างบัญชีที่ console.x.ai, เติมเครดิต (API เป็นแบบเติมเงิน) และสร้างคีย์ คู่มือคีย์ API ของ Grok ของเราจะอธิบายหน้าจอคอนโซล เก็บคีย์ของคุณให้ห่างจากโค้ด:

export XAI_API_KEY="your-key-here"

ขั้นตอนที่ 2: สร้างคำขอแรกของคุณ

Responses API คือปลายทางหลักและเป็นปลายทางที่ตัวอย่างทุกตัวอย่างในเอกสาร xAI ใช้:

curl https://api.x.ai/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -d '{
    "model": "grok-4.7",
    "input": "Review this function for bugs: function median(a){a.sort();return a[a.length/2]}"
  }'

API ทำงานร่วมกับ OpenAI SDK ชี้ไคลเอ็นต์ไปยัง URL พื้นฐานของ xAI และเรียกใช้ responses.create:

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.XAI_API_KEY,
  baseURL: "https://api.x.ai/v1",
});

const response = await client.responses.create({
  model: "grok-4.7",
  reasoning: { effort: "medium" },
  input: [
    { role: "system", content: "You are a senior backend reviewer." },
    { role: "user", content: "Find the bug in: function median(a){a.sort();return a[a.length/2]}" },
  ],
});

console.log(response.output_text);

หากคุณต้องการใช้ไคลเอ็นต์อื่น โมเดลเดียวกันคือ grok-4.7 ใน xAI's Python SDK (xai_sdk), xai.responses('grok-4.7') ใน Vercel AI SDK และ xai/grok-4.7 ใน LiteLLM ข้อควรจำด้านความเข้ากันได้สองประการ: xAI ตอนนี้ระบุว่า Chat Completions เป็นปลายทางแบบเดิม และความเข้ากันได้กับ Anthropic SDK นั้นเลิกใช้งานแล้วโดยสมบูรณ์ โค้ดใหม่ควรกำหนดเป้าหมายไปที่ /v1/responses

ขั้นตอนที่ 3: เลือกระดับความพยายามในการให้เหตุผล

Grok 4.7 ให้เหตุผลเสมอ คุณไม่สามารถปิดได้ แต่คุณสามารถควบคุมความพยายามในการคิดได้ด้วย reasoning.effort บน Responses API (reasoning_effort ใน xAI SDK): low สำหรับการเรียกใช้เครื่องมือที่ไวต่อความหน่วง, medium สำหรับการวิเคราะห์และบริบทที่ยาว, high (ค่าเริ่มต้น) สำหรับปัญหาหลายขั้นตอนที่ซับซ้อน และ xhigh เมื่อคุณภาพสำคัญกว่าเวลาตอบสนอง

การตั้งค่านี้เป็นปัจจัยสำคัญที่สุดต่อค่าใช้จ่ายของคุณ หน้าเผยแพร่ของ SpaceXAI เผยแพร่ผลลัพธ์ CursorBench 4.0 ต่อระดับความพยายาม และความแตกต่างนั้นกว้างมาก:

ความพยายาม CursorBench 4.0 ต้นทุนเฉลี่ยต่องาน โทเค็นเอาต์พุตเฉลี่ยต่องาน
low 33.1% $1.58 15,677
medium 41.6% $3.49 36,683
high 43.9% $4.69 56,382
xhigh 46.3% $6.01 70,141

การเปลี่ยนจาก low เป็น xhigh เพิ่มประสิทธิภาพได้ 13.2 คะแนน และมีค่าใช้จ่ายประมาณ 3.8 เท่าต่องาน เนื่องจากโมเดลสร้างโทเค็นเอาต์พุตได้มากกว่าประมาณ 4.5 เท่า เริ่มต้นที่ medium และเลื่อนระดับขึ้นเมื่อการทดสอบของคุณแสดงให้เห็นว่าคุณภาพพิเศษนั้นมีความสำคัญเท่านั้น

ข้อจำกัดเพิ่มเติม: โมเดลการให้เหตุผลจะปฏิเสธ presencePenalty, frequencyPenalty และ stop หาก wrapper เก่าๆ ยังคงส่งค่าใดค่าหนึ่งเหล่านี้ คำขอจะส่งคืนข้อผิดพลาด

ขั้นตอนที่ 4: จัดการการให้เหตุผลที่เข้ารหัสในการเรียกแบบหลายรอบ

นี่คือการเปลี่ยนแปลงพฤติกรรมที่น่าจะทำให้คุณประหลาดใจที่สุด บน Responses API, grok-4.7 จะส่งคืน reasoning.encrypted_content เสมอ แม้ว่ารายการ include ของคุณจะไม่ได้ร้องขอ คุณไม่สามารถอ่านการให้เหตุผลได้ แต่คุณสามารถส่งต่อไปได้

สำหรับการสนทนาแบบหลายรอบ ให้ส่งรายการการให้เหตุผลจากการตอบสนองก่อนหน้ากลับไปโดยไม่เปลี่ยนแปลงใน input ของคำขอถัดไป นั่นช่วยให้การให้เหตุผลของโมเดลยังคงสมบูรณ์ตลอดการสนทนา ห้ามแก้ไข, ตัดแต่ง หรือจัดเรียงรายการเหล่านั้นใหม่ หากโค้ดของคุณกรองอาร์เรย์ output ให้เหลือเฉพาะรายการ message ก่อนที่จะสร้างรอบถัดไป ตอนนี้มันจะละทิ้งบริบทที่ Grok 4.7 คาดว่าจะได้รับกลับมา พฤติกรรมของ Chat Completions ไม่มีการเปลี่ยนแปลง

ขั้นตอนที่ 5: ใช้ประโยชน์จากการแคช

อินพุตที่แคชไว้มีค่าใช้จ่าย 0.50 ดอลลาร์ต่อโทเค็นหนึ่งล้านรายการ เทียบกับ 2 ดอลลาร์สำหรับอินพุตใหม่ ซึ่งเป็นส่วนลด 75% แต่มีข้อแม้คือ: การเรียกใช้แคชที่สำเร็จต้องให้คำขอของคุณไปถึงเซิร์ฟเวอร์ที่มี prefix นั้นอยู่แล้ว SpaceXAI “แนะนำอย่างยิ่ง” ให้ตั้งค่า prompt_cache_key ในการเรียกใช้ Responses API (หรือเฮดเดอร์ x-grok-conv-id ใน Chat Completions) ซึ่งจะส่งคำขอของการสนทนาไปยังเซิร์ฟเวอร์เดียวกัน หากไม่มีสิ่งนี้ xAI เตือนว่า คุณมักจะต้องจ่ายราคาอินพุตเต็มสำหรับเซิร์ฟเวอร์ที่ไม่มีแคช

จัดเรียงพรอมต์สำหรับการนำกลับมาใช้ใหม่: พรอมต์ระบบ, สคีมาเครื่องมือ และเอกสารอ้างอิงก่อน ตามด้วยข้อความผู้ใช้ใหม่เป็นอันดับสุดท้าย สิ่งใดก็ตามที่เปลี่ยนแปลงใกล้จุดเริ่มต้นจะทำให้ prefix เสียหายและทำให้ส่วนลดหายไป

ขั้นตอนที่ 6: สตรีมการตอบกลับ

เพิ่ม "stream": true เพื่อรับเหตุการณ์ที่ส่งจากเซิร์ฟเวอร์แทนที่จะเป็น JSON body เพียงรายการเดียวเมื่อสิ้นสุด เนื่องจากความพยายามในการให้เหตุผลเปิดใช้งานอยู่เสมอ โมเดลอาจใช้เวลาคิดสักครู่ก่อนที่จะส่งโทเค็นคำตอบแรก และการเรียกที่ไม่ใช่การสตรีมอาจดูเหมือนค้างหรือเกิดข้อผิดพลาด HTTP timeout สั้นๆ Grok 4.7 สตรีมสรุปการให้เหตุผล คุณจึงสามารถแสดงความคืบหน้าในขณะที่โมเดลกำลังคิดได้

การเรียกใช้ฟังก์ชันเป็นข้อยกเว้น: ตามเอกสาร xAI การเรียกใช้ฟังก์ชันจะมาถึงทั้งหมดในชิ้นเดียว แยกวิเคราะห์เมื่อชิ้นนั้นมาถึง แทนที่จะประกอบอาร์กิวเมนต์จากส่วนต่าง คู่มือการทดสอบ LLM API ที่สตรีมผ่าน SSE ของเราแสดงวิธีการตรวจสอบลำดับเหตุการณ์ดิบใน Apidog

ขั้นตอนที่ 7: เพิ่มเครื่องมือ

การเรียกใช้ฟังก์ชันใช้รูปแบบเครื่องมือของ Responses API คุณอธิบายฟังก์ชัน Grok จะส่งคืนรายการ function_call คุณรันมัน และส่ง function_call_output กลับไปพร้อมกับ call_id ที่ตรงกัน:

curl https://api.x.ai/v1/responses \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -d '{
    "model": "grok-4.7",
    "input": [{"role": "user", "content": "Has order 10482 shipped yet?"}],
    "tools": [{
      "type": "function",
      "name": "get_order_status",
      "description": "Look up the fulfillment status of an order",
      "parameters": {
        "type": "object",
        "properties": { "order_id": {"type": "string"} },
        "required": ["order_id"]
      }
    }]
  }'

รองรับเอาต์พุตที่มีโครงสร้างด้วย คุณจึงสามารถเก็บคำตอบสุดท้ายไว้ใน JSON schema ได้

เครื่องมือฝั่งเซิร์ฟเวอร์ทำงานที่ฝั่งของ xAI: {"type": "web_search"} (การค้นหาเว็บ), การค้นหา X และการดำเนินการโค้ด พวกมันจะถูกเรียกเก็บเงินนอกเหนือจากโทเค็น: การค้นหาเว็บราคา 5 ดอลลาร์ต่อ 1,000 การเรียกใช้, การค้นหา X ราคา 5 ดอลลาร์ต่อ 1,000 โพสต์ และการดำเนินการโค้ดราคา 5 ดอลลาร์ต่อ 1,000 การเรียกใช้ ดังนั้นเอเจนต์ที่ค้นหาทุกรอบจะจ่ายค่าธรรมเนียมนั้นทุกรอบ การค้นหาเว็บยอมรับ allowed_domains และ excluded_domains (สูงสุดห้ารายการต่ออัน) หากไม่มีเครื่องมือค้นหา Grok 4.7 จะไม่มีข้อมูลสด ความรู้ของมันจะหยุดลงที่เดือนพฤษภาคม 2026

ระวังราคาที่กระโดดขึ้นเมื่อถึง 200k โทเค็น

ตารางราคามีสองแถวด้วยเหตุผล เมื่อพรอมต์ถึง 200,000 โทเค็น คำขอทั้งหมดจะถูกเรียกเก็บเงินในอัตราที่สูงขึ้น: อินพุต 4 ดอลลาร์, แคช 1 ดอลลาร์, เอาต์พุต 12 ดอลลาร์ ไม่ใช่แค่โทเค็นที่เกินขีดจำกัดเท่านั้นที่มีราคาแพงขึ้น

พรอมต์ 190,00็น โทเค็นพร้อมคำตอบ 4,000 โทเค็นมีค่าใช้จ่ายประมาณ 0.40 ดอลลาร์ พรอมต์ 210,000 โทเค็นพร้อมคำตอบเดียวกันมีค่าใช้จ่ายประมาณ 0.89 ดอลลาร์ อินพุตที่เพิ่มขึ้นประมาณ 10% ทำให้ค่าใช้จ่ายเพิ่มขึ้นมากกว่าสองเท่า

นับโทเค็นก่อนที่คุณจะส่ง สรุปประวัติเมื่อการสนทนาใกล้ถึงขีดจำกัด และใช้การบีบอัดบริบทของ xAI สำหรับลูปเอเจนต์ที่ยาวนาน ส่วนราคาถูกของหน้าต่าง 500,000 โทเค็นจะสิ้นสุดที่ 200,000 โทเค็น

ขีดจำกัดอัตราและข้อผิดพลาด 429

ขีดจำกัดจะปรับตามยอดการใช้จ่ายสะสมของคุณและตรงกับของ Grok 4.6:

ระดับ (ยอดใช้จ่ายสะสม) คำขอต่อวินาที โทเค็นต่อนาที
T0 ($0) 150 50M
T1 ($50) 172 53M
T2 ($250) 208 60M
T3 ($1,000) 312 74M
T4 ($5,000) 500 100M

โทเค็นที่แคชไว้จะถูกนับรวมในโทเค็นต่อนาที หากเกิน คุณจะได้รับ HTTP 429 ลองใหม่ด้วย exponential backoff และ jitter แทนที่จะส่งคำขอรัวๆ; คู่มือเกี่ยวกับข้อผิดพลาดขีดจำกัดอัตราเกิน ของเราครอบคลุมรูปแบบเหล่านี้

การย้ายจาก Grok 4.6

การผสานรวมส่วนใหญ่ต้องการการเปลี่ยนแปลงเดียว: grok-4.6 กลายเป็น grok-4.7 ราคา, หน้าต่างบริบท, ขีดจำกัดอัตรา และระดับความพยายามยังคงเหมือนเดิม ทดสอบสามสิ่งอีกครั้งก่อนที่คุณจะย้ายทราฟฟิกจริง:

คู่มือ API ของ Grok 4.6 ของเรายังคงใช้ได้กับทุกสิ่งที่ไม่ได้เปลี่ยนแปลง ข้อสังเกตสองประการ: https://us.api.x.ai/v1 จะเก็บการอนุมานไว้ในสหรัฐอเมริกาโดยมีค่าพรีเมียม 10% และ Grok 4.7 Fast (ราคา 2 เท่า) มีให้ใช้เฉพาะใน Cursor และ Grok Build เท่านั้น ไม่ใช่ใน Public API

ทดสอบ API ของ Grok 4.7 ใน Apidog

คำขอที่บันทึกไว้และสามารถทำซ้ำได้ดีกว่าคำสั่ง curl ในประวัติเชลล์ของคุณเมื่อคุณเปรียบเทียบระดับความพยายามหรือตรวจสอบการอัปเกรด

  1. สร้างสภาพแวดล้อมใน Apidog โดยตั้งค่า base_url เป็น https://api.x.ai/v1 และจัดเก็บ XAI_API_KEY เป็นตัวแปรลับ เพิ่มสภาพแวดล้อมที่สองสำหรับปลายทางในสหรัฐอเมริกาหากคุณต้องการ
  2. บันทึกคำขอ: POST {{base_url}}/responses พร้อมเฮดเดอร์ Authorization: Bearer {{XAI_API_KEY}} และพรอมต์จริงของคุณในส่วนเนื้อหา
  3. เพิ่มการยืนยัน: สถานะคือ 200, model เท่ากับ grok-4.7, usage มีอยู่ และ output มีรายการ message สิ่งเหล่านี้จะดักจับคีย์ที่ไม่ถูกต้อง, รหัสโมเดลที่ไม่ถูกต้อง หรือรูปร่างการตอบกลับที่เปลี่ยนแปลงไปก่อนที่แอปของคุณจะทำ
  4. โคลนตามระดับความพยายาม (low, medium, high, xhigh) และรันทั้งสี่เป็นสถานการณ์ทดสอบเดียว คุณจะได้รับเวลาตอบสนองและการใช้งานโทเค็นเคียงข้างกันสำหรับพรอมต์ของคุณ ไม่ใช่ของเกณฑ์มาตรฐาน
  5. จำลองปลายทางเมื่อรูปร่างการตอบกลับเสถียร เพื่อให้งานส่วนหน้าดำเนินต่อไปได้โดยไม่ต้องเสียเครดิต

เมื่อโมเดลถัดไปถูกปล่อยออกมา ให้เปลี่ยนตัวแปรเดียวแล้วรันใหม่ ดาวน์โหลด Apidog เพื่อตั้งค่า

คำถามที่พบบ่อย

รหัสโมเดล Grok 4.7 คืออะไร? grok-4.7 บนแพลตฟอร์มพันธมิตรคือ spacexai/grok-4.7 (Vercel AI Gateway) และ x-ai/grok-4.7 (OpenRouter)

API ของ Grok 4.7 มีค่าใช้จ่ายเท่าไร? 2 ดอลลาร์ต่อโทเค็นนำเข้าหนึ่งล้านรายการ, 0.50 ดอลลาร์สำหรับแคช และ 6 ดอลลาร์สำหรับเอาต์พุตสำหรับพรอมต์ที่ต่ำกว่า 200,000 โทเค็น และเพิ่มเป็นสองเท่าเมื่อถึง 200,000 โทเค็นขึ้นไป ไม่มีส่วนลดแบบแบตช์สำหรับ 4.7

ฉันสามารถปิดการให้เหตุผลได้หรือไม่? ไม่ได้ ใช้ความพยายามระดับ low เพื่อการตอบสนองที่เร็วที่สุดและถูกที่สุด

มี Grok 4.7 API ฟรีหรือไม่? API ของ xAI ทำงานบนเครดิตแบบเติมเงิน คู่มือการใช้ Grok 4.7 ฟรี ของเราครอบคลุมเส้นทางที่ไม่มีค่าใช้จ่ายที่มีอยู่จริง

Grok 4.7 เปรียบเทียบกับ GPT-6 Sol และ Claude Opus 5.5 อย่างไร? มีราคาเอาต์พุตต่ำที่สุดในสามตัวนี้ และตามหลัง Opus 5.5 ในเกณฑ์มาตรฐานการเขียนโค้ดที่ผู้ขายทั้งสองรายรายงาน การเปรียบเทียบสามทาง มีตัวเลขให้ดู

เริ่มต้นด้วยคำขอที่บันทึกไว้หนึ่งรายการ

ส่งคำขอ curl ด้านบน จากนั้นบันทึกใน Apidog พร้อมกับการยืนยันและสถานการณ์ระดับความพยายาม คุณจะได้รับต้นทุนพื้นฐานต่องานสำหรับพรอมต์ของคุณเองก่อนที่จะย้ายทราฟฟิก ในการเลือกระดับความพยายามเริ่มต้น โปรดอ่าน รายละเอียดเกณฑ์มาตรฐาน Grok 4.7 ถัดไป

ฝึกการออกแบบ API แบบ Design-first ใน Apidog

ค้นพบวิธีที่ง่ายขึ้นในการสร้างและใช้ API