DeepSeek-V4.1-Flash เปิดให้บริการทั่วไปบน API เมื่อวันที่ 10 กันยายน 2026 และบันทึกการเปิดตัวมาพร้อมกับการปรับลดราคา อินพุตที่เข้าแคช (cache-hit input) ตอนนี้มีค่าใช้จ่าย 0.003 ดอลลาร์ต่อล้านโทเค็นในช่วงนอกเวลาพีค อินพุตที่ไม่เข้าแคช (cache-miss input) 0.15 ดอลลาร์ และเอาต์พุต 0.60 ดอลลาร์ สี่วันต่อมา ในวันที่ 14 กันยายน DeepSeek เริ่มส่งคำขอ deepseek-v4-pro ทุกรายการไปยัง V4.1-Flash และเรียกเก็บเงินในอัตรา Flash หากคุณใช้งานใดๆ บน DeepSeek API บิลของคุณจะมีการเปลี่ยนแปลงในสัปดาห์นี้ไม่ว่าคุณจะแก้ไขโค้ดหรือไม่ก็ตาม
โพสต์นี้เป็นครึ่งหนึ่งของเรื่องราวที่เกี่ยวกับราคา: ตารางราคาเต็มในสกุลเงิน USD และ CNY การเปลี่ยนแปลงเป็นเปอร์เซ็นต์เมื่อเทียบกับ V4-Flash และ V4-Pro ช่วงเวลาพีคในเขตเวลาของคุณ และตัวอย่างการเข้าแคชสองกรณีพร้อมการคำนวณที่แสดง สำหรับตัวโมเดลเอง เริ่มต้นด้วย DeepSeek-V4.1-Flash คืออะไร
ข้อควรระวังประการหนึ่งที่ต้องแจ้งให้ทราบล่วงหน้า ทุกตัวเลขเกณฑ์มาตรฐานในกลุ่มนี้เป็นตัวเลขที่ DeepSeek รายงานจาก Model Card ราคามาจาก หน้า Pricing Page ซึ่งได้รับการยืนยันเมื่อวันที่ 10 กันยายน ส่วนสุดท้ายจะแสดงวิธีการวัดค่าใช้จ่ายของคุณเองด้วย Apidog โดยการอ่านบล็อก usage ในทุกการตอบกลับแทนที่จะเชื่อการประมาณการ
ปุ่ม
TL;DR
- ในช่วงนอกเวลาพีค (off-peak)
deepseek-flashมีค่าใช้จ่าย 0.003 ดอลลาร์ ต่อโทเค็นอินพุตที่เข้าแคช 1 ล้านโทเค็น, 0.15 ดอลลาร์ ต่อโทเค็นอินพุตที่ไม่เข้าแคช 1 ล้านโทเค็น และ 0.60 ดอลลาร์ ต่อโทเค็นเอาต์พุต 1 ล้านโทเค็น ในช่วงเวลาพีค (peak) ราคาจะเพิ่มเป็นสองเท่า - เมื่อเทียบกับ V4-Flash เมื่อวันที่ 21 สิงหาคม: อินพุตที่เข้าแคชลดลง 57%, อินพุตที่ไม่เข้าแคชลดลง 32%, เอาต์พุตลดลง 9%
- เมื่อเทียบกับ V4-Pro ในช่วงเวลาพีค: งานที่ถูกเปลี่ยนเส้นทางจะจ่ายน้อยลง 77% สำหรับอินพุตที่ไม่เข้าแคช และน้อยลง 70% สำหรับเอาต์พุต ตั้งแต่วันที่ 14 กันยายน
- ช่วงเวลาพีคคือวันจันทร์ถึงวันศุกร์ ตั้งแต่เวลา 01:00 ถึง 04:00 น. และ 06:00 ถึง 10:00 น. UTC วันหยุดสุดสัปดาห์ทั้งหมดถือเป็นช่วงนอกเวลาพีค
ตารางราคาเต็ม
ตัวเลขทั้งหมดคำนวณต่อ 1 ล้านโทเค็น มีผลบังคับใช้ตั้งแต่วันที่ 10 กันยายน 2026 เวลา 04:00 น. UTC
| deepseek-flash นอกเวลาพีค | deepseek-flash เวลาพีค | deepseek-v4-pro นอกเวลาพีค | deepseek-v4-pro เวลาพีค | |
|---|---|---|---|---|
| อินพุต, เข้าแคช | $0.003 | $0.006 | $0.022 | $0.044 |
| อินพุต, ไม่เข้าแคช | $0.15 | $0.30 | $0.66 | $1.32 |
| เอาต์พุต | $0.60 | $1.20 | $1.98 | $3.96 |
| การทำงานพร้อมกัน | 2,500 | 2,500 | 500 | 500 |
คอลัมน์ deepseek-v4-pro จะยังคงมีความสำคัญอีกสี่วัน ตั้งแต่วันที่ 14 กันยายน เวลา 04:00 น. UTC (12:00 น. ตามเวลาปักกิ่ง) คำขอที่ใช้ชื่อโมเดลนั้นจะถูกให้บริการโดย V4.1-Flash และเรียกเก็บเงินจากสองคอลัมน์แรก คู่มือการเลิกใช้งานและการย้ายข้อมูล V4-Pro จะครอบคลุมถึงสิ่งที่ต้องทดสอบก่อนถึงเวลานั้น
หากบัญชีของคุณชำระด้วยเงินหยวน หน้า Pricing Page ภาษาจีน (zh-cn) ระบุ deepseek-flash ดังนี้:
| นอกเวลาพีค (CNY) | เวลาพีค (CNY) | |
|---|---|---|
| อินพุต, เข้าแคช | ¥0.02 | ¥0.04 |
| อินพุต, ไม่เข้าแคช | ¥1.00 | ¥2.00 |
| เอาต์พุต | ¥4.00 | ¥8.00 |
แต่ละแถวของ CNY เป็นราคา USD คูณด้วยประมาณ 6.67 รายละเอียดสองอย่างที่ตารางไม่ได้ระบุไว้คือ: การแคชบริบท (context caching) เป็นแบบอัตโนมัติ โดยไม่ต้องตั้งค่าใดๆ และ ID โมเดลปัจจุบันคือ deepseek-flash ชื่อเก่าอย่าง deepseek-v4-flash และ deepseek-v4-flash-vision-exp ยังคงใช้งานได้ แต่จะถูกส่งไปยัง V4.1-Flash ด้วยอัตราเหล่านี้
สิ่งที่เปลี่ยนแปลงเมื่อเทียบกับ V4-Flash และ V4-Pro
เมื่อวันที่ 21 สิงหาคม 2026 deepseek-v4-flash มีค่าใช้จ่าย 0.007 ดอลลาร์ / 0.22 ดอลลาร์ / 0.66 ดอลลาร์ ในช่วงนอกเวลาพีค (อินพุตเข้าแคช / อินพุตไม่เข้าแคช / เอาต์พุต) และ 0.014 ดอลลาร์ / 0.44 ดอลลาร์ / 1.32 ดอลลาร์ ในช่วงเวลาพีค บันทึกการเปลี่ยนแปลง ระบุว่าราคา "ลดลงตามความเหมาะสม" กับการเปิดตัวครั้งนี้ นี่คือความหมายของ "ตามความเหมาะสม" ที่คำนวณจากสองรายการ:
| รายการ | V4-Flash (21 ส.ค.) | V4.1-Flash (10 ก.ย.) | ลดลง |
|---|---|---|---|
| เข้าแคช, นอกเวลาพีค | $0.007 | $0.003 | 57% |
| ไม่เข้าแคช, นอกเวลาพีค | $0.22 | $0.15 | 32% |
| เอาต์พุต, นอกเวลาพีค | $0.66 | $0.60 | 9% |
แถวของช่วงเวลาพีคมีเปอร์เซ็นต์เท่ากัน เนื่องจากทั้งสองรายการจะเพิ่มเป็นสองเท่าในช่วงเวลาพีค รูปแบบนี้เป็นการจงใจ: การลดราคาที่มากที่สุดคืออินพุตที่เข้าแคช ส่วนที่น้อยที่สุดคือเอาต์พุต DeepSeek กำหนดราคาสำหรับ Agent Loops ที่อ่าน Prefix ซ้ำๆ ในทุกรอบ และ FP4 KV cache ใน V4.1 (890 ไบต์ต่อโทเค็น ซึ่งประมาณหนึ่งในสี่ของพื้นที่จัดเก็บของ V4-Flash) คือสิ่งที่ทำให้ราคา 0.003 ดอลลาร์สำหรับการเข้าแคชมีความยั่งยืนสำหรับพวกเขา
สำหรับผู้ใช้ V4-Pro ตัวเลขจะสูงกว่า เนื่องจากมีการเปลี่ยนเส้นทางด้วยอัตรา Flash:
- อินพุตที่ไม่เข้าแคชในช่วงพีค: 1.32 ดอลลาร์ เหลือ 0.30 ดอลลาร์ ลดลง 77%
- เอาต์พุตในช่วงพีค: 3.96 ดอลลาร์ เหลือ 1.20 ดอลลาร์ ลดลง 70%
- อินพุตที่เข้าแคชในช่วงพีค: 0.044 ดอลลาร์ เหลือ 0.006 ดอลลาร์ ลดลง 86%
DeepSeek ระบุว่า V4.1-Flash "ได้แซงหน้า V4 Pro อย่างครอบคลุมในด้านประสิทธิภาพ ค่าใช้จ่าย ความเร็ว และเวลาทั้งหมด" ซึ่งเป็นข้อกล่าวอ้างที่ควรตรวจสอบกับ Prompt ของคุณเองก่อนวันที่ 14 สำหรับช่วงเวลาที่ยาวนานขึ้นของการกำหนดราคาของตระกูลนี้ รวมถึงช่วงเวลาที่ DeepSeek ขึ้นราคา API, การวิเคราะห์ราคา DeepSeek V4 API มีประวัติไว้ให้
ช่วงเวลาพีคในเขตเวลาของคุณ
ช่วงเวลาพีคใช้เฉพาะวันจันทร์ถึงวันศุกร์ โดยแบ่งเป็นสองช่วง: 01:00 ถึง 04:00 น. UTC และ 06:00 ถึง 10:00 น. UTC ซึ่งก็คือ 09:00 ถึง 12:00 น. และ 14:00 ถึง 18:00 น. ตามเวลาปักกิ่ง เจ็ดชั่วโมงพีคต่อวันทำงาน 35 ชั่วโมงต่อสัปดาห์ ดังนั้นช่วงเวลาพีคจึงครอบคลุมประมาณ 21% ของสัปดาห์ 168 ชั่วโมง ส่วนอื่นๆ ทั้งหมด รวมถึงวันเสาร์และวันอาทิตย์ จะถูกเรียกเก็บเงินในอัตรานอกเวลาพีค
| ช่วงเวลา | UTC | ปักกิ่ง (UTC+8) | สหรัฐฯ แปซิฟิก (PDT, UTC-7) | ยุโรปกลาง (CEST, UTC+2) |
|---|---|---|---|---|
| พีค 1 | 01:00 ถึง 04:00 | 09:00 ถึง 12:00 | 18:00 ถึง 21:00 (คืนก่อนหน้า) | 03:00 ถึง 06:00 |
| พีค 2 | 06:00 ถึง 10:00 | 14:00 ถึง 18:00 | 23:00 ถึง 03:00 (ข้ามคืน) | 08:00 ถึง 12:00 |
คอลัมน์ Pacific และ Central Europe ใช้เวลาออมแสง หลังจากมีการเปลี่ยนเวลา (25 ตุลาคมใน EU, 1 พฤศจิกายนใน US) ให้เลื่อนทั้งสองคอลัมน์เร็วขึ้นหนึ่งชั่วโมง ขอบเขต UTC จะไม่มีการเปลี่ยนแปลง
วันทำงานของฝั่งตะวันตกของสหรัฐฯ จะไม่ตรงกับช่วงเวลาพีคเลย ช่วงเช้าของยุโรปกลางจะอยู่ในช่วงพีค 2 และงาน Batch ที่ดำเนินการในเวลากลางคืนของยุโรปที่ 03:00 น. ตามเวลาท้องถิ่นจะเสียค่าใช้จ่ายเป็นสองเท่า การย้ายไปเป็น 23:00 น. CEST (21:00 น. UTC) จะทำให้ราคากลับมาเป็นครึ่งหนึ่ง
การคำนวณการเข้าแคช, ทำซ้ำสองครั้ง
การเข้าแคชหนึ่งครั้งมีค่าใช้จ่าย 1/50 ของการไม่เข้าแคช (0.003 ดอลลาร์ เทียบกับ 0.15 ดอลลาร์) ดังนั้นอัตราส่วนของ Prefix ที่ซ้ำกันต่อโทเค็นใหม่จึงเป็นตัวกำหนดค่าใช้จ่ายอินพุตของคุณมากกว่าจำนวนโทเค็นดิบ หากคุณไม่คุ้นเคยกับการแคช Prefix คู่มือการแคช Prompt จะอธิบายว่าอะไรคือ Prefix ที่สามารถแคชได้: ไบต์ที่เหมือนกันที่จุดเริ่มต้นของคำขอ
ตัวอย่างที่ 1: Agent loop ที่มี System Prompt 20K โทเค็น, 1,000 การเรียกใช้ในช่วงเวลาพีค
Agent คัดแยกคำร้องสนับสนุนพกพา System Prompt 20,000 โทเค็น (นโยบาย, โครงสร้างเครื่องมือ, ตัวอย่างแบบ Few-shot) อ่านข้อความตั๋วใหม่ 2,000 โทเค็นต่อการเรียกใช้ และเขียนเอาต์พุต 1,000 โทเค็น ในการเรียกใช้ 1,000 ครั้ง:
- อินพุตรวมคือ 1,000 × 22,000 = 22M โทเค็น เอาต์พุตรวมคือ 1M โทเค็น
- การเรียกใช้ครั้งแรกไม่เข้าแคชสำหรับโทเค็นทั้งหมด 22,000 โทเค็น การเรียกใช้ครั้งถัดไปทั้งหมดจะเข้าแคชสำหรับ Prefix 20,000 โทเค็น และไม่เข้าแคชสำหรับโทเค็นใหม่ 2,000 โทเค็น
- โทเค็นที่เข้าแคช: 999 × 20,000 = 19.98M ที่ 0.006 ดอลลาร์ต่อ 1M: 19.98 × 0.006 = 0.12 ดอลลาร์
- โทเค็นที่ไม่เข้าแคช: 22,000 + 999 × 2,000 = 2.02M ที่ 0.30 ดอลลาร์ต่อ 1M: 2.02 × 0.30 = 0.61 ดอลลาร์
- เอาต์พุต: 1M × 1.20 ดอลลาร์ = 1.20 ดอลลาร์
- รวม: 0.12 ดอลลาร์ + 0.61 ดอลลาร์ + 1.20 ดอลลาร์ = 1.93 ดอลลาร์
หากไม่มีการแคช อินพุตเพียงอย่างเดียวจะมีค่าใช้จ่าย 22 × 0.30 ดอลลาร์ = 6.60 ดอลลาร์ และงานจะมีค่าใช้จ่ายทั้งหมด 7.80 ดอลลาร์ การแคชช่วยลดค่าใช้จ่ายได้ 75% หากรันลูปเดียวกันในช่วงนอกเวลาพีค แต่ละบรรทัดจะลดลงครึ่งหนึ่ง: 0.06 ดอลลาร์ + 0.30 ดอลลาร์ + 0.60 ดอลลาร์ = 0.96 ดอลลาร์
การเรียกใช้ 1,000 ครั้งแบบเดียวกันบน V4-Pro ในช่วงเวลาพีค (เข้าแคช 0.88 ดอลลาร์, ไม่เข้าแคช 2.67 ดอลลาร์, เอาต์พุต 3.96 ดอลลาร์) รวมเป็น 7.51 ดอลลาร์ ซึ่งเป็นตัวเลขที่ลูกค้า Pro ควรนำมาเปรียบเทียบกับ 1.93 ดอลลาร์ เมื่อมีการเปลี่ยนเส้นทาง
ตัวอย่างที่ 2: งาน Batch ที่มีเอาต์พุต 10M โทเค็น ย้ายไปในช่วงนอกเวลาพีค
ทีมงานแคตตาล็อกสร้างคำอธิบายผลิตภัณฑ์ 10,000 รายการ การเรียกใช้แต่ละครั้งส่งข้อมูลผลิตภัณฑ์ 1,500 โทเค็น (ไม่ซ้ำกันต่อรายการ จึงไม่มีประโยชน์จากการแคช) และได้รับข้อความกลับมา 1,000 โทเค็น นั่นคืออินพุต 15M โทเค็น ทั้งหมดเป็นแบบไม่เข้าแคช และเอาต์พุต 10M โทเค็น
- ในช่วงเวลาพีค: อินพุต 15 × 0.30 ดอลลาร์ = 4.50 ดอลลาร์ เอาต์พุต 10 × 1.20 ดอลลาร์ = 12.00 ดอลลาร์ รวม 16.50 ดอลลาร์
- นอกเวลาพีค: อินพุต 15 × 0.15 ดอลลาร์ = 2.25 ดอลลาร์ เอาต์พุต 10 × 0.60 ดอลลาร์ = 6.00 ดอลลาร์ รวม 8.25 ดอลลาร์
- ประหยัดได้จากช่วงเวลาเพียงอย่างเดียว: 8.25 ดอลลาร์ โดยไม่มีการเปลี่ยนแปลง Prompt แต่อย่างใด
เอาต์พุตมีบทบาทสำคัญในงานนี้และได้รับการลดราคาที่น้อยที่สุดในการเปิดตัว ดังนั้นช่วงนอกเวลาพีคจึงเป็นปัจจัยสำคัญกว่า มันเป็นช่วงเวลาที่กว้างขวาง: 15 ชั่วโมงในวันทำงานทุกวันตั้งแต่เวลา 10:00 น. UTC บวกกับ 48 ชั่วโมงต่อเนื่องในแต่ละสุดสัปดาห์
บริบท, เอาต์พุต และเหตุใดการทำงานพร้อมกันจึงเป็นส่วนหนึ่งของราคา
โมเดลทั้งสองชื่อรองรับบริบท 1M โทเค็น และเอาต์พุตสูงสุด 384K โทเค็น Model Card แนะนำโทเค็นสูงสุด 256K หรือมากกว่า ดังนั้นให้กำหนดขีดจำกัดนั้นโดยเจตนา: การตอบกลับที่มีเอาต์พุตถึง 384K โทเค็น มีค่าใช้จ่าย 0.46 ดอลลาร์ในช่วงเวลาพีค ซึ่งดีสำหรับการถอดเสียง Agent แต่เป็นข้อผิดพลาดสำหรับ AutoComplete
การทำงานพร้อมกัน (Concurrency) คือ 2,500 สำหรับ Flash เทียบกับ 500 สำหรับ Pro เหตุผลที่อยู่ในบทความราคาเนื่องจากส่วนลดนอกเวลาพีคจะมีประโยชน์ก็ต่อเมื่อคุณสามารถทำงานให้เสร็จในช่วงเวลาดังกล่าว และเนื่องจากการส่งข้อมูล deepseek-v4-pro ที่ถูกเปลี่ยนเส้นทางในวันที่ 14 กันยายน จะได้รับขีดจำกัดของ Flash: การรวมระบบ Pro ที่เคยต้องรอคิวหลัง 500 ช่อง จะได้รับพื้นที่การทำงานเพิ่มขึ้นห้าเท่าโดยไม่ต้องเปลี่ยนการกำหนดค่า
วัดค่าใช้จ่ายจริงด้วย Apidog
ตารางราคาจะบอกอัตราให้คุณทราบ ส่วนออบเจกต์ usage ในแต่ละการตอบกลับจะบอกคุณว่าคุณถูกเรียกเก็บเงินสำหรับอะไร นี่คือเวิร์กโฟลว์ของ Apidog ที่ทำให้การตรวจสอบนี้ทำซ้ำได้

- เพิ่ม End Point. สร้าง
POST https://api.deepseek.com/chat/completionsหรือนำเข้าข้อมูลจำเพาะ OpenAPI ที่เข้ากันได้กับ OpenAI - ใส่ราคาใน Environments. สร้าง Apidog Environment สองรายการคือ
deepseek-peakและdeepseek-offpeakโดยแต่ละรายการจะเก็บDEEPSEEK_API_KEYพร้อมกับPRICE_HIT,PRICE_MISSและPRICE_OUTในรูปแบบ{{variables}}ช่วงเวลาพีคจะเก็บค่า 0.006 / 0.30 / 1.20; ส่วนช่วงนอกเวลาพีคจะเก็บค่า 0.003 / 0.15 / 0.60 - ส่งหนึ่งครั้งแล้วอ่าน
usage. DeepSeek จะแยกอินพุตออกเป็นprompt_cache_hit_tokensและprompt_cache_miss_tokensควบคู่ไปกับcompletion_tokens[ตรวจสอบ] บันทึกคำขอนั้นเป็น Test Case - สร้าง Test Scenario ที่ยืนยันพฤติกรรมการแคช. เชื่อมโยงคำขอที่บันทึกไว้สองครั้งด้วย System Prompt 20K โทเค็นเดียวกัน ในขั้นตอนที่สอง ให้ยืนยันว่าช่องโทเค็นที่เข้าแคชมีอย่างน้อย 19,000 และต้นทุนที่คำนวณได้ (จำนวนที่เข้าแคช ×
{{PRICE_HIT}}+ จำนวนที่ไม่เข้าแคช ×{{PRICE_MISS}}+ เอาต์พุต ×{{PRICE_OUT}}หารด้วย 1M) ยังคงอยู่ภายใต้งบประมาณ การไม่เข้าแคชในขั้นตอนที่สองหมายถึง Prefix เปลี่ยนไป และการยืนยันจะตรวจจับได้ก่อนที่จะมีการออกใบแจ้งหนี้ - เปรียบเทียบช่วงเวลาพีคกับนอกเวลาพีค. รัน Scenario ภายใต้แต่ละ Environment และเปรียบเทียบบรรทัดค่าใช้จ่าย หรือรันจาก CI ด้วย
apidog-cliตามตารางเวลาที่คาบเกี่ยวขอบเขตเวลาพีคของ UTC
ดาวน์โหลด Apidog แล้ว Scenario ทั้งหมดรวมถึง Environments จะทำงานได้บนแผนฟรี
ผลกระทบต่อบิลของคุณ
V4.1-Flash มีราคาถูกกว่า V4-Flash ในทุกรายการ และถูกกว่าอัตราของ V4-Pro ที่เข้ามาแทนที่ถึง 70 ถึง 86% มีสองปัจจัยสำคัญ: ทำให้ Prefix ยาวของคุณมีไบต์ที่เหมือนกันเพื่อให้เข้าแคชได้ และกำหนดเวลางาน Batch ให้อยู่นอกช่วงเวลาพีคเจ็ดชั่วโมงของวันทำงาน จากนั้นบันทึก usage ในทุกการเรียกใช้ ยืนยันจำนวนที่เข้าแคช และให้ตัวเลขแสดงว่าการลดราคาได้ส่งผลต่อใบแจ้งหนี้ของคุณหรือไม่
