DeepSeek-V4-Flash API公開:公式APIの使い方(パブリックベータガイド)

DeepSeek-V4-Flash-0731のパブリックベータ版が公開されました。このハンズオンガイドで、APIキーを取得し、最初の呼び出しを行い、思考モードを制御し、キャッシュヒット料金を確認しましょう。

Ashley Innocent

Ashley Innocent

31 7月 2026

DeepSeek-V4-Flash API公開:公式APIの使い方(パブリックベータガイド)

Apidog エンタープライズ

オンプレミスデプロイ

SSO & RBAC

SOC 2 準拠

Apidog Enterpriseを見る

今朝、DeepSeekは公式のDeepSeek-V4-Flash APIをリリースしました。発表は2026年7月31日に行われ、リリースノートでは3つの点が明確にされています。モデルのエージェント機能が大幅にアップグレードされたこと、OpenAIのResponses APIフォーマットにネイティブ対応したこと、そして初日からCodexに対応していることです。

もし4月からdeepseek-v4-flashを呼び出していたなら、それはプレビュー版でした。今回のリリースでモデルは公式バージョンであるDeepSeek-V4-Flash-0731に昇格し、コードを一行も変更することなくアップグレードが適用されます。モデル名は変わりません。

このガイドでは、キーの取得、最初の呼び出し、思考モードの切り替え、パブリックベータの料金体系など、すべてを説明します。DeepSeekラインナップが初めての方は、まずDeepSeek V4とは?でファミリーの概要を把握してから、ここに戻ってきてください。

💡
キーを取得したら、コードに組み込む前にエンドポイントを素早く試す方法が必要になるでしょう。Apidogを使えば、DeepSeek APIにリクエストを送信し、ストリーミング応答をイベントごとに検査し、すべての動作する呼び出しを再利用可能なテストとして保存できます。その設定については以下で詳しく説明します。
button

7月31日に実際にリリースされたもの

公式変更ログによると、今回のリリースはAPIのみを対象としています。DeepSeekアプリとウェブモデルは変更されておらず、V4-Pro APIも変更されていません。概要は以下の通りです。

正直なところ、ヘッドラインのベンチマーク主張(「V4-Pro-Previewをはるかに凌駕する」)はDeepSeek自身の評価によるものであり、リストされているベンチマークのうち2つ(DSBench-FullStackとDSBench-Hard)は社内テストセットです。独立した数値が発表されるまでには数日かかるでしょう。

ステップ1:APIキーを取得する

DeepSeek Platformにアクセスし、サインインしてAPIキーページからキーを作成してください。キーはsk-で始まります。ハードコーディングするのではなく、環境変数として保存してください。

export DEEPSEEK_API_KEY="sk-your-key-here"

DeepSeek APIはOpenAIとAnthropicの両方のAPIフォーマットと互換性があるため、DeepSeek固有のSDKは必要ありません。重要なベースURLは次の2つです。

フォーマット ベースURL
OpenAI互換 https://api.deepseek.com
Anthropic互換 https://api.deepseek.com/anthropic

ステップ2:最初の呼び出しを行う

最も簡単な健全性チェックはcurlです。

curl https://api.deepseek.com/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ${DEEPSEEK_API_KEY}" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {"role": "system", "content": "You are a helpful assistant."},
      {"role": "user", "content": "Summarize what changed in DeepSeek-V4-Flash-0731."}
    ],
    "stream": false
  }'

OpenAI Python SDKを介した同じ呼び出し:

# pip3 install openai
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ.get("DEEPSEEK_API_KEY"),
    base_url="https://api.deepseek.com"
)

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[
        {"role": "system", "content": "You are a helpful assistant."},
        {"role": "user", "content": "Write a Python function that validates an email address."}
    ],
    stream=False
)

print(response.choices[0].message.content)

そしてNode.js:

// npm install openai
import OpenAI from "openai";

const openai = new OpenAI({
  baseURL: "https://api.deepseek.com",
  apiKey: process.env.DEEPSEEK_API_KEY,
});

const completion = await openai.chat.completions.create({
  model: "deepseek-v4-flash",
  messages: [{ role: "user", content: "Hello!" }],
});

console.log(completion.choices[0].message.content);

モデル名deepseek-v4-flashが0731リリースを指すようになったため、プレビュー版に対して構築した既存の統合は、新しいモデルを自動的に選択します。移行は不要です。

ステップ3:思考モードと推論努力を制御する

V4-Flashは非思考モードと思考モードの両方をサポートしており、思考がデフォルトです。thinkingパラメーターで制御し、reasoning_effortで深さを調整できます。

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "Plan a database migration from MySQL to Postgres."}],
    reasoning_effort="high",
    extra_body={"thinking": {"type": "enabled"}}
)

パラメーターを調整する前に知っておくべき2つの挙動があります。

オートコンプリートのようなレイテンシに敏感なエンドポイントでは、思考を無効にしてください。エージェントループや困難なデバッグタスクでは、思考をオンにし、努力レベルを上げてください。

ステップ4:応答をストリーミングする

stream: trueを設定すると、APIはサーバー送信イベントを返します。これまでSSEペイロードをデバッグしたことがない場合は、サーバー送信イベントを使用したLLM応答のストリーミングに関するガイドでフォーマットの詳細が説明されています。

stream = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "Explain connection pooling."}],
    stream=True
)

for chunk in stream:
    if chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="")

パブリックベータ期間中の料金

公式のモデルと料金ページによると、V4-Flashは引き続き非常に安価です。

項目 deepseek-v4-flash deepseek-v4-pro
入力、キャッシュヒット (100万トークンあたり) $0.0028 $0.003625
入力、キャッシュミス (100万トークンあたり) $0.14 $0.435
出力 (100万トークンあたり) $0.28 $0.87
コンテキスト長 1Mトークン 1Mトークン
最大出力 384K 384K
同時実行制限 2,500 500

料金に関する3つの注意点:

V4ファミリー全体のより詳細なコスト情報、およびV4-Proの恒久的な値下げの履歴については、DeepSeek V4 API料金の内訳をご覧ください。

ApidogでAPIをテストおよびデバッグする

生のcurlはスモークテストには使えますが、思考モードと非思考モードの出力を比較したり、モデルがツール呼び出しをストリーミングする方法を監視したりする際には、可視性が必要です。Apidogで約5分かかるワークフローを以下に示します。

  1. プロジェクトを作成し、エンドポイントを追加します。POST https://api.deepseek.com/chat/completionsを追加します(または、OpenAI互換の仕様をインポートして、すべてのエンドポイントを一度に取得します)。
  2. キーを環境変数として保存します。DEEPSEEK_API_KEYをApidog環境に置き、AuthorizationヘッダーでBearer {{DEEPSEEK_API_KEY}}として参照します。テストキーとプロダクションキーの切り替えは、ドロップダウンをクリックするだけです。
  3. 送信と検査。ストリーミング呼び出しの場合、Apidogは到着したSSEイベントをレンダリングするため、生のdata:行の壁をじっと見る代わりに、推論内容と応答内容が個別のデルタとして表示されるのを監視できます。
  4. バリアントをテストケースとして保存します。思考が有効なリクエストと無効なリクエストをそれぞれ保存し、モデルが更新されるたびに両方を再実行します。DeepSeekが次のサイレントアップグレードをdeepseek-v4-flashにリリースしたとき、プロンプトがまだ意図通りに動作するかどうかをワンクリックで確認できます。

Apidogを無料でダウンロードしてください。上記のすべてのフローは無料プランで機能します。

よくある質問

新しいモデルを取得するためにコードを変更する必要がありますか? いいえ。モデル名deepseek-v4-flashは現在DeepSeek-V4-Flash-0731を提供しています。既存の統合は自動的にアップグレードされます。

これはDeepSeekアプリと同じモデルですか? いいえ。7月31日のアップデートはAPIのみを対象としています。アプリおよびウェブモデルは変更されていません。

deepseek-chatとdeepseek-reasonerはどうなりましたか? これらのレガシーモデル名は2026年7月24日に廃止される予定でした。deepseek-v4-flashまたはdeepseek-v4-proを使用してください。DeepSeek V4 APIの使用方法に関するガイドで移行について説明しています。

無料で利用できますか? DeepSeekのAPIは永続的な無料枠のない従量課金制ですが、キャッシュヒット料金により、実際には実験がほぼ無料で行えます。DeepSeek V4 APIを無料で利用する方法で現在のオプションをご覧ください。

V4-FlashはCodexとResponses APIで動作しますか? はい、両方とも動作し、これまでのところDeepSeekモデルで唯一これらに対応しています。V4-Proのサポートは2026年8月上旬に予定されています。完全なセットアップは、Responses APIとCodexガイドで説明しています。

結論

DeepSeek-V4-Flash-0731は、同じモデル名、同じ料金、同じアーキテクチャを持ちながら、DeepSeek自身のテストではあるものの、より大規模なV4-Pro-Previewを上回るエージェントベンチマークスコアを達成した、静かながらも重要なリリースです。Responses APIサポートとCodexへの適応は、このモデルが目指す方向性を示しています。それは、欧米のあらゆるラボを凌駕する価格で、高並行性のエージェントワークロードを処理することです。

キーを取得し、OpenAI SDKをhttps://api.deepseek.comに向け、ベンチマークテーブルを信用する前に、モデルを独自のテストスイートで試してみてください。Apidogは、この検証ループを迅速に行うことができます。プロンプトを一度テストケースとして保存し、モデルが更新されるたびに再実行すれば、サイレントアップグレードに驚かされることは二度とありません。

button

ApidogでAPIデザイン中心のアプローチを取る

APIの開発と利用をよりシンプルなことにする方法を発見できる