DeepSeek-V4.1-Flashは、2026年9月10日にAPIでGAとなり、「無料」という言葉が単なる宣伝文句ではなく、真剣な問いとなる2つの事実と共に登場しました。ウェイトはHugging FaceでMITライセンスの下に公開されているため、モデル自体は費用がかかりません。そして、公式APIでは、オフピーク時のキャッシュヒット入力は100万トークンあたり0.003ドルで課金され、ほとんどのサイドプロジェクトでは、無料とほぼ無料の間の区別は問題にならなくなるほどゼロに近い料金です。
DeepSeek APIには、永続的な無料枠はまだありません。そうでないと言う人は、ルーターのプロモーションやコンシューマーチャットアプリについて説明しているだけです。このガイドでは、V4.1-Flashを無料で利用するすべての正直な方法を順位付けし、その後、有料パスの計算を示して、ほぼ無料が十分に近いかどうかを判断できるようにします。最初にアーキテクチャの話を知りたい場合は、DeepSeek-V4.1-Flashとは何かを読んでから戻ってください。
まず一点注意です。いくつかの無料ルートは、レート制限があり、時にはモデルが密かに切り替わるサードパーティのエンドポイントを経由します。Apidogを使って応答を記録し、モデルフィールドをアサートすることでテストすることで、自身のデバッグで無料枠を消費するのを防ぐことができます。そのワークフローは、記事の最後にあります。
要点
「一切条件なしの無料」から「カード登録でほぼ無料」までのランキング:
- chat.deepseek.comのDeepSeekチャットアプリ。無料、カード不要。手動での出力品質評価に最適。
- Hugging Faceで公開されているオープンウェイト。MITライセンスの下で無料ですが、5520億のパラメータはハードウェアコストを意味します。
- OpenRouterのようなサードパーティ製ルーター。一部のモデルには一時的に無料枠が存在しますが、レート制限やデータポリシーに関するトレードオフがあります。
- コーディングツール内のバンドルされたトライアルクレジット。そのツールがすでにDeepSeekをバックエンドとして提供している場合にのみ有用。
- 公式API。無料ではありませんが、趣味のプロジェクトであればオフピーク時で月額約1.35ドルで利用できます。
オプション1:DeepSeekチャットアプリ
chat.deepseek.comのコンシューマーアプリは、手間のかからない方法です。メールアドレスまたは電話番号でサインアップし、カードなしでプロンプトの入力を開始できます。
2つの注意点があります。まず、今日のリリース後にアプリがどのモデルを提供するのかは[要確認]です。リリースノートはAPIを対象としており、アプリはこれまでAPIより遅れてリリースされたり、個別に調整されたビルドを実行したりしていました。次に、アプリはチャットインターフェースであり、APIではありません。スクリプト化したり、プロンプトをバッチ処理したり、製品に組み込んだりすることはできません。
したがって、このアプリは一つの質問に答えます。V4.1-Flashは、統合を正当化するのに十分なほどあなたのドメインをうまく処理できるか?モデルはネイティブにマルチモーダルなので、ユーザーが送信する入力(画像を含む)を貼り付けてみてください。もし回答が十分に良いものであれば、以下のいずれかのルートに進んでください。
オプション2:オープンウェイト
DeepSeekは、V4.1-Flashのウェイトと技術レポートをMITライセンスの下で公開しました。DeepSeekに支払ったり許可を求めたりすることなく、ダウンロード、実行、ファインチューニング、製品への搭載が可能です。

問題はそのサイズです。V4.1-Flashは5520億パラメータのMixture-of-Expertsバックボーン(ビジョンエンコーダーを含めると7630億)です。プリフィル中は80億パラメータのみ、デコード中は160億パラメータのみがアクティブになりますが、完全なパラメータセットはどこかに存在する必要があります。8ビットの場合、バックボーンだけでおよそ552GB、4ビットの場合、約280GBです。単一のコンシューマー向けGPUでは到底及びません。KVキャッシュは良いニュースです。FP4キャッシュではトークンあたり890バイトで、完全な100万トークンのコンテキストには約0.9GBが必要です。
ここでの「無料」とは、ライセンスが無料という意味であり、実行が無料という意味ではありません。ハードウェアティアや、280GBをダウンロードする前に確認すべき推論エンジンについては、DeepSeek-V4.1-Flashをローカルで実行する方法をお読みください。すでにハードウェアをお持ちであれば、これはこのページで最も耐久性のある無料オプションです。レート制限も、データポリシーも、密かなモデルの入れ替えもありません。
オプション3:公式APIは無料ではないが、それに近い
DeepSeekプラットフォームは従量課金制です。残高をチャージし、キーを作成し、トークンごとに課金されます。永続的な無料枠はありません。

「無料」のページに掲載される理由は、その価格です。以下は、公式料金ページからの全米ドル表で、2026年9月10日04:00 UTCから有効、100万トークンあたりの料金です。
| トークンタイプ | deepseek-flash オフピーク | deepseek-flash ピーク |
|---|---|---|
| 入力、キャッシュヒット | $0.003 | $0.006 |
| 入力、キャッシュミス | $0.15 | $0.30 |
| 出力 | $0.60 | $1.20 |
ピーク時間は、月曜日から金曜日の01:00~04:00および06:00~10:00 UTC(北京時間では09:00~12:00および14:00~18:00)です。それ以外の時間帯(週末を含む)はオフピークとなり、半額です。コンテキストキャッシングは自動で行われるため、繰り返しのシステムプロンプトは追加のコードなしでキャッシュにヒットします。
では計算です。サイドプロジェクトが1ヶ月に500万トークンの新規(キャッシュミス)入力を送信し、100万トークンの出力を生成するとします。すべてオフピークの場合:
- キャッシュミス入力500万トークン(100万トークンあたり0.15ドル)= 0.75ドル
- 出力100万トークン(100万トークンあたり0.60ドル)= 0.60ドル
- 合計:月額1.35ドル
その入力の一部が繰り返されるシステムプロンプトであれば、さらに料金は下がります。オフピーク時のキャッシュヒット100万トークンは0.003ドルなので、2,000トークンのシステムプロンプトが10,000回のリクエスト(2,000万キャッシュ済みトークン)で再利用されると、6セント追加されます。請求額は小銭程度になり、2,500リクエストの同時実行上限で、要求通りの正確なモデルを利用できます。V4.1-Flashの料金解説では、プロンプトの構造によって計算がどのように変化するかを説明しています。
利用状況ブロックが出力されているのでキャッシュの分割が確認できる、最小限の呼び出し:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DEEPSEEK_API_KEY"],
base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
model="deepseek-flash",
messages=[
{"role": "system", "content": "You classify support tickets as billing, bug, or feature request."},
{"role": "user", "content": "Customer says their August invoice shows two charges for one seat."},
],
)
print(response.choices[0].message.content)
print(response.usage)
オプション4および5:ルーター、無料枠、バンドルクレジット
OpenRouterは、新しいオープンウェイトモデルの無料エンドポイントを探す際の一般的な場所です。ルーターは複数のホストをOpenAI互換のAPIの背後に集約し、ホストはトラフィックを引き込むためにモデルの無料枠を提供することがあります。今日V4.1-Flashがそこにリストされているか、そして無料枠を提供しているホストがあるかは[要確認]です。このモデルはリリースされて数時間しか経っておらず、リストは速く動きます。

すべてのルーターの無料枠には、以下の3つの警告が当てはまります。
- レート制限が厳しい。1分あたりおよび1日あたりの上限があるため、テストループは1時間で1日分のクォータを使い果たす可能性があります。
- データポリシーはホストごとに異なります。無料トラフィックは、ホストがログを記録したり、トレーニングに使用したりすることが許可されている場合があります。機密情報を送信する前にポリシーをお読みください。
- 無料枠は毎週変更されます。月曜日に無料だったものが金曜日には有料になったり、別のホストにルーティングされたりすることがあります。無料枠に本番環境の依存関係を構築しないでください。
注意すべき失敗は、サイレントなモデルの置き換えです。V4.1-Flashをリクエストしたのに、無料ホストがダウンしたため古いモデルが応答する場合があります。応答のmodelフィールドが最初の防御線であり、以下のワークフローではこれをアサートします。
CursorやCodexスタイルのエージェントを含む一部のコーディングツールは、ツールがサポートするバックエンドに利用できるトライアルクレジットをバンドルしています。もしあなたがすでに使用しているツールがDeepSeekを選択可能なモデルとしてリストしている場合、それらのクレジットはトライアル期間中、正当な無料ルートとなります。DeepSeekにアクセスするためだけにツールに登録しないでください。クレジットの量や対象モデルは頻繁に変わるため、ドキュメント化するには変更が多すぎます。
あなたの状況に合うオプションは?
| オプション | 費用 | モデル保証? | レート制限 | 最適な用途 |
|---|---|---|---|---|
| DeepSeekチャットアプリ | 無料 | アプリのビルドによる | アプリの使用上限 | 手動評価、クイックチェック |
| オープンウェイト(MIT) | ライセンス無料、自身のハードウェア | はい、自分で実行 | なし | プライバシー、ファインチューニング、所有GPU |
| 公式API | 趣味の規模で月額約1.35ドル | はい | 2,500同時リクエスト | 本番導入するもの全般 |
| ルーター無料枠 | 無料期間中のみ | いいえ、ホストが入れ替わる | 1分あたり・1日あたりの上限 | プロトタイプ、比較 |
| バンドルツールクレジット | トライアル期間中無料 | ツールによる | ツールで定義 | そのツール内でのコーディング |
製品をリリースする予定があるなら、公式APIに1ドルを費やしましょう。評価中なら、チャットアプリから始めましょう。GPUを所有しているなら、オープンウェイトが他のどの選択肢よりも優れています。
Apidogで無料エンドポイントをクォータを消費せずにテストする
無料ルートには2つの失敗パターンがあります。自分のコードをデバッグ中にレート制限に達してしまうこと、そしてルーターが告知なく別のモデルを返すことです。どちらも、選択したエンドポイントの前にあるAPIレイヤーをテストするApidogを使えば安価に防ぐことができます。
- エンドポイントを一度追加します。Authorizationヘッダーに
Bearer {{API_KEY}}を設定し、POST {{BASE_URL}}/chat/completionsを作成します。チャットアプリを除くすべてのオプションは同じOpenAI互換の形式であるため、保存された1つのリクエストですべてをカバーできます。 - プロバイダーごとに1つの環境を作成します。
official環境ではBASE_URLをあなたのDeepSeekキーでhttps://api.deepseek.comに設定し、router環境は無料ホストを指します。切り替えはドロップダウンで行います。 - 実際の応答を記録し、それをモックします。無料エンドポイントを通じて代表的なプロンプトをいくつか送信し、応答を保存して、Apidogのモックサーバーからそれらを提供します。パース、リトライ、UIを構築している間、あなたのアプリはモックにヒットし、無料クォータは消費されません。
- モデルフィールドをアサートします。応答の
modelに、ホストがV4.1-Flashに対して返す文字列が含まれていることをアサートするテストケースとしてリクエストを保存します。各セッションの開始時にこれを実行すれば、モデルが入れ替わっても、プロンプトの「リグレッション」を1時間追いかける前にテストが失敗します。 - 使用状況ブロックをアサートします。
usage.prompt_tokensとusage.completion_tokensがゼロより大きいことを確認し、公式APIでのキャッシュヒット数を同じブロックから読み取ります。1週間後には、無料枠がどれだけ節約になったか、そしてあなたのプロンプトが想定通りにキャッシュされているかが分かります。
Apidogをダウンロードすれば、このループは10分以内に完了します。アサーションが作成されれば、apidog-cliがCIでそれらを実行し、ルーターの切り替えがデモではなくビルドを壊すようにします。
よくある質問
- DeepSeek-V4.1-Flashは無料で使えますか? モデルはMITライセンスの下でライセンスが無料で、DeepSeekチャットアプリ内での使用も無料です。公式APIは従量課金制で、永続的な無料枠はありません。DeepSeekは無料ですかでは、この区別がモデルライン全体でどのように維持されてきたかをたどっています。
- DeepSeek APIに無料トライアルはありますか? 常設のものはありません。最も低コストな方法は、公式APIのオフピーク利用です。500万トークンのキャッシュミス入力と100万トークンの出力で1.35ドルです。
- APIを通じてV4.1-Flashを呼び出す最も安価な方法は? ピーク時間外に送信し、共通のプレフィックスがキャッシュにヒットするようにプロンプトを構造化します。キャッシュヒットはミスよりも50倍安価だからです。プロンプトキャッシングとはでは、そのためのプロンプトの順序付け方法を説明しています。
- V4.1-Flashをノートパソコンで実行できますか? 完全なモデルはできません。5520億パラメータは、バックボーンだけで4ビットで約280GBです。上記のローカルガイドでは、各ハードウェアティアで何が現実的かを説明しています。
- 無料のルーター版は公式APIと同じモデルですか? ホストがそう言っており、あなたのテストでそれが確認された場合にのみ同じです。
modelフィールドをアサートし、固定されたプロンプトセットに対する出力を公式エンドポイントと比較してください。DeepSeek V4を無料で使う方法とV4 APIを無料で使う方法のガイドでは、前世代でも同じチェックを行っています。
まとめ
V4.1-Flashは、最も重要な2つの点で無料です。ウェイトはMITライセンスであり、チャットアプリは費用がかかりません。これら2つの極の間にあるものはすべて、移動する無料枠か、または「無料」のために最適化する価値がなくなるほど低価格な公式APIです。月額1.35ドルであれば、通常、最も安価な方法は支払うことです。
どのエンドポイントを選択するにしても、その前にApidogを配置しましょう。構築中は応答をモックし、モデルフィールドをアサートし、使用状況をログに記録します。無料枠はリソースです。自分のバグではなく、モデルのために使いましょう。
