Qwen-Image-2.1は、最も重要な点で無料です。そのウェイトは公開されています。Alibabaは、2026年9月20日にQwen Research Licenseの下で、7Bの統合生成・編集モデルをリリースしました。このモデルは、ネイティブな透過出力と最大10枚の参照画像からの編集機能を備えています。画像ごとの課金や、購入する必要のあるAPIキーはありません。あなたが支払うのは、キュー(ホストされたデモ)またはGPU(自分で実行する場合)のいずれかです。このガイドでは、すべての無料ルート、それぞれの機能、そしてライセンスが出力に対して許可することについて説明します。
まず機能概要を知りたい場合は、Qwen-Image-2.1とはをお読みください。試用段階を過ぎてコードが必要な場合は、ハウツーガイドにdiffusersの例と、Apidogでテストできるラッパーが掲載されています。
無料ルートの概要
| ルート | コスト | 最適用途 | 制限事項 |
|---|---|---|---|
| Qwen Chat, 「画像生成」 | 無料アカウント | 最速の初回確認、プロンプト書き換え機能内蔵 | 消費者向け制限、シード制御なし、UIの背後にあるモデルが変更される可能性あり [Qwen Chatで2.1が使用されているか確認] |
| Hugging Face Space | 無料 (ZeroGPUキュー) | 参照と透過性を持つ正確な2.1チェックポイントのテスト | キュー時間、ユーザーごとのGPU割り当て、バッチ処理なし |
| ModelScope Studio | 無料 | Spaceと同じ、中国本土からのスループットが向上 | アカウントが必要 |
| ご自身のGPU上のComfyUI | 無料ソフトウェア、ご自身のハードウェア | 繰り返し可能なワークフロー、透過レイヤー、マスクを使用したローカル編集 | GPUメモリ; セットアップ |
| ご自身のGPUまたはクラウドノートブック上のdiffusers | 無料ソフトウェア、ご自身のハードウェアまたは無料ティアのノートブック | プログラムによる使用、シード、自動化 | 上記と同じ; 無料ノートブックはbf16に対応しない場合あり |
ルート1:Qwen Chat
2.1が何をするかを確認する最も手っ取り早い方法は、Qwen自身のランディングページからQwenが案内しているQwen Chatの画像生成モードです。任意の言語で短いリクエストを入力すると、チャットレイヤーがそれを長い構造化されたプロンプト(公開されているPE-T2Iプロンプト書き換えモデルが行うのと同じ作業)に展開し、画像を返します。編集は、画像を添付し変更内容を記述することで機能します。
利点:タイポグラフィ、ポートレートの品質、および編集スタイルが自分に適しているかの判断に優れています。欠点:再現性には適していません。シードがなく、制限は公開されておらず、消費者向けチャット製品は予告なくモデルを入れ替えるため、2.1について結論を出す前に、どのモデルが応答しているかを確認してください。
ルート2:Hugging Face Space
公式のQwen-Image-2.1 Spaceは、共有GPU上で実際のチェックポイントを実行します。テキストから画像への生成、参照画像を使った編集、そして要求に応じた透過出力といった、ローンチ投稿で示された機能が利用可能です。より多くのZeroGPUクォータを得るには、無料のHugging Faceアカウントにログインしてください。匿名ユーザーはクォータが少なく、待ち時間が長くなります。
ご自身のGPU費用をかける前に、ここで実行すべき3つのテストがあります。
- 透過性。 プロンプト:「これは透過性のあるRGBA画像です。漫画のキツネのステッカー。画像にはアルファチャンネルがあり、背景は透過です。」PNGをダウンロードし、市松模様の背景の上に開いてください。毛皮の端を拡大して見てください。そこは背景リムーバーが失敗しがちな場所ですが、ネイティブアルファなら問題ありません。
- 複数の参照。 1つの製品の写真を異なる角度から3枚アップロードし、ライフスタイルショットを要求します。ラベルのテキストと形状が維持されているか確認してください。
- テキストレンダリング。 2つの異なる書体で引用符付きの文字列が書かれた看板やポスター。Qwenの強みはここにあり、確認するのに費用はかかりません。
すべてのGradio Spaceは、その機能をHTTPエンドポイントとして公開しているため、これらのテストをスクリプト化できます。gradio_clientパッケージ、またはSpaceの/gradio_api/call/<fn>ルートへの直接呼び出しにより、プロンプトを送信して結果ファイルをフェッチできます。Spaceの「Use via API」リンクから正確なルート名を記録してください [このSpaceのルート名を確認]。HTTP呼び出しとして一度構築すれば、Apidogでリクエストとして作成し、返されたファイルのタイプとサイズをアサートして、後で何も書き直すことなく、独自のサーバーに対して同じ3つのテストを再実行できます。
ルート3:ModelScope
Qwenは、ModelScopeでウェイトとデモをミラーリングしています。Hugging Faceがお住まいの地域で遅い、または制限されている場合でも、そこのStudioデモは同じモデルを実行しており、このモデルページは中国本土のユーザーにとって最速のダウンロードミラーです。
ルート4:ご自身のGPUでComfyUI
ComfyUIは、起動日にテンプレートワークフロー付きでネイティブサポートを追加しました。セットアップは4つのステップです:ComfyUIを更新し、Hugging Faceからウェイトをダウンロードし、テンプレートをロードし、プロンプトと参照画像で実行します。透過出力と多参照編集はテンプレートに組み込まれており、グラフ全体をJSONファイルとして保存できるため、ComfyUIはコードを記述する以外の最も再現性の高い無料ルートとなります。
QwenはVRAM要件を公開していません。参照スタックは、7Bジェネレーター、8B Qwen3-VLテキストエンコーダー、およびVAEで構成され、bfloat16、2048 x 2048、40ステップで動作します。純粋なbf16パスには、ハイエンドの消費者向けまたはデータセンターGPUを想定してください。より軽量なパスも存在します。diffusersのenable_model_cpu_offload()、vLLM-OmniによるFP8、およびLightX2Vアクセラレーションで、これらはすべてGitHub READMEに記載されています。ComfyUI用のコミュニティFP8チェックポイントは、Qwenのリリースから数日以内に出現するのが常です。ご自身で変換する前に、モデルのHugging Faceの「Spaces and models using this」リストを確認してください。
ルート5:diffusers、ローカルまたは無料のノートブックで
リファレンスコードは短いです。torch>=2.4.0、transformers>=5.17、accelerate、pillow、およびGitHub mainからdiffusersをインストールし、その後:
import torch
from diffusers import QwenImage21Pipeline
pipe = QwenImage21Pipeline.from_pretrained("Qwen/Qwen-Image-2.1", torch_dtype=torch.bfloat16)
pipe.enable_model_cpu_offload() # skip and .to("cuda") if the whole model fits
image = pipe(
prompt="This is an RGBA image with transparency. A paper plane icon. The image has alpha channel and the background is transparent.",
num_inference_steps=40,
generator=torch.Generator("cuda").manual_seed(7),
).images[0]
assert image.mode == "RGBA"
image.save("plane.png")
無料のクラウドノートブックは、一度に数時間GPUを提供します。bf16パイプラインがそのメモリに適合するかどうかは、割り当てられるカードによって異なるため、オフロード行がそこにあります。ハウツーガイドでは、これを参照を使った編集と小規模なHTTPサーバーに拡張しています。
「無料」が許すこと:ライセンス
ダウンロードが無料であることは、販売が無料であることとは異なります。Qwen-Image-2.1はQwen Research License Agreementの下で提供されます。重要な条項は、「Qwenから別途商用ライセンスを取得することなく、いかなる商業目的で本資料を使用してはならない」というものです。再配布されたウェイトやファインチューンはライセンスを保持し、「Built with Qwen」の表示を追加し、「Qwen」を主要な名称として使用することはできません。
したがって、上記のすべてのルートは、学習、研究、ポートフォリオ作業、社内実験、およびライセンス取得の決定には問題ありません。画像を販売したり、モデルを有料製品のバックエンドとして使用したりするには、まず商用契約が必要です。これが、ApacheライセンスのオリジナルQwen-Imageや、画像ごとの価格に商用利用権が含まれるNano Banana 2やgpt-image-2.5のような有料APIとの最大の相違点です。ライセンスに関する話し合いなしに商用出力が必要な場合は、AlibabaがホストするQwen Image 3.0が1画像あたり$0.03で提供されるのが意図された経路です。2.1と3.0の比較では、それぞれがどのような場合に理にかなっているかを示しています。
無料だが高速ではない:予想されること
- ホストされているデモはキューに入ります。リリース週には、米国のピーク時間帯にはSpaceで画像ごとに数分の待ち時間を覚悟してください。ログインユーザーのクォータは毎日リセットされます。
- 40ステップで2Kの画像生成は、消費者向けGPUでは遅いです。まず1024クラスのサイズでテストし、プロンプトが適切になったらスケールアップしてください。
- 多参照編集は2.1が最適化したケースです。参照画像は一度エンコードされ、ステップ間でキャッシュされるため、5つの参照を使っても1つの参照の5倍のコストはかかりません。
- チャットルートではシードが隠されます。同じ画像を2回必要とする場合は、シードを制御できるSpace、ComfyUI、またはdiffusersを使用してください。
無料の実験をテストスイートに変える
いずれかのルートが機能し始めた後、リスクとなるのは、モデルが同じままでプロンプトが変化したり、プロンプトが同じままでモデルが変化したりして、どちらが原因か分からなくなることです。SpaceのGradioエンドポイントを呼び出す場合でも、独自のラッパーを使用する場合でも、Apidogで一度リクエストを定義します。プロンプト、シード、透過フラグ、参照ファイルなどです。透過性テストと3参照編集を、応答のタイプとサイズに関するアサーションを含むテストケースとして保存し、何かを変更するたびに再実行してください。無料利用からライセンス取得済みのデプロイメントや3.0 APIに移行する際も、このスイートはそのまま利用でき、基本URLのみが変更されます。Apidogをダウンロードしてセットアップしてください。
よくある質問 (FAQ)
Qwen-Image-2.1は完全に無料ですか? ウェイトとデモは無料です。商用利用はライセンスに含まれていません。Qwenから別途契約が必要です。
どの無料ルートが実際の2.1モデルを実行しますか? Hugging Face Space、ModelScope Studio、ComfyUI、diffusersはすべてリリースされたチェックポイントを実行します。Qwen Chatもそうである可能性が高いですが、消費者向けチャット製品はどのモデルバージョンが応答するかを保証しません。
透明なPNGを無料で入手できますか? はい。Space、ComfyUI、またはdiffusersのプロンプトでRGBA画像を要求し、ファイルのモードを確認してください。
GPUは必要ですか? Space、ModelScope、またはQwen Chatでは不要です。ComfyUIまたはdiffusersではGPUが必要です。Qwenは最小VRAMを公開していませんが、CPUオフロードとFP8ビルドで敷居は下がります。
Qwen-Image-2.1の無料APIはありますか? Alibabaがホストしているものはありません。SpaceのGradioエンドポイントは小規模なテストのスクリプト作成に機能し、ハウツーガイドで独自の実行方法が示されています。
次へ進む
上記の3つのテストからSpaceを始め、シードと再現性が必要になったらComfyUIまたはdiffusersに移行し、何かを出荷する前にライセンスを読んでください。コードについてはハウツーガイドが次のステップであり、購入か実行かの決定については3.0との比較を参考にし、Apidogはそれらすべてにおいてプロンプトとアサーションを安定させます。
