Qwen-Image-2.1 miễn phí theo cách quan trọng nhất: các trọng số (weights) là công khai. Alibaba đã phát hành mô hình tạo và chỉnh sửa hợp nhất 7B này vào ngày 20 tháng 9 năm 2026 theo Giấy phép Nghiên cứu Qwen, với khả năng tạo và chỉnh sửa đầu ra trong suốt tự nhiên từ tối đa 10 hình ảnh tham chiếu. Không có phí mỗi hình ảnh và không cần mua khóa API. Điều bạn phải trả là một hàng đợi (đối với các bản demo được lưu trữ) hoặc một GPU (nếu tự chạy). Hướng dẫn này liệt kê mọi cách thức miễn phí, mỗi cách mang lại cho bạn điều gì và giấy phép cho phép bạn làm gì với đầu ra.
Nếu bạn cần tổng quan về tính năng trước, hãy đọc Qwen-Image-2.1 là gì. Nếu bạn đã thử và muốn có mã, hướng dẫn cách dùng có các ví dụ về diffusers và một trình bao bọc (wrapper) mà bạn có thể kiểm thử trong Apidog.
Các tuyến đường miễn phí trong nháy mắt
| Tuyến đường | Chi phí | Tốt nhất cho | Hạn chế |
|---|---|---|---|
| Qwen Chat, “Tạo hình ảnh” | Tài khoản miễn phí | Cái nhìn đầu tiên nhanh nhất, tích hợp viết lại lời nhắc | Giới hạn người dùng, không kiểm soát hạt giống (seed), mô hình đằng sau giao diện người dùng có thể thay đổi [XÁC MINH rằng 2.1 là mô hình phục vụ Qwen Chat] |
| Hugging Face Space | Miễn phí (hàng đợi ZeroGPU) | Kiểm thử điểm kiểm tra 2.1 chính xác với tham chiếu và độ trong suốt | Thời gian chờ hàng đợi, hạn mức GPU cho mỗi người dùng, không có chế độ hàng loạt |
| ModelScope Studio | Miễn phí | Giống như Space, thông lượng tốt hơn từ Trung Quốc đại lục | Cần tài khoản |
| ComfyUI trên GPU của bạn | Phần mềm miễn phí, phần cứng của bạn | Quy trình làm việc có thể lặp lại, các lớp trong suốt, chỉnh sửa cục bộ với mặt nạ | Bộ nhớ GPU; thiết lập |
| diffusers trên GPU của bạn hoặc sổ tay đám mây | Phần mềm miễn phí, phần cứng của bạn hoặc sổ tay miễn phí | Sử dụng có lập trình, hạt giống, tự động hóa | Tương tự; sổ tay miễn phí có thể không phù hợp với bf16 |
Tuyến đường 1: Qwen Chat
Cách nhanh nhất để xem 2.1 làm gì là chế độ Tạo Hình ảnh trong Qwen Chat, mà Qwen chỉ ra từ trang đích của nó. Nhập một yêu cầu ngắn gọn bằng bất kỳ ngôn ngữ nào; lớp trò chuyện sẽ mở rộng nó thành một lời nhắc có cấu trúc dài (công việc tương tự mà mô hình viết lại lời nhắc PE-T2I đã xuất bản thực hiện) và trả về một hình ảnh. Chỉnh sửa hoạt động bằng cách đính kèm một hình ảnh và mô tả thay đổi.
Tốt cho: đánh giá kiểu chữ, chất lượng chân dung và liệu phong cách chỉnh sửa có phù hợp với bạn không. Không tốt cho: khả năng tái tạo. Không có hạt giống, giới hạn không được công bố và các sản phẩm trò chuyện dành cho người tiêu dùng có thể thay đổi mô hình mà không báo trước, vì vậy hãy xác nhận mô hình nào đang trả lời trước khi bạn đưa ra kết luận cụ thể về 2.1.
Tuyến đường 2: Hugging Face Space
Qwen-Image-2.1 Space chính thức chạy điểm kiểm tra thực tế trên các GPU được chia sẻ. Nó cung cấp các tính năng mà bài đăng ra mắt cho thấy: văn bản thành hình ảnh, chỉnh sửa với hình ảnh tham chiếu và đầu ra trong suốt khi bạn yêu cầu. Đăng nhập vào một tài khoản Hugging Face miễn phí để có hạn mức ZeroGPU lớn hơn; người dùng ẩn danh sẽ nhận được ít hơn và phải chờ lâu hơn.
Ba thử nghiệm đáng chạy ở đây trước khi bạn tự chi tiền cho GPU:
- Độ trong suốt. Lời nhắc: “Đây là hình ảnh RGBA có độ trong suốt. Một nhãn dán hình cáo hoạt hình. Hình ảnh có kênh alpha và nền trong suốt.” Tải xuống PNG và mở nó trên một bàn cờ. Phóng to các cạnh lông; đó là nơi các công cụ xóa nền thất bại và alpha gốc không nên.
- Nhiều tham chiếu. Tải lên ba bức ảnh của một sản phẩm từ các góc độ khác nhau và yêu cầu một bức ảnh phong cách sống. Kiểm tra xem văn bản nhãn và hình dạng có được giữ lại không.
- Hiển thị văn bản. Một biển báo hoặc áp phích với một chuỗi được trích dẫn bằng hai tập lệnh. Điểm mạnh của Qwen nằm ở đây, và việc xác nhận điều này rất dễ dàng.
Mọi Gradio Space cũng cung cấp các chức năng của nó dưới dạng các điểm cuối HTTP, có nghĩa là bạn có thể tạo tập lệnh cho các thử nghiệm này. Gói gradio_client hoặc một lệnh gọi trực tiếp đến đường dẫn /gradio_api/call/<fn> của Space cho phép bạn gửi lời nhắc và tìm nạp tệp kết quả; ghi lại đường dẫn chính xác từ liên kết “Use via API” của Space [XÁC MINH tên đường dẫn cho Space này]. Khi đó là một lệnh gọi HTTP, bạn có thể xây dựng nó thành một yêu cầu trong Apidog, khẳng định loại và kích thước của tệp được trả về, và chạy lại ba thử nghiệm tương tự trên máy chủ của riêng bạn sau này mà không cần viết lại bất cứ điều gì.
Tuyến đường 3: ModelScope
Qwen sao chép các trọng số và bản demo trên ModelScope. Nếu Hugging Face chậm hoặc bị giới hạn băng thông ở nơi bạn ở, bản demo Studio ở đó chạy cùng một mô hình và trang mô hình là gương tải xuống nhanh nhất cho người dùng ở Trung Quốc đại lục.
Tuyến đường 4: ComfyUI trên GPU của riêng bạn
ComfyUI đã thêm hỗ trợ gốc vào ngày ra mắt với một quy trình làm việc mẫu. Việc thiết lập gồm bốn bước: cập nhật ComfyUI, tải xuống các trọng số từ Hugging Face, tải mẫu và chạy nó với các lời nhắc và hình ảnh tham chiếu. Đầu ra trong suốt và chỉnh sửa nhiều tham chiếu được tích hợp vào mẫu, và bạn có thể lưu toàn bộ đồ thị dưới dạng tệp JSON, điều này làm cho ComfyUI trở thành tuyến đường miễn phí có thể lặp lại nhất ngoài việc viết mã.
Qwen chưa công bố yêu cầu VRAM. Ngăn xếp tham chiếu là một trình tạo 7B, một bộ mã hóa văn bản Qwen3-VL 8B và một VAE, ở định dạng bfloat16, với độ phân giải 2048 x 2048 và 40 bước. Hãy chuẩn bị cho một GPU tiêu dùng cao cấp hoặc trung tâm dữ liệu cho đường dẫn bf16 thông thường. Các đường dẫn nhẹ hơn tồn tại: enable_model_cpu_offload() trong diffusers, FP8 thông qua vLLM-Omni và tăng tốc LightX2V, tất cả đều được liệt kê trong GitHub README. Các điểm kiểm tra FP8 cộng đồng cho ComfyUI thường xuất hiện trong vòng vài ngày sau khi Qwen phát hành; hãy kiểm tra danh sách “Spaces and models using this” của mô hình trên Hugging Face trước khi chuyển đổi của riêng bạn.
Tuyến đường 5: diffusers, cục bộ hoặc trong sổ tay miễn phí
Mã tham chiếu ngắn gọn. Cài đặt torch>=2.4.0, transformers>=5.17, accelerate, pillow, và diffusers từ GitHub main, sau đó:
import torch
from diffusers import QwenImage21Pipeline
pipe = QwenImage21Pipeline.from_pretrained("Qwen/Qwen-Image-2.1", torch_dtype=torch.bfloat16)
pipe.enable_model_cpu_offload() # bỏ qua và .to("cuda") nếu toàn bộ mô hình vừa đủ
image = pipe(
prompt="This is an RGBA image with transparency. A paper plane icon. The image has alpha channel and the background is transparent.",
num_inference_steps=40,
generator=torch.Generator("cuda").manual_seed(7),
).images[0]
assert image.mode == "RGBA"
image.save("plane.png")
Các sổ tay đám mây miễn phí cung cấp cho bạn một GPU trong vài giờ mỗi lần; liệu đường dẫn bf16 có vừa với bộ nhớ của chúng hay không tùy thuộc vào card bạn được cấp, đó là lý do tại sao dòng giảm tải (offload) lại ở đó. Hướng dẫn cách dùng mở rộng điều này thành việc chỉnh sửa với các tham chiếu và một máy chủ HTTP nhỏ.
“Miễn phí” cho phép gì: giấy phép
Miễn phí tải xuống không có nghĩa là miễn phí để bán. Qwen-Image-2.1 được phát hành theo Thỏa thuận Giấy phép Nghiên cứu Qwen. Điều khoản quan trọng: bạn “sẽ không sử dụng Vật liệu cho bất kỳ mục đích thương mại nào nếu không có giấy phép thương mại riêng” từ Qwen. Các trọng số được phân phối lại hoặc tinh chỉnh phải giữ nguyên giấy phép, thêm thông báo “Được xây dựng với Qwen” và không thể sử dụng “Qwen” làm tên chính của chúng.
Vì vậy, mọi tuyến đường trên đều tốt cho việc học, nghiên cứu, công việc portfolio, thử nghiệm nội bộ và quyết định có nên cấp phép hay không. Việc bán hình ảnh, hoặc đặt mô hình đằng sau một sản phẩm trả phí, cần có thỏa thuận thương mại trước. Đó là sự khác biệt lớn nhất so với bản gốc Qwen-Image được cấp phép Apache, và từ các API trả phí như Nano Banana 2 hoặc gpt-image-2.5, với giá mỗi hình ảnh bao gồm quyền thương mại. Nếu bạn cần đầu ra thương mại mà không cần đàm phán giấy phép, Qwen Image 3.0 do Alibaba lưu trữ với giá 0,03 đô la mỗi hình ảnh là con đường được định trước; so sánh 2.1 với 3.0 sẽ làm rõ khi nào mỗi loại có ý nghĩa.
Miễn phí nhưng không nhanh: những gì mong đợi
- Hàng đợi demo được lưu trữ. Vào tuần ra mắt, hãy đợi vài phút mỗi hình ảnh trên Space vào giờ cao điểm ở Mỹ. Hạn mức sẽ được đặt lại hàng ngày cho người dùng đã đăng nhập.
- 2K ở 40 bước chậm trên GPU tiêu dùng. Hãy thử nghiệm ở kích thước lớp 1024 trước, sau đó mở rộng khi lời nhắc đã đúng.
- Chỉnh sửa nhiều tham chiếu là trường hợp 2.1 được tối ưu hóa: hình ảnh tham chiếu được mã hóa một lần và lưu vào bộ nhớ đệm qua các bước, vì vậy năm tham chiếu không tốn gấp năm lần một.
- Tuyến đường trò chuyện ẩn hạt giống. Nếu bạn cần cùng một hình ảnh hai lần, hãy sử dụng Space, ComfyUI hoặc diffusers, nơi bạn kiểm soát nó.
Biến các thử nghiệm miễn phí của bạn thành một bộ kiểm thử
Khi một tuyến đường hoạt động, rủi ro là lời nhắc của bạn bị trôi trong khi mô hình vẫn giữ nguyên, hoặc mô hình thay đổi trong khi lời nhắc của bạn vẫn giữ nguyên, và bạn không thể biết điều gì đang xảy ra. Cho dù bạn đang gọi điểm cuối Gradio của Space hay trình bao bọc của riêng bạn, hãy định nghĩa yêu cầu một lần trong Apidog: lời nhắc, hạt giống, cờ trong suốt và các tệp tham chiếu. Lưu thử nghiệm độ trong suốt và chỉnh sửa ba tham chiếu dưới dạng các trường hợp kiểm thử với các khẳng định về loại và kích thước phản hồi, và chạy lại chúng bất cứ khi nào bạn thay đổi bất cứ điều gì. Khi bạn chuyển từ miễn phí sang triển khai có giấy phép hoặc sang API 3.0, bộ kiểm thử sẽ di chuyển cùng bạn; chỉ có URL cơ sở thay đổi. Tải xuống Apidog để thiết lập điều đó.
Câu hỏi thường gặp
Qwen-Image-2.1 có hoàn toàn miễn phí không? Các trọng số và bản demo thì miễn phí. Sử dụng thương mại không được bao gồm trong giấy phép; bạn sẽ cần một thỏa thuận riêng từ Qwen.
Tuyến đường miễn phí nào chạy mô hình 2.1 thực sự? Hugging Face Space, ModelScope Studio, ComfyUI và diffusers đều chạy điểm kiểm tra đã phát hành. Qwen Chat có lẽ cũng vậy, nhưng các sản phẩm trò chuyện tiêu dùng không đảm bảo phiên bản mô hình nào trả lời.
Tôi có thể nhận được PNG trong suốt miễn phí không? Có. Yêu cầu một hình ảnh RGBA trong lời nhắc trên Space, trong ComfyUI hoặc trong diffusers, và kiểm tra chế độ của tệp.
Tôi có cần GPU không? Không cần cho Space, ModelScope hoặc Qwen Chat. Đối với ComfyUI hoặc diffusers bạn cần GPU; Qwen không công bố VRAM tối thiểu, và giảm tải CPU cộng với các bản dựng FP8 làm giảm yêu cầu.
Có API miễn phí nào cho Qwen-Image-2.1 không? Không có API được lưu trữ từ Alibaba. Điểm cuối Gradio của Space hoạt động để tạo tập lệnh cho các thử nghiệm nhỏ, và hướng dẫn cách dùng chỉ ra cách tự chạy của bạn.
Nên đi đâu tiếp theo
Bắt đầu trên Space với ba thử nghiệm trên, chuyển sang ComfyUI hoặc diffusers khi bạn cần hạt giống và khả năng lặp lại, và đọc giấy phép trước khi xuất bản bất cứ điều gì. Hướng dẫn cách dùng là bước tiếp theo cho mã, so sánh với 3.0 để đưa ra quyết định mua hay tự chạy, và Apidog giữ cho lời nhắc và các khẳng định của bạn ổn định trên tất cả các lựa chọn đó.
