Comment utiliser Qwen 3.8 gratuitement

Toutes les manières concrètes d'utiliser Qwen 3.8 gratuitement : Qwen Chat, le quota Model Studio de 1 million de jetons (Singapour, 90 jours), la chronologie des poids ouverts, et ce qu'il faut éviter.

Ashley Innocent

Ashley Innocent

3 August 2026

Comment utiliser Qwen 3.8 gratuitement

Apidog pour les entreprises

Déploiement sur site

SSO & RBAC

Conforme SOC 2

Découvrir Apidog Enterprise

Alibaba a lancé Qwen 3.8-Max début août 2026, et les résultats de recherche sont déjà remplis d'affirmations « utilisez-le gratuitement pour toujours » qui ne résistent pas à l'examen des conditions réelles. Voici la version honnête, vérifiée sur les propres pages d'Alibaba au 3 août 2026.

Il existe exactement quatre voies qui méritent votre temps. Deux fonctionnent aujourd'hui. L'une est une promesse avec une date attachée. L'une est une solution de repli. Si vous voulez d'abord avoir une vue d'ensemble complète du modèle (2,4 billions de paramètres au total, 95 milliards actifs, contexte de 1 million de jetons), commencez par notre aperçu de Qwen 3.8 et revenez ensuite.

bouton

Aperçu rapide avant les détails :

Voie Gratuit ? Fonctionne aujourd'hui ? Restrictions
Qwen Chat Oui Oui Application grand public, pas d'API
Quota d'API Model Studio 1 million de jetons Oui Région de Singapour uniquement, 90 jours
Poids ouverts (auto-hébergement) Poids gratuits Pas encore Promis « la semaine prochaine », et le matériel n'est pas gratuit
Anciens modèles Qwen Oui Oui Pas Qwen 3.8

Voie 1 : Qwen Chat, l'option sans aucune configuration

Le chemin gratuit le plus rapide est celui qu'Alibaba souhaite pour les consommateurs : Qwen Chat. Connectez-vous, choisissez le modèle, et vous discutez avec Qwen 3.8-Max sans carte et sans console cloud. Le billet de blog officiel pointe ici comme la manière par défaut d'essayer le modèle.

Ce que vous obtenez : une utilisation gratuite du modèle phare via une interface de chat, y compris la compréhension des images et des documents sur laquelle s'appuient les démos de lancement.

Ce que vous n'obtenez pas : une API. Pas de clés, pas d'automatisation, aucun moyen de l'intégrer à votre application ou suite de tests. Les applications de chat appliquent également leurs propres invites système et paramètres, de sorte que le comportement que vous y observez ne correspondra pas exactement à ce que l'API brute renvoie. Si vous évaluez Qwen 3.8 pour un produit, considérez Qwen Chat comme une démo, pas comme un étalon.

Verdict : réel, gratuit et idéal pour une première prise en main. Pas une voie pour les développeurs.

Voie 2 : le quota gratuit de Model Studio (lisez les petits caractères)

C'est la voie qui compte si vous écrivez du code. Alibaba Cloud Model Studio offre aux nouvelles activations un quota gratuit pour qwen3.8-max : 1 million de jetons. C'est un montant véritablement utile, et il est également assorti de petits caractères que la plupart des articles récapitulatifs ignorent.

Voici ce que la page de tarification dit réellement, traduit en décisions :

1. Région de Singapour uniquement. Le quota gratuit s'applique à la région de Singapour (internationale). Cela signifie que votre URL de base est :

https://dashscope-intl.aliyuncs.com/compatible-mode/v1

Pointez vers les points d'accès de Pékin ou de US-Virginie et vous paierez dès le premier jeton. Si votre budget de latence nécessite un point d'accès aux États-Unis, le quota gratuit ne vous sera d'aucune aide.

2. 90 jours, puis il disparaît. Le quota est valable 90 jours à compter de l'activation. Les jetons inutilisés ne sont pas reportés ; ils expirent. Le compte à rebours a déjà commencé avec le lancement du modèle début août, donc n'activez pas maintenant en prévoyant d'évaluer en novembre.

3. Après le quota : 2 $ par million de jetons en entrée / 6 $ par million de jetons en sortie. C'est le tarif forfaitaire pour le contexte complet de 1 million de jetons, sans niveaux. C'est bon marché pour un modèle phare, mais ce n'est pas gratuit, et la transition est automatique une fois que votre quota est épuisé ou expire. Configurez une alerte de facturation avant de commencer. Nous détaillons le coût des charges de travail réelles dans notre guide de tarification de Qwen 3.8.

Pour réclamer le quota : créez un compte sur Model Studio, activez le service et générez une clé API (la convention de variable d'environnement est DASHSCOPE_API_KEY). Le catalogue de modèles liste qwen3.8-max en haut des modèles recommandés. Le point d'accès utilise le protocole compatible OpenAI, et il existe également un point d'accès compatible Anthropic. Notre tutoriel sur l'API Qwen 3.8 couvre les deux, avec la diffusion en continu et la sortie de raisonnement incluses.

Un piège qui consomme du quota : le raisonnement est activé par défaut

Qwen 3.8-Max est livré avec reasoning_effort réglé sur xhigh, et les jetons de réflexion sont facturés comme des sorties. Une seule invite complexe peut produire discrètement des milliers de jetons de raisonnement avant même que la réponse ne commence. Sur un compte payant, c'est une ligne de coût ; sur un quota gratuit de 1 million de jetons, c'est la différence entre deux semaines de tests et deux jours. Réduisez reasoning_effort à low ou medium pour toute tâche qui n'est pas une véritable tâche de raisonnement.

Faites durer le million de jetons

Un million de jetons disparaît rapidement lorsque chaque itération de débogage renvoie toute votre chaîne d'invites. Quelques habitudes permettent de le prolonger :

Téléchargez Apidog gratuitement si vous souhaitez suivre ce flux de travail ; cela rend également le changement de région indolore, car vous pouvez stocker les URL de base de Singapour, Pékin et des États-Unis comme environnements et basculer entre elles.

Verdict : réel, véritablement gratuit pendant 90 jours, et la meilleure voie pour les développeurs à l'heure actuelle. Respectez simplement le verrouillage régional et la date d'expiration.

Voie 3 : poids ouverts, promis mais pas encore téléchargeables

La plus grande nouvelle du lancement pour la foule du gratuit : Qwen 3.8-Max est le premier modèle de classe Qwen-Max avec des poids ouverts. Alibaba affirme que les poids seront disponibles sur Hugging Face et ModelScope « la semaine prochaine », ce qui les situerait autour du 10 août.

Au 3 août 2026, ils ne sont pas téléchargeables. Il n'y a rien à télécharger, rien à quantifier, rien à exécuter. Si vous voyez un tutoriel « exécuter Qwen 3.8 localement aujourd'hui » daté avant l'existence réelle des poids, fermez l'onglet. À titre de référence, Kimi K3 a fait la même promesse de poids ouverts lors de son lancement et l'a tenue 11 jours plus tard, donc le calendrier est plausible. Mais cela ne s'est pas encore produit.

La réalité de l'auto-hébergement

Même lorsque les poids seront disponibles, le « gratuit » aura besoin d'un astérisque de la taille d'une baie de serveurs. Qwen 3.8-Max représente 2,4 billions de paramètres au total. Le précédent le plus proche est Kimi K3 : un modèle de 2,8 billions de paramètres qui a été livré avec 594 Go de poids même avec une quantification MXFP4 agressive. Ramenez cela légèrement pour les 2,4 billions de Qwen et vous êtes toujours face à des centaines de gigaoctets de poids et une configuration de service multi-GPU, et de manière réaliste multi-nœuds. Aucune carte graphique grand public ne peut gérer cela. Aucune station de travail unique ne peut gérer cela. Nous avons détaillé précisément à quoi ressemble cette classe de matériel pour l'exécution locale de Kimi K3, et les aspects économiques s'appliquent ici sans changement.

Alors, que vous apportent réellement les poids ouverts ? Principalement ceci : une fois les poids publics, des hébergeurs tiers peuvent servir le modèle, et la concurrence tend à faire baisser les prix d'hébergement en dessous des tarifs du fournisseur initial. Pour la plupart des lecteurs, les « poids ouverts gratuits » se traduiront par un accès API moins cher via des fournisseurs d'hébergement, et non par un modèle fonctionnant sur votre ordinateur portable. C'est toujours une victoire. C'est juste une victoire différente de ce que la phrase suggère.

Verdict : pas encore réel. Revenez à la mi-août, et prévoyez un budget pour l'hébergement, pas pour le matériel.

Voie 4 : la solution de repli, des anciens modèles Qwen véritablement gratuits

Si ce dont vous avez besoin est « un modèle Qwen capable à coût zéro » plutôt que « Qwen 3.8-Max spécifiquement », la génération précédente propose des voies gratuites qui n'expirent pas dans 90 jours. Les modèles Qwen à poids ouverts plus petits fonctionnent déjà sur du matériel que les gens possèdent réellement, et l'ancienne gamme a ses propres chemins d'accès sans coût. Nous tenons à jour un guide séparé pour utiliser Qwen 3.7 gratuitement qui reste à jour sur ces options.

Le compromis honnête : vous renoncez aux gains de performances qui ont fait la une de 3.8-Max. Pour un projet secondaire, un classificateur ou pour apprendre la forme de l'API Qwen avant de dépenser de l'argent, les modèles plus anciens sont souvent suffisants.

Ce qui n'est pas réel

Pour vous éviter des recherches, voici ce qui n'existe pas au 3 août 2026 :

FAQ

L'API Qwen 3.8 est-elle réellement gratuite ?

En partie. Vous obtenez 1 million de jetons gratuits via Alibaba Cloud Model Studio, valables 90 jours et uniquement dans la région de Singapour. Après cela, le tarif est de 2 $ par million de jetons en entrée et de 6 $ par million de jetons en sortie, alors planifiez votre évaluation dans la fenêtre de 90 jours.

Puis-je télécharger et exécuter Qwen 3.8 localement dès maintenant ?

Non. Les poids sont promis pour Hugging Face et ModelScope aux alentours du 10 août 2026, et n'ont pas encore été publiés au moment de la rédaction de cet article. Quand ils le seront, prévoyez des centaines de gigaoctets et un service multi-GPU ; il s'agit d'un modèle de 2,4 billions de paramètres, pas quelque chose qu'un ordinateur portable peut exécuter.

En quoi cela diffère-t-il des options gratuites de Kimi K3 ?

Les poids de Kimi K3 sont déjà en ligne et téléchargeables, donc sa voie d'auto-hébergement est réelle aujourd'hui, tandis que celle de Qwen 3.8 est toujours en attente. Cependant, les deux sont bien trop grands pour le matériel grand public. Notre guide sur l'utilisation gratuite de Kimi K3 couvre les voies de ce modèle si vous souhaitez comparer.

Le quota gratuit couvre-t-il les jetons de réflexion ?

Oui, mais ils l'épuisent. Les sorties de raisonnement sont facturées comme des sorties normales, et le reasoning_effort par défaut est xhigh. Réduisez-le pour les appels de routine, sinon votre quota disparaîtra dans une chaîne de pensée que vous ne lirez jamais.

En résumé

L'accès gratuit à Qwen 3.8 est réel, mais il est spécifique : Qwen Chat pour une utilisation occasionnelle, et 1 million de jetons dans la région de Singapour avec une validité de 90 jours pour les développeurs. La voie des poids ouverts est théoriquement à quelques jours et signifiera principalement un accès hébergé moins cher en pratique. Tout le reste est soit un modèle plus ancien, soit de l'optimisme exagéré.

Si vous choisissez la voie de l'API, dépensez votre quota pour les réponses, pas pour le débogage. Prototypez les requêtes dans Apidog, simulez les réponses pendant que vous développez, et conservez les jetons réels pour les exécutions d'évaluation qui vous diront si Qwen 3.8-Max mérite une place dans votre pile technologique.

bouton

Pratiquez le Design-first d'API dans Apidog

Découvrez une manière plus simple de créer et utiliser des API