Alibaba a lancé Qwen3.8-Max le août 3, 2026 : c’est la première fois qu’un modèle Qwen de classe Max (niveau frontière) sort avec ses poids ouverts. La version 27B exécutable en local suivra la semaine prochaine. Ce guide présente les changements, les benchmarks de Qwen3.8 et le moyen le plus rapide de lancer dès aujourd’hui un vrai produit avec ce modèle.
Oui. Qwen3.8-Max est sorti le août 3, 2026 : c’est le premier modèle Qwen de classe Max publié avec ses poids ouverts. Vous pouvez l’utiliser via des fournisseurs comme OpenRouter, Together AI ou l’API officielle de Qwen. Une variante Qwen3.8-27B à poids ouverts exécutable en local est aussi prévue pour la semaine suivante ; elle pourra tourner sur un GPU grand public haut de gamme.
Qwen3.8-Max est présenté comme un modèle performant en programmation et collaboration, Alibaba affirmant qu’il fixe une nouvelle référence dans cette catégorie. En pratique, Claude Opus 5 (sorti le juillet 24, 2026) reste meilleur pour la génération de code complexe sur plusieurs fichiers et le raisonnement architectural. Qwen3.8-Max est compétitif pour les tâches sur un fichier, prend bien en charge le code multilingue et, grâce à ses poids ouverts, peut être hébergé soi-même ou ajusté finement, ce qui n’est pas possible avec les modèles fermés.
Utilisez l’API Qwen ou OpenRouter (qui a ajouté Qwen3.8-Max dès le premier jour) comme point de terminaison du modèle, et créez la couche produit avec un créateur IA. Avec We.Inc, décrivez l’application en termes simples, obtenez immédiatement une application React fonctionnelle, connectez votre clé API Qwen à l’appel du modèle et publiez sur un domaine personnalisé. Le code généré peut être exporté : vous bénéficiez ainsi de la même liberté de propriété sans verrouillage qui rend les poids ouverts intéressants. Commencez gratuitement sur we.inc.
Qwen3.8-Max lui-même est un grand modèle qui n’est pas conçu pour l’inférence locale sur ordinateur grand public. Alibaba a toutefois annoncé la sortie distincte de Qwen3.8-27B à poids ouverts pour la semaine du août 10, 2026. La version 27B tourne sur un GPU haut de gamme (un RTX 4090 avec 24GB de VRAM suffit pour une inférence quantifiée) et conserve une grande partie des capacités de Max pour les tâches de code. D’ici là, l’API Qwen et OpenRouter sont les voies les plus rapides.
Alibaba a lancé Qwen3.8-Max le août 3, 2026 et, en quelques heures, le modèle faisait la une de Hacker News avec près de 1000 points. L’annonce ne se résume pas à la sortie d’un nouveau modèle : c’est la première fois qu’Alibaba publie un modèle de classe Max — son niveau frontière — avec des poids ouverts. OpenRouter l’a proposé dès le premier jour. Une version Qwen3.8-27B exécutable en local suivra la semaine prochaine.
En bref : Qwen3.8-Max est désormais le modèle de code à poids ouverts le plus puissant accessible par API. Pour créer un produit avec lui dès aujourd’hui, l’API Qwen ou OpenRouter permet de démarrer en quelques minutes ; vous pouvez ensuite créer une application complète autour de ce point de terminaison avec We.Inc, sans écrire la couche d’infrastructure. La variante 27B exécutable en local sort la semaine prochaine et fonctionnera sur un GPU de 24GB.
La gamme Qwen a toujours été performante pour sa catégorie de taille. Qwen 3.6-27B s’est fait connaître comme l’un des meilleurs modèles locaux pour le code, le raisonnement et les tâches multilingues, sans véritable équivalent à cette taille. Qwen3.8 passe au niveau Max ; voici les faits importants :
Des poids ouverts de niveau frontière. Les versions précédentes de Qwen-Max étaient uniquement accessibles par API fermée. La nouvelle importante est la publication des poids à ce niveau de capacité, pas un score de benchmark. Vous pouvez héberger le modèle vous-même, l’ajuster finement ou l’exécuter derrière votre propre pare-feu, sans dépendre de la disponibilité de l’API d’Alibaba.
Le code et la « cowork » sont les principaux usages annoncés. Le blog officiel présente Qwen3.8-Max comme un modèle destiné aux flux de développement où un développeur et une IA échangent du contexte au cours d’une longue session : pas une simple autocomplétion ponctuelle, mais un partenaire de programmation continu. Les benchmarks publiés avec le modèle le placent au niveau ou au-dessus des précédentes versions Qwen-Max sur HumanEval, MBPP et les scénarios de programmation à plusieurs tours.
La version locale 27B est confirmée pour la semaine prochaine. Le fil HN a confirmé la sortie de Qwen3.8-27B durant la semaine du août 10. Qwen3.6-27B est déjà largement considéré comme le meilleur modèle local de cette taille, et la version 3.8 en 27B sera celle que les développeurs exécuteront sur leurs propres machines.
OpenRouter dès le premier jour. C’est utile en pratique : si vous avez déjà une clé OpenRouter, vous pouvez appeler Qwen3.8-Max dès maintenant sans configurer de fournisseur.
Trois sorties ont marqué le haut de gamme ces deux dernières semaines : Claude Opus 5 (juillet 24), Kimi K3 à poids ouverts (fin juillet, 2.8T paramètres), puis Qwen3.8-Max (août 3). Elles répondent à des besoins différents :
| Modèle | Idéal pour | Poids ouverts | Exécutable en local |
|---|---|---|---|
| Claude Opus 5 | Génération complexe sur plusieurs fichiers, architecture | Non | Non |
| Kimi K3 | Tâches à long contexte, documents de recherche | Oui | Non (2.8T paramètres) |
| Qwen3.8-Max | Code, multilingue, longues sessions | Oui | API dès maintenant, version locale 27B la semaine prochaine |
| Qwen3.8-27B (à venir) | Assistant de code local | Oui | Oui, GPU de 24GB |
Pour lancer un produit qui utilise un modèle de pointe avec poids ouverts, Qwen3.8-Max est désormais le choix le plus pratique. Kimi K3 a aussi des poids ouverts, mais avec 2.8 trillions de paramètres il exige du matériel de centre de données. Qwen3.8-27B sera le premier modèle de niveau frontière qu’un développeur pourra réellement exécuter sur une station de travail.
Voici les cas d’usage pratiques qui émergent dans les premiers échanges sur Qwen3.8 :
Assistants de programmation pour longues sessions. L’orientation « cowork » est réelle : les modèles Qwen gèrent bien les longs contextes, ce qui les rend adaptés aux sessions où vous développez une fonctionnalité répartie sur des dizaines de fichiers plutôt qu’à des questions ponctuelles. Les petites entreprises qui veulent héberger leur propre assistant IA de programmation en interne sont le public visé.
Outils SaaS multilingues. Qwen a historiquement été la famille de modèles la plus performante pour la programmation dans d’autres langues, notamment les langues CJK. Les équipes qui créent des outils pour les marchés japonais, chinois ou coréen l’adoptent déjà comme remplacement direct des modèles conçus d’abord pour l’anglais.
Outils internes ajustés finement. Les poids ouverts permettent l’ajustement fin. Les entreprises qui développent des agents de programmation spécialisés pour leurs propres environnements (SDK propriétaires, API internes, frameworks métier) peuvent entraîner Qwen3.8 sur leur base de code, contrairement aux modèles fermés.
Le point de terminaison du modèle est la partie facile. C’est le produit qui l’entoure qui bloque les projets. Voici une méthode concrète avec We.Inc :
Pour un outil doté d’une seule fonction, il faut généralement moins d’une heure entre « décrire l’application » et « la mettre en ligne sur un domaine ». L’infrastructure, l’authentification et l’hébergement — qui prendraient normalement une semaine — sont pris en charge.
Une question mérite une réponse directe : WeInc utilise des modèles IA avancés pour générer des sites dans son créateur. Est-ce incompatible avec la création d’une application basée sur Qwen à l’aide de WeInc ?
Non, et c’est désormais une architecture normale. L’IA qui écrit et modifie votre code (l’IA du créateur) est distincte de celle appelée par votre application à l’exécution (l’IA du produit). We.Inc utilise le modèle actuellement le plus performant en génération de code sur plusieurs fichiers et en raisonnement d’interface. L’application créée par WeInc peut appeler l’API de votre choix : Qwen3.8-Max, une instance locale de Qwen3.8-27B, Claude ou GPT-4o. Vous choisissez le meilleur outil à chaque niveau sans vous engager à utiliser un seul modèle partout.
Qwen3.8-Max est disponible dès maintenant sur OpenRouter. La version locale 27B suit la semaine prochaine. La période pendant laquelle être parmi les premiers utilisateurs d’un modèle apporte de la visibilité — citations, liens, bouche-à-oreille — dure environ les deux premières semaines suivant sa sortie.
Décrivez votre application basée sur Qwen sur We.Inc, gratuit pour commencer sans carte bancaire, et mettez-la en ligne sur un domaine aujourd’hui. Pour comparer les formules, consultez les tarifs. Pour découvrir plus largement comment créer des applications de production sans code, consultez comment créer une application web sans code.
Commencer gratuitement · Sans carte bancaire