Alibaba a dévoilé lundi Qwen3.8-Max, présenté comme le modèle le plus puissant de sa famille Qwen. Le groupe chinois revendique des performances comparables à celles de Claude Fable 5 d'Anthropic, notamment sur les tâches de longue durée exécutées sans supervision humaine. Une annonce qui intervient quelques jours après le lancement de Kimi K3 par Moonshot AI, dans un contexte de course accélérée entre laboratoires chinois et américains.
Un modèle pensé pour travailler seul, pendant des jours
Qwen3.8-Max repose sur une architecture de type mélange d'experts (MoE) de 2400 milliards de paramètres, dont environ 95 milliards sont activés à chaque requête. Ce choix vise à réduire les coûts de calcul tout en conservant des performances élevées. Le modèle prend en charge une fenêtre de contexte allant jusqu'à un million de tokens, ce qui lui permet, selon Alibaba, de traiter des documents volumineux, des dépôts de code entiers ou des vidéos longues en une seule requête.
L'équipe Qwen affirme que le modèle a travaillé de manière entièrement autonome pendant environ cinq jours, soit 125 heures d'efforts ininterrompus, pour reconstruire puis améliorer l'expérience décrite dans un article de recherche en mathématiques. Alibaba cite également un test dans lequel le modèle a participé à un concours en ligne face à 526 équipes humaines et, avec une échéance de 24 heures, aurait dépassé toutes les équipes sauf 68. Par ailleurs, le groupe indique que Qwen3.8-Max a passé 16 jours à construire puis perfectionner un outil de codage, en écrivant, testant et corrigeant son propre travail sans intervention continue.
Ces chiffres n'ont pas été vérifiés par des chercheurs indépendants. Alibaba lui-même reconnaît que ces résultats de benchmarks proviennent de ses propres tests et n'ont pas encore fait l'objet d'une validation externe. Le modèle se classerait deuxième mondial sur l'arène visuelle et cinquième sur l'arène textuelle, juste derrière Claude Fable 5 selon les classements cités par le groupe.
La riposte par l'ouverture des poids
Depuis deux ans, Washington restreint l'exportation de puces avancées vers les entreprises chinoises d'IA, dans l'objectif déclaré de maintenir des acteurs comme Alibaba avec une génération de retard technologique. La réponse d'Alibaba consiste à annoncer la publication prochaine des poids de Qwen3.8-Max, accompagnés d'une version plus légère, Qwen3.8-27B, permettant à quiconque de télécharger, vérifier et affiner le modèle plutôt que de croire les annonces du groupe sur parole. Cette ouverture tranche avec la posture d'Anthropic, dont Claude Opus 5, lancé le 24 juillet 2026, reste un modèle propriétaire accessible uniquement via API ou les outils Claude Code et Claude Cowork.
Ce geste s'inscrit dans une trajectoire plus longue: la famille Qwen a démarré en avril 2023 sous le nom Tongyi Qianwen, ouverte au public en septembre 2023, avant que la génération Qwen3 ne soit publiée sous licence Apache 2.0 en avril 2025. Plus de 200 000 variantes des modèles Qwen circulent aujourd'hui sur Hugging Face, et l'application Qwen revendiquait 234 millions d'utilisateurs en mai 2026. Une commission américaine chargée d'examiner les enjeux économiques et sécuritaires sino-américains a souligné que cette stratégie d'ouverture aide la Chine à compenser ses contraintes de calcul.
| Modèle | Éditeur | Paramètres | Fenêtre de contexte | Poids ouverts | Test d'autonomie revendiqué |
|---|---|---|---|---|---|
| Qwen3.8-Max | Alibaba | 2400 milliards (environ 95 milliards actifs) | jusqu'à 1 million de tokens | Oui, annoncé pour la semaine suivant le 3 août 2026 | 125 heures en continu sur un projet de recherche mathématique; 16 jours sur un projet de codage |
| Claude Fable 5 / Opus 5 | Anthropic | non communiqué dans les sources | non communiqué dans les sources | Non, modèle propriétaire | conçu pour fonctionner sans supervision sur de longues périodes |
| Kimi K3 | Moonshot AI | 2800 milliards | non communiqué dans les sources | non communiqué dans les sources | non communiqué dans les sources |
Ce que l'ouverture change réellement pour un professionnel européen
La disponibilité des poids d'un modèle de cette taille change la nature du choix pour une entreprise francophone. Avec un modèle propriétaire, l'accès passe obligatoirement par l'API du fournisseur, ce qui implique un envoi systématique des données vers son infrastructure. Avec un modèle à poids ouverts, il devient possible d'héberger l'inférence sur son propre matériel ou chez un hébergeur de son choix, sans transiter par les serveurs de l'éditeur d'origine. Un tutoriel technique publié sur GitHub illustre cette possibilité concrète: il décrit comment faire fonctionner une version antérieure, Qwen 3.5, en local sur un Mac équipé d'une puce Apple Silicon, en connectant l'interface de Claude Code à un serveur local plutôt qu'à l'API d'Anthropic, sans facturation à l'usage ni sortie de données vers un tiers.
Cette démonstration concerne Qwen 3.5 et non le tout nouveau Qwen3.8-Max, dont les poids ne sont pas encore publiés au moment de l'annonce. Elle montre néanmoins que l'ouverture des poids déplace la question de la souveraineté numérique: elle ne dépend plus seulement du pays d'origine de l'éditeur, mais de la capacité de l'entreprise utilisatrice à maîtriser l'endroit où tourne réellement le modèle. Pour une PME sans équipe technique dédiée à l'auto-hébergement de modèles de plusieurs dizaines de milliards de paramètres, cette liberté théorique reste toutefois difficile à exploiter dans l'immédiat.
Tarifs et canaux d'accès annoncés par Alibaba
Pour les développeurs qui préfèrent passer par l'API plutôt que par un hébergement local, Alibaba a communiqué une grille tarifaire en dollars américains: 2 dollars par million de tokens en entrée, 6 dollars par million de tokens en sortie, et 0,25 dollar par million de tokens pour la mise en cache implicite. Le groupe présente ces tarifs comme compétitifs face aux modèles occidentaux équivalents. L'accès s'effectue via les API du Model Studio d'Alibaba Cloud pour les développeurs, ou via QwenWork, l'assistant de travail conçu par Alibaba pour les entreprises.
Ces montants sont exprimés en dollars et facturés à l'usage, sur une base différente des abonnements par siège pratiqués par certaines plateformes multi-modèles françaises. En France, des offres comme celle de Moon AI regroupent déjà plus de 70 modèles, dont des versions Qwen, GPT, Claude, Gemini, Mistral, DeepSeek, Llama et Grok, au sein d'un abonnement unique facturé en euros TTC par siège, sans qu'il soit possible de garantir à ce jour l'inclusion de Qwen3.8-Max spécifiquement, l'éditeur n'ayant pas communiqué de calendrier précis pour cette intégration.
Ce qu'il reste à vérifier avant d'adopter un modèle chinois open source
Plusieurs points restent en suspens pour une entreprise qui envisagerait Qwen3.8-Max en production. D'abord, les performances annoncées reposent uniquement sur des tests internes d'Alibaba, non reproduits par des chercheurs tiers à ce jour. Ensuite, si l'utilisation passe par l'API d'Alibaba Cloud plutôt que par un hébergement local des poids, les données transitent par l'infrastructure du groupe, ce qui pose des questions de localisation et de droit applicable qu'une entreprise soumise au RGPD doit examiner avant tout déploiement. Enfin, l'écart entre les capacités revendiquées et les capacités réellement disponibles en accès public ne sera mesurable qu'une fois les poids publiés et testés hors du contrôle de l'éditeur.
Sur ce dernier point, les plateformes françaises qui agrègent des modèles tiers, dont ceux issus de Chine, appliquent parfois des mécanismes intermédiaires de protection des données. Moon AI utilise par exemple un dispositif nommé Moon Blur, qui remplace les données personnelles par des jetons avant leur envoi à un modèle tiers, puis les rétablit au retour. Ce procédé étant réversible, il s'agit d'une pseudonymisation au sens du RGPD, pas d'une anonymisation, et il ne rend pas à lui seul un usage conforme: il réduit l'exposition des données personnelles identifiables au moment du traitement par le modèle, sans garantir la conformité globale du traitement.
Questions fréquentes
Qwen3.8-Max est-il vraiment gratuit et ouvert à tous ?
Alibaba annonce la publication des poids du modèle et d'une version plus légère, Qwen3.8-27B, ce qui permettra un usage libre et un affinage local. L'accès via API reste toutefois facturé à l'usage, en dollars, selon la grille tarifaire communiquée par le groupe.
Les performances annoncées par Alibaba sont-elles fiables ?
Les chiffres proviennent des tests internes d'Alibaba et n'ont pas été vérifiés par des chercheurs indépendants au moment de l'annonce. Le groupe reconnaît lui-même que ces résultats n'ont pas encore fait l'objet d'une validation externe.
Utiliser Qwen via l'API d'Alibaba Cloud pose-t-il un problème de localisation des données ?
Oui, potentiellement. Passer par l'API d'Alibaba Cloud implique un envoi des données vers l'infrastructure du groupe chinois. Seul un hébergement local des poids ouverts, une fois ceux-ci publiés, permet d'éviter ce transfert, à condition de disposer de la puissance de calcul nécessaire.
Existe-t-il des alternatives pour tester Qwen sans développer d'intégration technique ?
Des plateformes multi-modèles françaises comme Moon AI proposent déjà un accès à des modèles Qwen antérieurs au sein d'un abonnement unique regroupant plus de 70 modèles, avec des tarifs allant de 9,90 à 249,90 euros TTC par siège et par mois selon la formule, sans que l'inclusion de Qwen3.8-Max soit confirmée à ce jour.
Transparence. Cet article a été rédigé par un système d'intelligence artificielle à partir des sources listées ci-dessous, puis vérifié fait par fait par un second système avant publication. Il n'a pas fait l'objet d'une relecture humaine préalable. Les chiffres et citations proviennent des sources ; en cas d'écart, la source fait foi.
Sources. Article rédigé à partir des publications suivantes, consultées le 03/08/2026. En cas d'écart, la source fait foi. Signalez toute inexactitude à contact@stellarrstudio.com.
- https://fr.news.yahoo.com/nouvelle-ia-qwen-dalibaba-revendique-083448528.html
- https://en.wikipedia.org/wiki/Qwen
- https://www.cnbc.com/2026/08/03/alibaba-ai-model-qwen-rival-anthropic.html
- https://www.indiatoday.in/technology/news/story/alibaba-launches-its-most-powerful-model-qwen-38-max-claims-it-can-match-performance-of-chatgpt-and-claude-2962176-2026-08-03
- https://www.digit.in/news/general/what-is-alibabas-qwen-38-max-how-it-is-different-from-claude-fable-5-and-kimi-k3.html
- https://gist.github.com/kibotu/a009f00414b7c10fb1c74e603d7838c0