Alibaba lance le modèle d'IA open weights Qwen3.8-Max avec des résultats de pointe sur les benchmarks de programmation
Hangzhou, 3 août 2026
N509FZ / Wikimedia Commons / CC BY-SA 4.0
Summary
Le géant chinois de la technologie Alibaba a présenté le 3 août 2026 son nouveau modèle d'IA Qwen3.
Hangzhou, 3 août 2026
Le géant chinois de la technologie Alibaba a présenté le 3 août 2026 son nouveau modèle d'IA Qwen3.8-Max en version open weights et le positionne, sur les benchmarks de programmation, au même niveau que les systèmes leaders d'Anthropic et d'OpenAI.
Le groupe technologique chinois Alibaba a publié son nouveau modèle linguistique d'IA Qwen3.8-Max en version open weights. Les modèles open weights publient les paramètres appris du réseau de neurones, permettant aux développeuses et développeurs d'exploiter, d'adapter et de réutiliser le modèle de manière autonome. Avec cette démarche, Alibaba entre dans une compétition pour la première place parmi les systèmes d'IA dédiés aux tâches de programmation, jusqu'ici dominée principalement par des fournisseurs américains.
Dans des comparaisons de benchmarks internes, Qwen3.8-Max obtient des résultats nettement meilleurs que son modèle précédent Qwen3.7-Max dans plusieurs tests. Sur la plateforme Terminal Bench 2.1, le nouveau modèle atteint un score de 86,6, devançant son prédécesseur à 74,5. Sur SWE-bench Pro, Qwen3.8-Max obtient 67,7 points, contre 60,6 pour Qwen3.7-Max. Sur DeepSWE 1.1 (56,6 contre 21,6), FrontierSWE (73,5 contre 40,7) et PaperBench (93,0 contre 64,8), on observe également un bond net par rapport à la version précédente.
Vue d'ensemble des résultats des benchmarks
En comparaison directe avec les modèles commerciaux actuellement leaders, Qwen3.8-Max livre des résultats mitigés. Sur Terminal Bench 2.1, il devance avec 86,6 points Claude Fable 5 d'Anthropic (84,6), mais se place derrière GPT-5.6 Sol d'OpenAI (88,8). Sur SWE-bench Pro, GPT-5.6 Sol (80,0) et Claude Fable 5 (69,2) mènent devant le nouveau modèle d'Alibaba (67,7). Lors du test FrontierSWE, Qwen3.8-Max occupe avec 73,5 points la deuxième place derrière GPT-5.6 Sol (88,8). Sur GPQA Diamond, un test de raisonnement logique, Qwen3.8-Max atteint 92,6 points, à égalité avec Claude Fable 5 (92,6) et derrière GPT-5.6 Sol (94,1).
Les benchmarks sont des tests standardisés qui mesurent les performances des modèles d'IA dans des tâches clairement définies comme la génération de code ou le raisonnement logique. Ils permettent des comparaisons entre systèmes de différents fournisseurs, mais ne reflètent que partiellement la pertinence pratique, car les tâches réelles diffèrent de l'environnement de test. Les observateurs du secteur interprètent néanmoins cette publication comme un signal que l'écart entre les développements d'IA chinois et américains s'est réduit.
Les open weights comme approche stratégique
Avec sa stratégie open weights, Alibaba adopte une approche différente de celle de ses concurrents directs américains. Alors qu'OpenAI mise avec GPT-5.6 Sol sur des systèmes fermés dont les poids internes ne sont pas publiés, Alibaba permet aux développeurs externes d'accéder aux paramètres du modèle. Cela facilite les adaptations autonomes, le déploiement local et les audits de sécurité indépendants. Des experts du secteur y voient un avantage concurrentiel sur les marchés ayant des exigences en matière de souveraineté des données, notamment en Europe.
Cette publication s'inscrit dans une série de sorties de modèles chinois. Outre Qwen3.8-Max, le modèle Kimi K3 se positionne également comme un concurrent pertinent dans le segment open weights. Les deux systèmes sont développés par des fournisseurs chinois qui misent de plus en plus sur les publications ouvertes afin de s'adresser aux communautés internationales de développeurs et de contribuer à façonner les normes technologiques.
Disponibilité et validation indépendante
Alibaba a annoncé la mise à disposition du modèle via sa plateforme cloud ainsi que sur la plateforme Hugging Face, où les développeuses et développeurs peuvent télécharger et faire évoluer ensemble des modèles d'IA. Ainsi, Qwen3.8-Max est immédiatement disponible après sa publication pour des tests et des applications en dehors de l'infrastructure Alibaba. Concernant les conditions de licence concrètes et les formes d'usage commercial autorisées, l'entreprise n'a pas fourni de précisions détaillées dans sa communication actuelle.
Les valeurs des benchmarks proviennent de quatre rapports indépendants qui classent le modèle Qwen3.8-Max de manière concordante avec les scores indiqués. Une validation par des tiers indépendants en dehors des tests d'Alibaba reste en attente pour les résultats mentionnés dans la communication. Les observateurs du secteur soulignent que des réplications indépendantes des résultats de benchmarks doivent être attendues avant que les performances de Qwen3.8-Max puissent être évaluées de manière définitive.
Avec Qwen3.8-Max, Alibaba intensifie la concurrence dans le segment des modèles d'IA dédiés au développement logiciel. Si les résultats des benchmarks se confirment dans des tests indépendants, le modèle représenterait une concurrence technologique face aux systèmes établis venus des États-Unis et diversifierait davantage le paysage mondial de l'IA.
La communauté européenne des développeurs accueille cette publication avec intérêt, car les modèles open weights sont particulièrement pertinents dans le cadre des exigences du Règlement général sur la protection des données (RGPD) et face aux préoccupations relatives au transfert de données vers des pays tiers. Avec Qwen3.8-Max, les développeuses et développeurs en Europe disposent désormais d'un autre modèle open weights performant, adapté à un déploiement local dans des centres de données européens.
Alibaba lance le modèle d'IA open weights Qwen3.8-Max… | actualites360