
Avec une architecture de 2 400 milliards de paramètres, l’entreprise chinoise affirme qu’il peut exécuter des tâches complexes sur de longues périodes grâce à ses capacités d’autonomie.
Alibaba a dévoilé lundi 3 août une version de son modèle IA, Qwen 3.8-Max, dans un contexte de compétition toujours plus intense entre les grands acteurs mondiaux du secteur, notamment américains et chinois. Le modèle repose sur une architecture annoncée à 2 400 milliards de paramètres et adopte une approche de type « Mixture of Experts » (MoE). Cette technique consiste à n’activer qu’une partie des paramètres du modèle lors du traitement d’une requête. Selon Reuters, dans le cas de Qwen 3.8-Max, environ 95 milliards de paramètres seraient activés simultanément sur les 2 400 milliards que compte l’architecture complète. Le modèle disposerait également d’une fenêtre de contexte d’un million de tokens, ce qui lui permet de traiter des volumes importants d’informations au sein d’une même interaction.
Selon Alibaba, Qwen 3.8-Max figure parmi les modèles IA les plus avancés actuellement disponibles. L’entreprise affirme qu’il rivalise avec les meilleures solutions du marché et qu’il n’est dépassé que par quelques systèmes de pointe.
Une IA multimodale conçue pour les agents autonomes
Comme les précédentes générations de la famille Qwen, Qwen 3.8-Max couvre un large éventail d’usages : génération et analyse de texte, programmation, traitement de documents ou encore automatisation de tâches complexes. Alibaba met toutefois l’accent sur une évolution avec le passage d’une IA capable de répondre à des questions vers un système capable de piloter un processus de travail complet. Le modèle aurait ainsi été évalué dans des scénarios nécessitant de planifier plusieurs étapes, d’utiliser des outils externes et d’adapter ses actions en fonction des résultats obtenus. L’un des exemples avancés par Alibaba concerne le développement logiciel autonome. Selon l’entreprise, Qwen 3.8-Max aurait été capable de travailler pendant plus de dix jours sur un projet informatique en partant d’un environnement vierge, en générant du code, en corrigeant des erreurs et en améliorant progressivement le résultat. Cette démonstration illustre une tendance forte du secteur : le développement d’agents IA capables de fonctionner sur des cycles longs, au-delà de la simple production d’une réponse ponctuelle.
Alibaba met également en avant les résultats obtenus par son modèle sur plusieurs tests d’évaluation. Sur PaperBench, qui mesure la capacité d’une IA à reproduire en code les résultats d’un article scientifique, Qwen 3.8-Max aurait obtenu un score de 93,0 sur 100, contre 88,8 pour Fable 5 d’Anthropic et 80,3 pour Claude Opus 4.8. Sur OSWorld, un benchmark évaluant la capacité d’un modèle à utiliser un ordinateur comme un humain, Qwen 3.8-Max aurait atteint 86,1, soit le meilleur score annoncé parmi les modèles testés.
Le retour de l’open-weight
L’un des éléments les plus commentés de cette annonce concerne le choix d’Alibaba de revenir à une stratégie « open-weight ». L’entreprise a indiqué que les poids de Qwen 3.8-Max seraient prochainement mis à disposition des développeurs, afin de leur permettre de personnaliser le modèle, de l’adapter à leurs besoins et de le déployer sur leurs propres infrastructures. Au moment du lancement, cette ouverture n’était toutefois pas encore effective : le modèle était uniquement accessible via l’API proposée par Alibaba. La mise à disposition des poids a été annoncée pour la semaine suivante,