
Alibaba dévoile Qwen3.8-Max, un modèle d'IA de 2,4 billions de paramètres qui rivalise avec Anthropic et OpenAI sur des benchmarks clés
Le nouveau modèle à poids ouverts du géant technologique chinois s'est classé deuxième mondial pour l'analyse visuelle sur Arena.AI et a égalé GPT-5.6 Sol et Fable 5 sur plusieurs benchmarks textuels, intensifiant la course à l'IA entre les États-Unis et la Chine.
Alibaba a dévoilé lundi Qwen3.8-Max, le décrivant comme son modèle d'intelligence artificielle le plus grand et le plus performant à ce jour. Le système compte 2,4 billions de paramètres, utilise une architecture de mixture d'experts qui n'active que 95 milliards de paramètres par requête, et peut traiter jusqu'à 1 million de jetons à la fois. Alibaba a indiqué qu'il publiera les poids du modèle la semaine prochaine via la plateforme Model Studio d'Alibaba Cloud, marquant un retour aux versions à poids ouverts après un bref virage vers des modèles propriétaires plus tôt cette année.
Positionnement dans les benchmarks
Sur la plateforme de comparaison participative Arena.AI, Qwen3.8-Max est immédiatement devenu le modèle chinois le mieux classé pour les tâches textuelles, bien qu'il soit encore derrière le Claude Fable 5 d'Anthropic et trois variantes Opus. Pour l'analyse visuelle, il s'est classé deuxième mondial, derrière seulement une variante de Fable 5. En codage front-end, il n'a été battu que par deux modèles Opus et le Kimi K3 de Moonshot AI. Les propres tests internes d'Alibaba ont montré que le modèle égalait, et parfois dépassait, Fable 5 et GPT-5.6 Sol d'OpenAI sur plusieurs benchmarks, les surpassant tous deux en raisonnement visuel et en utilisation agentique d'ordinateur.
Exécution autonome de tâches
Alibaba a mis en avant la capacité du modèle à gérer des tâches agentiques à long horizon avec une intervention humaine minimale. Dans un test interne, Qwen3.8-Max a travaillé de manière autonome pendant environ 125 heures (près de cinq jours) pour reproduire une expérience décrite dans un article de recherche. À partir du seul article, le modèle a créé tout le code nécessaire à partir de zéro, analysé les données, exécuté l'expérience et rapporté les résultats. Alibaba a qualifié cela d'exactement le type de travail qui prend des jours à des ingénieurs qualifiés. L'entreprise a également indiqué que le modèle avait réalisé un projet de génie logiciel en 16 jours.
Paysage concurrentiel
Qwen3.8-Max arrive dans un domaine où les laboratoires chinois réduisent rapidement l'écart avec les développeurs américains de pointe. Moonshot AI a lancé son modèle Kimi K3 le mois dernier avec 2,8 billions de paramètres, et a publié des résultats de tests indiquant qu'il suivait également de près les systèmes américains les plus avancés. Contrairement à OpenAI, Anthropic et Google, qui ne divulguent pas le nombre de paramètres de leurs modèles propriétaires, les entreprises chinoises publient régulièrement ces chiffres pour gagner en popularité auprès des développeurs. Les versions à poids ouverts sont devenues une norme dans l'industrie chinoise de l'IA et un point de différenciation croissant.
Tarification et réaction du marché
Alibaba a fixé le prix de Qwen3.8-Max à 2 $ par million de jetons d'entrée et 6 $ par million de jetons de sortie, sous-cotant nettement le Fable 5 d'Anthropic, qui coûte 10 $ par million de jetons d'entrée et 50 $ par million de jetons de sortie. Les actions d'Alibaba cotées aux États-Unis ont augmenté d'environ 3,5 % dans les échanges avant l'ouverture après l'annonce.
Contexte géopolitique
Ce lancement ajoute aux tensions dans la Silicon Valley et à Washington sur la manière de conserver l'avance technologique américaine. Les restrictions américaines à l'exportation de puces avancées et d'équipements de fabrication de semi-conducteurs, commencées en 2022 et renforcées par la suite, visaient à ralentir les progrès de l'IA en Chine. Plusieurs analystes ont noté que les restrictions ont plutôt poussé la Chine à réduire sa dépendance à la technologie américaine, des modèles comme Qwen3.8-Max démontrant que l'écart s'est considérablement réduit.
- Qwen3.8-Max (Alibaba)
- 2.4 billions de paramètres
- Kimi K3 (Moonshot AI)
- 2.8 billions de paramètres
- Entrée Qwen3.8-Max
- 2 $
- Sortie Qwen3.8-Max
- 6 $
- Entrée Fable 5
- 10 $
- Sortie Fable 5
- 50 $


