Présentation de Qwen3.8-Max

Alibaba a présenté Qwen3.8-Max, un nouveau modèle de langage basé sur son série Qwen. Ce modèle est doté de 2,4 billions de paramètres, soit environ sept fois plus que le modèle Qwen3.5 présenté en février. Lorsqu’il répond à une requête, Qwen3.8-Max active 95 milliards de ses paramètres.

Architecture et fonctionnement

Qwen3.8-Max prend en charge des invites avec jusqu’à 1 million de jetons de données. Selon Alibaba, cela permet au modèle d’analyser plus de 200 pages de texte ou environ 100 heures de footage par requête. Les réponses aux invites contiennent jusqu’à 131 000 jetons.

Alibaba n’a pas encore partagé une vue d’ensemble détaillée de l’architecture de Qwen3.8-Max. Les modèles précédents, Qwen3.5 et Qwen3.6, partageaient certaines propriétés techniques, notamment un mécanisme d’attention appelé Gated DeltaNet. Il est possible que Qwen3.8-Max utilise également cette technologie.

Évaluation et performances

Alibaba a évalué les capacités de Qwen3.8-Max dans plusieurs tests avant sa présentation. Selon l’entreprise, le modèle a réussi à compléter un projet de codage de 16 jours sans intervention humaine. Dans un autre test, Qwen3.8-Max a effectué une tâche d’optimisation de conception de puces composée de plus de 500 étapes.

Le modèle a obtenu 1 668 points sur un benchmark appelé Frontend Code Arena, qui mesure les compétences de développement d’interface des modèles de langage. Cela le place à seulement 37 points derrière la configuration la plus avancée de Claude Opus 5, le dernier modèle de langage d’Anthropic PBC. Qwen3.8-Max a surpassé plus d’une douzaine d’autres modèles de pointe, notamment le modèle Muse Spark 1.1 de Meta Platforms Inc.

Mise à disposition et ouverture du code source

Qwen3.8-Max est disponible via la plateforme cloud d’Alibaba dès sa sortie. L’entreprise prévoit de rendre le code source ouvert la semaine prochaine, ainsi qu’une version plus petite et plus efficace en termes de matériel appelée Qwen3.8-27B.

Qwen3.8-Max est doté de 2,4 billions de paramètres
Qwen3.8-Max prend en charge des invites avec jusqu’à 1 million de jetons de données