- Début
- 3 août 2026CONFIANCE 90 %selon la source
Sortie de Qwen3.8-Max
Traduit automatiquement de l’original
Titre original: Qwen3.8-Max Released
- Alibaba a lancé Qwen3.8-Max le 3 août 2026, « le modèle le plus puissant de sa série Qwen à ce jour », sur son API Model Studio pour les développeurs du monde entier et dans sa plateforme d'agents QwenWork, après un aperçu en juillet[1][3]
- Il s'est classé cinquième dans Text Arena, deuxième dans Vision Arena et quatrième dans Frontend Code Arena, et lors d'un test interne, il a codé de manière autonome pendant 16 jours pour construire et publier en open source le framework d'agent « oh-my-cli »[1][6]
- L'action d'Alibaba cotée à New York a grimpé de 4,5 % ce jour-là, et son action de Hong Kong de 7 %[6]
- Les poids ont suivi le 12 août sous le nom Qwen3.8-2.4T-A95B, le premier Qwen de rang Max publié ouvertement, sous une licence qui impose aux fournisseurs générant plus de 50 millions de dollars de revenus de signer une licence commerciale ; le modèle ouvert omet l'entrée image et le mode sans réflexion, que conserve le Qwen3.8-27B sous licence Apache 2.0 (14 août)[3][5]
- Le 2 septembre, l'API
qwen3.8-maxest passée à un nouveau cliché, qwen3.8-max-0902, et le 23 septembre, Alibaba a ajouté Qwen3.8 Max Prime, une formule à plus haut débit du même modèle, à un prix double[2][4]
Caractéristiques notables
- Un modèle à mélange d'experts épars avec un mécanisme d'attention hybride, construit sur Qwen 3.5 : 2,4 billions de paramètres au total dont 95 milliards activés, 92 couches et 512 experts (10 routés plus 1 partagé par jeton)[1][5]
- Caractéristiques : une fenêtre de contexte de 1 million de jetons avec jusqu'à 131 072 jetons de sortie sur l'API cloud (les poids ouverts fonctionnent nativement sur 262 144 jetons, extensibles à 1 010 000), entrée texte, image et vidéo, appel de fonctions, sorties structurées, recherche web et mise en cache du contexte[2][5]
- Nativement multimodal : Alibaba affirme qu'il peut transformer des documents de cent pages, des séries télévisées entières ou des diffusions en direct de 100 heures en bases de connaissances consultables, et reconstruire un projet front-end à partir d'une seule capture d'écran[1]
- Tarifs par million de jetons : 12 CNY en entrée et 36 CNY en sortie sur Model Studio à Pékin ; Prime coûte 4 $ en entrée et 12 $ en sortie[2][4]
- Le tableau de comparaison d'Alibaba lui attribue 86,6 sur Terminal Bench 2.1 contre 84,6 pour Fable 5 et 88,8 pour GPT-5.6 Sol, et 67,7 sur SWE-bench Pro contre 80,0 pour Fable 5[5]
Références 7CONFIANCE 81 %Confiance globale: 81%Dans quelle mesure la source et les références du pin étayent ses dates.Moyenne pondérée de la fermeté avec laquelle 7 références, source comprise, étayent les heures de début et de fin de l’épingle ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récenteAfficher toutes les épingles à 75 % de confiance ou plus
La première entrée est toujours la source de l’épingle. La confiance globale est une moyenne pondérée de la fermeté avec laquelle chaque référence étaye les heures de début et de fin retenues ci-dessus ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récente.
- [1]90%alibabagroup.com/en-US/document-2021044032125272064alibabagroup.com· Publié le 28 sept. 2026· Début 3 août 2026 ✓· 16 % du score
Le communiqué du groupe Alibaba est daté du '3 août 2026' et dit 'Le modèle est désormais accessible via des API sur Alibaba Cloud Model Studio pour les développeurs du monde entier, la publication des poids du modèle étant prévue la semaine suivante' ; CNBC[6] rapporte qu'Alibaba l'a 'dévoilé' 'lundi' 3 août.
- [2]90%qwen3.8-max Model Info - Alibaba Cloud Model Studiohelp.aliyun.com· Ajouté le 28 sept. 2026· 16 % du score
Alibaba Cloud's model page: model ID qwen3.8-max, now the snapshot qwen3.8-max-0902 (alias qwen3.8-max-2026-09-02); image, text and video input; a 1,000,000-token context window with 131,072 max output; function calling, structured outputs, web search and context caching; CNY 12 input and CNY 36 output per million tokens in Beijing.[1]
- [3]75%Qwen - Wikipediaen.wikipedia.org· Ajouté le 28 sept. 2026· 16 % du score
Dates the cloud release to 3 August 2026, the open weights (Qwen3.8-2.4T-A95B, without image input or non-thinking mode) to 12 August, with a licence requiring providers earning more than US$50 million to get a commercial licence, and the Apache 2.0 Qwen3.8-27B to 14 August.[1]
- [4]70%Qwen3.8 Max Prime: Is it actually better? - DataNorth AIdatanorth.ai· Publié le 24 sept. 2026· 15 % du score
Reports that Alibaba's Qwen team released Qwen3.8 Max Prime on 23 September 2026 as a higher-throughput version of Qwen3.8 Max at $4 per million input and $12 per million output tokens, "exactly twice the price of the standard model", and that it was not measurably faster in OpenRouter's first measurements.[1]
- [5]90%Qwen/Qwen3.8-2.4T-A95B · Hugging Facehuggingface.co· Publié le 12 août 2026· 13 % du score
The open-weights model card: "For the first time, Qwen3.8 brings a Qwen-Max-class model to open release"; 2.4T total and 95B activated parameters, 92 layers, 512 experts (10 routed + 1 shared), 262,144 tokens natively extensible to 1,010,000, and benchmarks against Opus 4.8, Fable 5 and GPT-5.6 Sol.[1]
Suggérer une correction
Il manque quelque chose ou une erreur s'est glissée ? Dites-le avec vos mots : un lien qui étaye cette épingle, une autre date de début ou de fin et pourquoi, ou une information absente ou erronée. L'IA la vérifie au regard des sources de l'épingle, en cherche de meilleures et ajoute toute page qui vous donne raison. Les sources de l'épingle restent celles qui comptent le plus. L'IA regarde aussi les images : une image qui montre autre chose, ou qui le montre mal, passe en dernier ou est remplacée.