- Beginn
- 3. Aug. 202690 % SICHERHEITlaut der Quelle
Qwen3.8-Max veröffentlicht
Automatisch aus dem Original übersetzt
Originaltitel: Qwen3.8-Max Released
- Alibaba brachte Qwen3.8-Max am 3. August 2026 heraus, „das leistungsstärkste Modell seiner Qwen-Serie bis heute“, auf seiner Model-Studio-API für globale Entwickler und in seiner Agentenplattform QwenWork, nachdem es im Juli bereits eine Vorschau gezeigt hatte[1][3]
- Es belegte Platz fünf in der Text Arena, Platz zwei in der Vision Arena und Platz vier in der Frontend Code Arena, und codierte in einem internen Test 16 Tage lang eigenständig, um das Agenten-Framework „oh-my-cli“ zu erstellen und als Open Source zu veröffentlichen[1][6]
- Alibabas in New York gelistete Aktien stiegen an diesem Tag um 4,5 %, die Hongkonger Aktien um 7 %[6]
- Die Gewichte folgten am 12. August als Qwen3.8-2.4T-A95B, der erste offen veröffentlichte Qwen der Max-Stufe, unter einer Lizenz, die Anbieter mit mehr als 50 Millionen US-Dollar Umsatz zur Unterschrift einer kommerziellen Lizenz verpflichtet; dem offenen Modell fehlen Bildeingabe und der Nicht-Denk-Modus, die das Apache-2.0-Modell Qwen3.8-27B (14. August) behält[3][5]
- Am 2. September wechselte die API
qwen3.8-maxauf einen neuen Snapshot, qwen3.8-max-0902, und am 23. September fügte Alibaba Qwen3.8 Max Prime hinzu, eine Durchsatz-stärkere Stufe desselben Modells zum doppelten Preis[2][4]
Bemerkenswerte Merkmale
- Ein Sparse-Mixture-of-Experts-Modell mit einem hybriden Attention-Mechanismus, aufgebaut auf Qwen 3.5: 2,4 Billionen Parameter insgesamt mit 95 Milliarden aktivierten, 92 Schichten und 512 Experten (10 gerouteten plus 1 gemeinsam genutzten pro Token)[1][5]
- Spezifikationen: ein 1-Millionen-Token-Kontextfenster mit bis zu 131.072 Ausgabetokens auf der Cloud-API (die offenen Gewichte laufen nativ mit 262.144 Tokens, erweiterbar auf 1.010.000), Text-, Bild- und Videoeingabe, Funktionsaufrufe, strukturierte Ausgaben, Websuche und Context Caching[2][5]
- Nativ multimodal: Alibaba zufolge kann es hundertseitige Dokumente, ganze Fernsehserien oder 100-stündige Livestreams in durchsuchbare Wissensdatenbanken verwandeln und ein Frontend-Projekt aus einem einzigen Screenshot rekonstruieren[1]
- Preise pro Million Tokens: 12 CNY Eingabe und 36 CNY Ausgabe auf Model Studio in Peking; Prime kostet 4 $ Eingabe und 12 $ Ausgabe[2][4]
- Alibabas Benchmark-Tabelle setzt es bei 86,6 auf Terminal Bench 2.1 an, gegenüber 84,6 bei Fable 5 und 88,8 bei GPT-5.6 Sol, und bei 67,7 auf SWE-bench Pro gegenüber 80,0 bei Fable 5[5]
Belege 781 % SICHERHEITGesamtvertrauen: 81%Wie gut die Quelle und die Belege des Pins seine Termine stützen.Gewichteter Durchschnitt, wie fest 7 Belege einschließlich der Quelle die Start- und Endzeiten des Pins stützen; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so vielAlle Pins mit mindestens 75 % Sicherheit anzeigen
Der erste Eintrag ist immer die Quelle des Pins. Die Gesamtsicherheit ist ein gewichteter Durchschnitt, wie fest jeder Beleg die oben verwendeten Start- und Endzeiten stützt; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so viel.
- [1]90%alibabagroup.com/en-US/document-2021044032125272064alibabagroup.com· Gepostet am 28. Sept. 2026· Beginn 3. Aug. 2026 ✓· 16 % der Wertung
Alibaba Groups Meldung ist auf „August 3, 2026“ datiert und sagt, „Das Modell ist jetzt über APIs im Alibaba Cloud Model Studio für globale Entwickler zugänglich, die Modellgewichte sollen kommende Woche veröffentlicht werden“; CNBC[6] berichtet, Alibaba habe es „am Montag“, dem 3. August, vorgestellt.
- [2]90%qwen3.8-max Model Info - Alibaba Cloud Model Studiohelp.aliyun.com· Hinzugefügt am 28. Sept. 2026· 16 % der Wertung
Alibaba Cloud's model page: model ID qwen3.8-max, now the snapshot qwen3.8-max-0902 (alias qwen3.8-max-2026-09-02); image, text and video input; a 1,000,000-token context window with 131,072 max output; function calling, structured outputs, web search and context caching; CNY 12 input and CNY 36 output per million tokens in Beijing.[1]
- [3]75%Qwen - Wikipediaen.wikipedia.org· Hinzugefügt am 28. Sept. 2026· 16 % der Wertung
Dates the cloud release to 3 August 2026, the open weights (Qwen3.8-2.4T-A95B, without image input or non-thinking mode) to 12 August, with a licence requiring providers earning more than US$50 million to get a commercial licence, and the Apache 2.0 Qwen3.8-27B to 14 August.[1]
- [4]70%Qwen3.8 Max Prime: Is it actually better? - DataNorth AIdatanorth.ai· Veröffentlicht am 24. Sept. 2026· 15 % der Wertung
Reports that Alibaba's Qwen team released Qwen3.8 Max Prime on 23 September 2026 as a higher-throughput version of Qwen3.8 Max at $4 per million input and $12 per million output tokens, "exactly twice the price of the standard model", and that it was not measurably faster in OpenRouter's first measurements.[1]
- [5]90%Qwen/Qwen3.8-2.4T-A95B · Hugging Facehuggingface.co· Veröffentlicht am 12. Aug. 2026· 13 % der Wertung
The open-weights model card: "For the first time, Qwen3.8 brings a Qwen-Max-class model to open release"; 2.4T total and 95B activated parameters, 92 layers, 512 experts (10 routed + 1 shared), 262,144 tokens natively extensible to 1,010,000, and benchmarks against Opus 4.8, Fable 5 and GPT-5.6 Sol.[1]
Korrektur vorschlagen
Fehlt etwas oder stimmt etwas nicht? Sag es in deinen eigenen Worten: ein Link, der diesen Pin belegt, ein anderes Start- oder Enddatum und warum, oder eine Angabe, die fehlt oder falsch ist. Die KI prüft es an den Quellen dieses Pins, sucht nach besseren und ergänzt jede Seite, die dich bestätigt. Die eigenen Quellen des Pins zählen weiterhin am meisten. Auch Bilder sieht sich die KI an: Eines, das etwas anderes oder die Sache schlecht zeigt, wird nach hinten gestellt oder ersetzt.