- Inicio
- 3 ago 202690% DE CONFIANZAsegún la fuente
Alibaba lanza Qwen3.8-Max
Traducido automáticamente del original
Título original: Qwen3.8-Max Released
- Alibaba lanzó Qwen3.8-Max el 3 de agosto de 2026, "el modelo más potente de su serie Qwen hasta la fecha", en su API de Model Studio para desarrolladores globales y en su plataforma de agentes QwenWork, después de mostrarlo en vista previa en julio[1][3]
- Se clasificó quinto en Text Arena, segundo en Vision Arena y cuarto en Frontend Code Arena, y en una prueba interna programó de forma autónoma durante 16 días para construir y publicar como código abierto el framework de agentes "oh-my-cli"[1][6]
- Las acciones de Alibaba que cotizan en Nueva York subieron un 4,5% ese día y sus acciones de Hong Kong un 7%[6]
- Los pesos siguieron el 12 de agosto como Qwen3.8-2.4T-A95B, el primer Qwen de nivel Max publicado de forma abierta, bajo una licencia que obliga a los proveedores que ganan más de 50 millones de dólares a firmar una licencia comercial; el modelo abierto omite la entrada de imagen y el modo sin razonamiento, que el Qwen3.8-27B con licencia Apache 2.0 (14 de agosto) sí conserva[3][5]
- El 2 de septiembre la API
qwen3.8-maxpasó a un nuevo snapshot, qwen3.8-max-0902, y el 23 de septiembre Alibaba añadió Qwen3.8 Max Prime, un nivel de mayor rendimiento del mismo modelo al doble de precio[2][4]
Características destacadas
- Un modelo disperso de mezcla de expertos con un mecanismo de atención híbrido, construido sobre Qwen 3.5: 2,4T de parámetros totales con 95B activados, 92 capas y 512 expertos (10 enrutados más 1 compartido por token)[1][5]
- Especificaciones: una ventana de contexto de 1M de tokens con hasta 131.072 tokens de salida en la API en la nube (los pesos abiertos funcionan de forma nativa con 262.144 tokens, extensibles a 1.010.000), entrada de texto, imagen y video, llamadas a funciones, salidas estructuradas, búsqueda web y almacenamiento en caché de contexto[2][5]
- Nativamente multimodal: Alibaba dice que puede convertir documentos de cientos de páginas, series de televisión completas o retransmisiones en vivo de 100 horas en bases de conocimiento con capacidad de búsqueda, y reconstruir un proyecto frontend a partir de una sola captura de pantalla[1]
- Precios por millón de tokens: 12 CNY de entrada y 36 CNY de salida en Model Studio en Pekín; Prime cuesta 4 $ de entrada y 12 $ de salida[2][4]
- La tabla de benchmarks de Alibaba lo sitúa en 86,6 en Terminal Bench 2.1 frente al 84,6 de Fable 5 y el 88,8 de GPT-5.6 Sol, y en 67,7 en SWE-bench Pro frente al 80,0 de Fable 5[5]
Referencias 781% DE CONFIANZAConfianza general: 81%Hasta qué punto la fuente y las referencias del pin respaldan sus fechas.Media ponderada de la firmeza con la que 7 referencias, incluida la fuente, respaldan las horas de inicio y fin del pin; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más recienteMostrar todos los pines con un 75% de confianza o más
La primera entrada es siempre la fuente del pin. La confianza global es una media ponderada de la firmeza con la que cada referencia respalda las horas de inicio y fin usadas arriba; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más reciente.
- [1]90%alibabagroup.com/en-US/document-2021044032125272064alibabagroup.com· Publicado el 28 sept 2026· Empieza 3 ago 2026 ✓· 16% de la puntuación
El comunicado de Alibaba Group está fechado el "3 de agosto de 2026" y dice que "el modelo ya es accesible a través de las API en Alibaba Cloud Model Studio para desarrolladores globales, con los pesos del modelo previstos para publicarse la semana próxima"; CNBC[6] informa que Alibaba lo "presentó" "el lunes" 3 de agosto.
- [2]90%qwen3.8-max Model Info - Alibaba Cloud Model Studiohelp.aliyun.com· Añadido el 28 sept 2026· 16% de la puntuación
Alibaba Cloud's model page: model ID qwen3.8-max, now the snapshot qwen3.8-max-0902 (alias qwen3.8-max-2026-09-02); image, text and video input; a 1,000,000-token context window with 131,072 max output; function calling, structured outputs, web search and context caching; CNY 12 input and CNY 36 output per million tokens in Beijing.[1]
- [3]75%Qwen - Wikipediaen.wikipedia.org· Añadido el 28 sept 2026· 16% de la puntuación
Dates the cloud release to 3 August 2026, the open weights (Qwen3.8-2.4T-A95B, without image input or non-thinking mode) to 12 August, with a licence requiring providers earning more than US$50 million to get a commercial licence, and the Apache 2.0 Qwen3.8-27B to 14 August.[1]
- [4]70%Qwen3.8 Max Prime: Is it actually better? - DataNorth AIdatanorth.ai· Publicado el 24 sept 2026· 15% de la puntuación
Reports that Alibaba's Qwen team released Qwen3.8 Max Prime on 23 September 2026 as a higher-throughput version of Qwen3.8 Max at $4 per million input and $12 per million output tokens, "exactly twice the price of the standard model", and that it was not measurably faster in OpenRouter's first measurements.[1]
- [5]90%Qwen/Qwen3.8-2.4T-A95B · Hugging Facehuggingface.co· Publicado el 12 ago 2026· 13% de la puntuación
The open-weights model card: "For the first time, Qwen3.8 brings a Qwen-Max-class model to open release"; 2.4T total and 95B activated parameters, 92 layers, 512 experts (10 routed + 1 shared), 262,144 tokens natively extensible to 1,010,000, and benchmarks against Opus 4.8, Fable 5 and GPT-5.6 Sol.[1]
Sugerir una corrección
¿Falta algo o hay un error? Dilo con tus palabras: un enlace que respalde este pin, otra fecha de inicio o fin y por qué, o un dato que falta o está mal. La IA lo contrasta con las fuentes del pin, busca otras mejores y añade cualquier página que te dé la razón. Las fuentes del propio pin siguen contando más. La IA también mira las imágenes: una que muestra otra cosa, o la muestra mal, pasa al final o se sustituye.