- Início
- 3 de ago. de 202690% DE CONFIANÇAde a fonte
Qwen3.8-Max é lançado
Traduzido automaticamente do original
Título original: Qwen3.8-Max Released
- A Alibaba lançou o Qwen3.8-Max em 3 de agosto de 2026, “o modelo mais poderoso de sua série Qwen até hoje”, na API Model Studio para desenvolvedores do mundo todo e em sua plataforma de agentes QwenWork, depois de uma prévia em julho[1][3]
- Ele ficou em quinto lugar na Text Arena, segundo na Vision Arena e quarto na Frontend Code Arena e, em um teste interno, programou de forma autônoma por 16 dias para construir e abrir o código do framework de agentes “oh-my-cli”[1][6]
- As ações da Alibaba listadas em Nova York subiram 4,5% no dia e as de Hong Kong, 7%[6]
- Os pesos vieram em 12 de agosto como Qwen3.8-2.4T-A95B, o primeiro Qwen da faixa Max liberado abertamente, sob uma licença que obriga provedores com receita acima de US$ 50 milhões a assinar uma licença comercial; o modelo aberto omite a entrada de imagem e o modo sem raciocínio, que o Qwen3.8-27B, sob Apache 2.0 (14 de agosto), mantém[3][5]
- Em 2 de setembro, a API
qwen3.8-maxpassou a um novo snapshot, o qwen3.8-max-0902, e em 23 de setembro a Alibaba acrescentou o Qwen3.8 Max Prime, uma faixa de maior vazão do mesmo modelo pelo dobro do preço[2][4]
Destaques
- Um modelo esparso de mistura de especialistas com mecanismo de atenção híbrido, construído sobre o Qwen 3.5: 2,4T de parâmetros no total com 95B ativados, 92 camadas e 512 especialistas (10 roteados mais 1 compartilhado por token)[1][5]
- Especificações: janela de contexto de 1 milhão de tokens com até 131.072 tokens de saída na API em nuvem (os pesos abertos rodam 262.144 tokens nativamente, extensíveis a 1.010.000), entrada de texto, imagem e vídeo, chamada de funções, saídas estruturadas, busca na web e cache de contexto[2][5]
- Nativamente multimodal: a Alibaba diz que ele pode transformar documentos de cem páginas, séries de televisão inteiras ou transmissões ao vivo de 100 horas em bases de conhecimento pesquisáveis e reconstruir um projeto de frontend a partir de uma única captura de tela[1]
- Preços por milhão de tokens: CNY 12 de entrada e CNY 36 de saída no Model Studio em Pequim; o Prime custa US$ 4 de entrada e US$ 12 de saída[2][4]
- A tabela de benchmarks da Alibaba o coloca em 86,6 no Terminal Bench 2.1 contra 84,6 do Fable 5 e 88,8 do GPT-5.6 Sol, e em 67,7 no SWE-bench Pro contra 80,0 do Fable 5[5]
Referências 781% DE CONFIANÇAConfiança geral: 81%Quanto a fonte e as referências do pin sustentam suas datas.Média ponderada de quanto 7 referências, incluindo a fonte, sustentam os horários de início e fim do pin; uma referência conta metade a cada 180 dias a mais em relação à mais recenteMostrar todos os pins com confiança de 75% ou mais
A primeira entrada é sempre a fonte do pin. A confiança geral é uma média ponderada de quanto cada referência sustenta os horários de início e fim usados acima; uma referência conta metade a cada 180 dias a mais em relação à mais recente.
- [1]90%alibabagroup.com/en-US/document-2021044032125272064alibabagroup.com· Postado em 28 de set. de 2026· Início 3 de ago. de 2026 ✓· 16% da pontuação
O comunicado do Alibaba Group é datado de “3 de agosto de 2026” e diz “O modelo já está acessível por APIs no Alibaba Cloud Model Studio para desenvolvedores do mundo todo, com os pesos do modelo previstos para lançamento na próxima semana”; a CNBC[6] informa que a Alibaba o “apresentou” “na segunda-feira”, 3 de agosto.
- [2]90%qwen3.8-max Model Info - Alibaba Cloud Model Studiohelp.aliyun.com· Adicionado em 28 de set. de 2026· 16% da pontuação
Alibaba Cloud's model page: model ID qwen3.8-max, now the snapshot qwen3.8-max-0902 (alias qwen3.8-max-2026-09-02); image, text and video input; a 1,000,000-token context window with 131,072 max output; function calling, structured outputs, web search and context caching; CNY 12 input and CNY 36 output per million tokens in Beijing.[1]
- [3]75%Qwen - Wikipediaen.wikipedia.org· Adicionado em 28 de set. de 2026· 16% da pontuação
Dates the cloud release to 3 August 2026, the open weights (Qwen3.8-2.4T-A95B, without image input or non-thinking mode) to 12 August, with a licence requiring providers earning more than US$50 million to get a commercial licence, and the Apache 2.0 Qwen3.8-27B to 14 August.[1]
- [4]70%Qwen3.8 Max Prime: Is it actually better? - DataNorth AIdatanorth.ai· Publicado em 24 de set. de 2026· 15% da pontuação
Reports that Alibaba's Qwen team released Qwen3.8 Max Prime on 23 September 2026 as a higher-throughput version of Qwen3.8 Max at $4 per million input and $12 per million output tokens, "exactly twice the price of the standard model", and that it was not measurably faster in OpenRouter's first measurements.[1]
- [5]90%Qwen/Qwen3.8-2.4T-A95B · Hugging Facehuggingface.co· Publicado em 12 de ago. de 2026· 13% da pontuação
The open-weights model card: "For the first time, Qwen3.8 brings a Qwen-Max-class model to open release"; 2.4T total and 95B activated parameters, 92 layers, 512 experts (10 routed + 1 shared), 262,144 tokens natively extensible to 1,010,000, and benchmarks against Opus 4.8, Fable 5 and GPT-5.6 Sol.[1]
Sugerir uma correção
Falta algo ou há um erro? Diga com suas palavras: um link que sustente este pin, uma data de início ou fim diferente e por quê, ou um fato que falta ou está errado. A IA confere isso com as fontes do pin, procura outras melhores e adiciona qualquer página que dê razão a você. As fontes do próprio pin continuam contando mais. Uma imagem que mostra outra coisa, ou mostra mal, também é analisada e rebaixada ou substituída.