- 시작
- 2026년 8월 3일신뢰도 90%출처 제공
Qwen3.8-Max 출시
원문에서 자동 번역됨
원본 제목: Qwen3.8-Max Released
- Alibaba는 2026년 8월 3일 “지금까지 Qwen 시리즈에서 가장 강력한 모델”인 Qwen3.8-Max를 전 세계 개발자를 위한 Model Studio API와 자사의 QwenWork 에이전트 플랫폼에서 출시했다. 이는 7월에 프리뷰를 진행한 뒤에 이뤄졌다.[1][3]
- Text Arena에서 5위, Vision Arena에서 2위, Frontend Code Arena에서 4위를 차지했으며, 한 내부 테스트에서는 16일 동안 자율적으로 코딩해 “oh-my-cli” 에이전트 프레임워크를 만들고 오픈소스로 공개했다.[1][6]
- Alibaba의 뉴욕 상장 주식은 당일 4.5%, 홍콩 상장 주식은 7% 올랐다.[6]
- 가중치는 8월 12일 Qwen3.8-2.4T-A95B라는 이름으로 공개돼, 처음으로 공개된 Max 등급 Qwen이 됐다. 연매출이 5,000만 달러를 넘는 제공업체는 상업용 라이선스에 서명해야 한다는 조건이 붙어 있다. 이 오픈 모델은 이미지 입력과 비사고(non-thinking) 모드를 제외했는데, 이는 Apache 2.0 라이선스로 나온 Qwen3.8-27B(8월 14일)에는 남아 있다.[3][5]
- 9월 2일
qwen3.8-maxAPI는 qwen3.8-max-0902라는 새 스냅숏으로 옮겨갔고, 9월 23일 Alibaba는 동일 모델을 두 배 가격으로 더 높은 처리량을 제공하는 등급인 Qwen3.8 Max Prime을 추가했다.[2][4]
주요 특징
- Qwen 3.5를 기반으로 한 하이브리드 어텐션 메커니즘의 희소 혼합전문가(MoE) 모델로, 전체 파라미터 2조 4,000억 개 중 950억 개가 활성화되며, 92개 레이어와 512개 전문가(토큰당 라우팅되는 10개와 공유되는 1개)로 구성된다.[1][5]
- 사양: 클라우드 API에서는 컨텍스트 윈도우 100만 토큰에 최대 출력 토큰 13만 1,072개(오픈 웨이트는 기본 26만 2,144토큰으로 작동하며 101만 토큰까지 확장 가능)이며, 텍스트·이미지·동영상 입력, 함수 호출, 구조화된 출력, 웹 검색, 컨텍스트 캐싱을 지원한다.[2][5]
- 네이티브 멀티모달 모델로, Alibaba는 수백 페이지 분량의 문서, TV 시리즈 전체, 100시간짜리 라이브스트림을 검색 가능한 지식 베이스로 바꾸고 스크린샷 한 장으로 프런트엔드 프로젝트를 재구성할 수 있다고 밝혔다.[1]
- 토큰 100만 개당 가격: 베이징 소재 Model Studio에서는 입력 12위안, 출력 36위안이며, Prime은 입력 4달러, 출력 12달러다.[2][4]
- Alibaba의 벤치마크 표에 따르면 Terminal Bench 2.1에서 86.6점으로 Fable 5의 84.6점과 GPT-5.6 Sol의 88.8점과 비교되며, SWE-bench Pro에서는 67.7점으로 Fable 5의 80.0점과 비교된다.[5]
참고자료 7신뢰도 81%종합 신뢰도: 81%핀의 출처와 참고 자료가 날짜를 얼마나 뒷받침하는지.출처를 포함한 자료 7건이 핀의 시작·종료 시각을 얼마나 강하게 뒷받침하는지에 대한 가중 평균. 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다신뢰도 75% 이상 핀 모두 보기
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]90%alibabagroup.com/en-US/document-2021044032125272064alibabagroup.com· 게시 2026년 9월 28일· 시작 2026년 8월 3일 ✓· 점수의 16%
Alibaba Group의 발표는 “2026년 8월 3일”로 날짜가 표시돼 있으며 “이 모델은 이제 전 세계 개발자를 위한 Alibaba Cloud Model Studio의 API를 통해 이용할 수 있으며, 모델 가중치는 다음 주 공개될 예정”이라고 밝혔다. CNBC[6]는 Alibaba가 8월 3일 “월요일” 이를 “공개했다”고 전했다.
- [2]90%qwen3.8-max Model Info - Alibaba Cloud Model Studiohelp.aliyun.com· 추가 2026년 9월 28일· 점수의 16%
Alibaba Cloud's model page: model ID qwen3.8-max, now the snapshot qwen3.8-max-0902 (alias qwen3.8-max-2026-09-02); image, text and video input; a 1,000,000-token context window with 131,072 max output; function calling, structured outputs, web search and context caching; CNY 12 input and CNY 36 output per million tokens in Beijing.[1]
- [3]75%Qwen - Wikipediaen.wikipedia.org· 추가 2026년 9월 28일· 점수의 16%
Dates the cloud release to 3 August 2026, the open weights (Qwen3.8-2.4T-A95B, without image input or non-thinking mode) to 12 August, with a licence requiring providers earning more than US$50 million to get a commercial licence, and the Apache 2.0 Qwen3.8-27B to 14 August.[1]
- [4]70%Qwen3.8 Max Prime: Is it actually better? - DataNorth AIdatanorth.ai· 게재 2026년 9월 24일· 점수의 15%
Reports that Alibaba's Qwen team released Qwen3.8 Max Prime on 23 September 2026 as a higher-throughput version of Qwen3.8 Max at $4 per million input and $12 per million output tokens, "exactly twice the price of the standard model", and that it was not measurably faster in OpenRouter's first measurements.[1]
- [5]90%Qwen/Qwen3.8-2.4T-A95B · Hugging Facehuggingface.co· 게재 2026년 8월 12일· 점수의 13%
The open-weights model card: "For the first time, Qwen3.8 brings a Qwen-Max-class model to open release"; 2.4T total and 95B activated parameters, 92 layers, 512 experts (10 routed + 1 shared), 262,144 tokens natively extensible to 1,010,000, and benchmarks against Opus 4.8, Fable 5 and GPT-5.6 Sol.[1]
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다. AI는 이미지도 확인합니다. 다른 것을 보여주거나 제대로 보여주지 못하는 이미지는 뒤로 옮기거나 교체합니다.