- Bắt đầu
- 3 thg 8, 2026ĐỘ TIN CẬY 90%từ nguồn
Qwen3.8-Max ra mắt
Được dịch tự động từ bản gốc
Tiêu đề gốc: Qwen3.8-Max Released
- Ngày 3 tháng 8 năm 2026, Alibaba ra mắt Qwen3.8-Max, “mô hình mạnh nhất trong dòng Qwen của hãng cho đến nay”, trên API Model Studio dành cho nhà phát triển toàn cầu và trong nền tảng tác tử QwenWork, sau khi xem trước vào tháng 7[1][3]
- Mô hình đứng thứ năm trên Text Arena, thứ hai trên Vision Arena và thứ tư trên Frontend Code Arena, và trong một bài kiểm tra nội bộ đã tự động viết mã suốt 16 ngày để xây dựng và mở mã nguồn khung tác tử “oh-my-cli”[1][6]
- Cổ phiếu Alibaba niêm yết tại New York tăng 4.5% trong ngày và cổ phiếu tại Hồng Kông tăng 7%[6]
- Trọng số được công bố sau đó vào ngày 12 tháng 8 với tên Qwen3.8-2.4T-A95B, Qwen cấp Max đầu tiên được phát hành mở, theo một giấy phép yêu cầu các nhà cung cấp có doanh thu hơn 50 triệu đô la Mỹ phải ký giấy phép thương mại; mô hình mở bỏ đầu vào hình ảnh và chế độ không suy nghĩ, những thứ mà Qwen3.8-27B theo giấy phép Apache 2.0 (14 tháng 8) vẫn giữ[3][5]
- Ngày 2 tháng 9, API
qwen3.8-maxchuyển sang một bản chụp mới, qwen3.8-max-0902, và ngày 23 tháng 9 Alibaba bổ sung Qwen3.8 Max Prime, một gói thông lượng cao hơn của cùng mô hình với giá gấp đôi[2][4]
Tính năng nổi bật
- Một mô hình kết hợp nhiều chuyên gia thưa với cơ chế chú ý lai, xây dựng trên Qwen 3.5: tổng 2.4T tham số với 95B được kích hoạt, 92 lớp và 512 chuyên gia (10 chuyên gia được định tuyến cộng 1 chuyên gia dùng chung cho mỗi token)[1][5]
- Thông số: cửa sổ ngữ cảnh 1M token với tối đa 131,072 token đầu ra trên API đám mây (trọng số mở chạy nguyên bản 262,144 token, có thể mở rộng đến 1,010,000), nhận đầu vào văn bản, hình ảnh và video, gọi hàm, đầu ra có cấu trúc, tìm kiếm web và lưu đệm ngữ cảnh[2][5]
- Đa phương thức nguyên bản: Alibaba nói mô hình có thể biến các tài liệu hàng trăm trang, toàn bộ series truyền hình hay các buổi phát trực tiếp dài 100 giờ thành cơ sở tri thức có thể tìm kiếm, và dựng lại một dự án giao diện người dùng từ một ảnh chụp màn hình[1]
- Giá cho mỗi triệu token: 12 nhân dân tệ đầu vào và 36 nhân dân tệ đầu ra trên Model Studio ở Bắc Kinh; Prime có giá 4 đô la đầu vào và 12 đô la đầu ra[2][4]
- Bảng điểm chuẩn của Alibaba xếp mô hình ở mức 86.6 trên Terminal Bench 2.1 so với 84.6 của Fable 5 và 88.8 của GPT-5.6 Sol, và 67.7 trên SWE-bench Pro so với 80.0 của Fable 5[5]
Tài liệu tham khảo 7ĐỘ TIN CẬY 81%Độ tin cậy tổng thể: 81%Mức độ nguồn và tài liệu tham khảo của ghim củng cố các ngày của nó.Trung bình có trọng số về mức độ 7 tài liệu, gồm cả nguồn, ủng hộ thời điểm bắt đầu và kết thúc của ghim; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhấtHiện tất cả ghim có độ tin cậy từ 75% trở lên
Mục đầu tiên luôn là nguồn của ghim. Độ tin cậy tổng thể là trung bình có trọng số về mức độ mỗi tài liệu ủng hộ thời điểm bắt đầu và kết thúc được dùng ở trên; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhất.
- [1]90%alibabagroup.com/en-US/document-2021044032125272064alibabagroup.com· Đăng 28 thg 9, 2026· Bắt đầu 3 thg 8, 2026 ✓· 16% điểm số
Thông cáo của Alibaba Group đề ngày “August 3, 2026” và nói “Mô hình hiện có thể truy cập qua API trên Alibaba Cloud Model Studio cho nhà phát triển toàn cầu, với trọng số mô hình dự kiến phát hành vào tuần tới”; CNBC[6] đưa tin Alibaba đã “công bố” mô hình “vào Thứ Hai” ngày 3 tháng 8.
- [2]90%qwen3.8-max Model Info - Alibaba Cloud Model Studiohelp.aliyun.com· Thêm 28 thg 9, 2026· 16% điểm số
Alibaba Cloud's model page: model ID qwen3.8-max, now the snapshot qwen3.8-max-0902 (alias qwen3.8-max-2026-09-02); image, text and video input; a 1,000,000-token context window with 131,072 max output; function calling, structured outputs, web search and context caching; CNY 12 input and CNY 36 output per million tokens in Beijing.[1]
- [3]75%Qwen - Wikipediaen.wikipedia.org· Thêm 28 thg 9, 2026· 16% điểm số
Dates the cloud release to 3 August 2026, the open weights (Qwen3.8-2.4T-A95B, without image input or non-thinking mode) to 12 August, with a licence requiring providers earning more than US$50 million to get a commercial licence, and the Apache 2.0 Qwen3.8-27B to 14 August.[1]
- [4]70%Qwen3.8 Max Prime: Is it actually better? - DataNorth AIdatanorth.ai· Xuất bản 24 thg 9, 2026· 15% điểm số
Reports that Alibaba's Qwen team released Qwen3.8 Max Prime on 23 September 2026 as a higher-throughput version of Qwen3.8 Max at $4 per million input and $12 per million output tokens, "exactly twice the price of the standard model", and that it was not measurably faster in OpenRouter's first measurements.[1]
- [5]90%Qwen/Qwen3.8-2.4T-A95B · Hugging Facehuggingface.co· Xuất bản 12 thg 8, 2026· 13% điểm số
The open-weights model card: "For the first time, Qwen3.8 brings a Qwen-Max-class model to open release"; 2.4T total and 95B activated parameters, 92 layers, 512 experts (10 routed + 1 shared), 262,144 tokens natively extensible to 1,010,000, and benchmarks against Opus 4.8, Fable 5 and GPT-5.6 Sol.[1]
Đề xuất chỉnh sửa
Thiếu hay sai điều gì? Hãy nói bằng lời của bạn: một liên kết củng cố ghim này, một ngày bắt đầu hoặc kết thúc khác kèm lý do, hoặc một thông tin còn thiếu hay sai. AI đối chiếu với các nguồn của ghim này, tìm nguồn tốt hơn và thêm mọi trang ủng hộ bạn. Các nguồn của chính ghim vẫn được tính nhiều nhất. Hình ảnh thể hiện nội dung khác hoặc thể hiện kém cũng được xem xét, rồi bị hạ xuống hoặc thay thế.