- 開始
- 2026年8月3日確度 90%出典:出典
Qwen3.8-Maxがリリース
原文から自動翻訳されています
元のタイトル: Qwen3.8-Max Released
- アリババは2026年8月3日、7月にプレビューを行った後、「Qwenシリーズ史上最も強力なモデル」であるQwen3.8-Maxを、世界の開発者向けのModel Studio APIとエージェントプラットフォームQwenWorkでローンチした。[1][3]
- Text Arenaで5位、Vision Arenaで2位、Frontend Code Arenaで4位となった。ある社内テストでは、16日間自律的にコーディングを行い、「oh-my-cli」エージェントフレームワークを構築してオープンソース化した。[1][6]
- アリババのニューヨーク上場株はこの日4.5%上昇し、香港上場株は7%上昇した。[6]
- ウェイトは8月12日にQwen3.8-2.4T-A95Bとして公開され、初めて公開されたMaxクラスのQwenとなった。ライセンスでは、収益が5,000万米ドルを超えるプロバイダーは商用ライセンスに署名する必要がある。このオープンモデルは画像入力とnon-thinkingモードを省いているが、Apache 2.0のQwen3.8-27B(8月14日)にはこれらが残されている。[3][5]
- 9月2日、
qwen3.8-maxAPIは新しいスナップショットqwen3.8-max-0902に移行し、9月23日にはアリババが、同モデルのより高スループットな階層で価格が2倍のQwen3.8 Max Primeを追加した。[2][4]
注目の機能
- Qwen 3.5をベースに構築された、ハイブリッド注意機構を持つスパースなmixture-of-expertsモデルで、総パラメータ数2.4兆のうち950億が活性化し、92層、512のエキスパート(トークンごとにルーティングされる10個と共有の1個)を持つ。[1][5]
- 仕様: クラウドAPIではコンテキストウィンドウ100万トークン、出力は最大131,072トークン(オープンウェイト版はネイティブで262,144トークン、拡張時は1,010,000トークンまで対応)、テキスト・画像・動画の入力、関数呼び出し、構造化出力、ウェブ検索、コンテキストキャッシングに対応する。[2][5]
- ネイティブなマルチモーダル対応であり、アリババによれば、数百ページの文書、テレビシリーズ全編、100時間のライブ配信を検索可能なナレッジベースに変換したり、1枚のスクリーンショットからフロントエンドのプロジェクトを再構築したりできるという。[1]
- 100万トークンあたりの価格: 北京のModel Studioでは入力12人民元、出力36人民元。Primeは入力4ドル、出力12ドル。[2][4]
- アリババのベンチマーク表では、Terminal Bench 2.1で86.6(Fable 5の84.6、GPT-5.6 Solの88.8に対する数値)、SWE-bench Proで67.7(Fable 5の80.0に対する数値)を記録している。[5]
参考資料 7確度 81%総合信頼度: 81%ピンの情報源と参照がその日付をどれだけ裏付けているか。出典を含む 7 件の資料がピンの開始・終了時刻をどれだけ強く裏付けているかの加重平均。最新の資料より180日古くなるごとに重みは半分になります確度75%以上のピンをすべて表示
最初の項目は常にピンの出典です。全体の確度は、各資料が上記の開始・終了時刻をどれだけ強く裏付けているかの加重平均です。最新の資料より180日古くなるごとに、重みは半分になります。
- [1]90%alibabagroup.com/en-US/document-2021044032125272064alibabagroup.com· 投稿 2026年9月28日· 開始 2026年8月3日 ✓· スコアの 16%
アリババグループのリリースは「2026年8月3日」の日付で、「本モデルは現在、世界の開発者向けにAlibaba Cloud Model StudioのAPI経由で利用可能であり、モデルウェイトは翌週にリリース予定」としている。CNBC[6]は、アリババが8月3日「月曜日」にこれを「発表した」と報じている。
- [2]90%qwen3.8-max Model Info - Alibaba Cloud Model Studiohelp.aliyun.com· 追加 2026年9月28日· スコアの 16%
Alibaba Cloud's model page: model ID qwen3.8-max, now the snapshot qwen3.8-max-0902 (alias qwen3.8-max-2026-09-02); image, text and video input; a 1,000,000-token context window with 131,072 max output; function calling, structured outputs, web search and context caching; CNY 12 input and CNY 36 output per million tokens in Beijing.[1]
- [3]75%Qwen - Wikipediaen.wikipedia.org· 追加 2026年9月28日· スコアの 16%
Dates the cloud release to 3 August 2026, the open weights (Qwen3.8-2.4T-A95B, without image input or non-thinking mode) to 12 August, with a licence requiring providers earning more than US$50 million to get a commercial licence, and the Apache 2.0 Qwen3.8-27B to 14 August.[1]
- [4]70%Qwen3.8 Max Prime: Is it actually better? - DataNorth AIdatanorth.ai· 公開 2026年9月24日· スコアの 15%
Reports that Alibaba's Qwen team released Qwen3.8 Max Prime on 23 September 2026 as a higher-throughput version of Qwen3.8 Max at $4 per million input and $12 per million output tokens, "exactly twice the price of the standard model", and that it was not measurably faster in OpenRouter's first measurements.[1]
- [5]90%Qwen/Qwen3.8-2.4T-A95B · Hugging Facehuggingface.co· 公開 2026年8月12日· スコアの 13%
The open-weights model card: "For the first time, Qwen3.8 brings a Qwen-Max-class model to open release"; 2.4T total and 95B activated parameters, 92 layers, 512 experts (10 routed + 1 shared), 262,144 tokens natively extensible to 1,010,000, and benchmarks against Opus 4.8, Fable 5 and GPT-5.6 Sol.[1]
修正を提案
足りない点や誤りがありますか? このピンを裏付けるリンク、別の開始日・終了日とその理由、欠けている情報や誤っている情報を、自由に書いてください。AIがこのピンの出典と照らし合わせ、より良い情報源を探し、裏付けとなるページがあれば参考資料として追加します。ピン自身の出典が引き続き最も重視されます。AIは画像も確認します。別のものが写っている画像や写りの悪い画像は、後ろに回すか差し替えます。