- 開始
- 2026年9月10日確度 90%出典:出典
DeepSeek-V4.1-Flashがリリース
原文から自動翻訳されています
元のタイトル: DeepSeek-V4.1-Flash Released
- DeepSeekは2026年9月10日、「ネイティブな視覚理解を備えた、当社の新しいアーキテクチャファミリーの中で最小のモデル」であるDeepSeek-V4.1-Flashをリリースし、DeepSeek APIで
deepseek-flashとして、またDeepSeekのウェブ・モバイルアプリで利用可能にした。[1][5] - V4-Flashと実験版のV4-Flash-Vision-Expは廃止され、これらのモデル名はV4.1-Flashにルーティングされる。DeepSeekは「V4-Proを段階的に廃止」しており、9月14日04:00 UTC以降、V4.1-Proがリリースされるまで、
deepseek-v4-proへの全てのリクエストはV4.1-Flashの料金でV4.1-Flashによって処理される。[1][3] - 新たな、より低いAPI価格が9月10日04:00 UTCに適用された。SiliconANGLEの算出によれば、V4-Pro利用者はピーク時、出力100万トークンあたり3.96ドルではなく1.20ドルを支払うことになり、約70%の削減となる。[1][5]
- ウェイトはMITライセンスのもとHugging Faceで公開されている。[4][5]
- ロイターは、このリリースがDeepSeekが上海科創板(STARマーケット)での新規株式公開(IPO)の準備を始めた時期に行われたと指摘している。[6]
注目の機能
- 5,520億パラメータのmixture-of-expertsモデルで、新しいCausal Encoder-Decoderアーキテクチャを採用し、「入力にはわずか80億、出力には160億」のパラメータのみを活性化させる。テキストと画像45兆トークンをもとにゼロから事前学習された。[1][4]
- KVキャッシュは1トークンあたり890バイトで、メモリ上ではV4-Flashのおよそ4分の1、SSDストレージでは8分の1で済む。DeepSeekは「キャッシュヒットの課金がエージェントのコストの大きな割合を占めることが多い」と指摘している。[1][4]
- 仕様: コンテキスト100万トークン、出力は最大384Kトークン、thinkingモードとnon-thinkingモード、1から100までの推論強度設定、ネイティブな画像入力、ツール呼び出し、Anthropic形式のAPIに対応する。[2][4]
- 100万トークンあたりの価格: オフピーク時は入力0.15ドル・出力0.60ドル、ピーク時(平日01:00-04:00 UTCおよび06:00-10:00 UTC)は0.30ドルと1.20ドル。オフピーク時のキャッシュヒットは0.003ドル。[2]
- 最大強度において、DeepSeekはTerminal-Bench 2.1で90.6(Claude Opus 5の89.1、GPT-5.6 Solの88.8に対する数値)、DeepSWE v1.1で74.2%(74.0%と73.0%に対する数値、V4-Proは62.7%)、CyberGymで88.1を報告している。GPQA Diamondでは依然として米国の両モデルが上回っている(93.4と94.1に対し90.9)。[4][5]
参考資料 7確度 85%総合信頼度: 85%ピンの情報源と参照がその日付をどれだけ裏付けているか。出典を含む 7 件の資料がピンの開始・終了時刻をどれだけ強く裏付けているかの加重平均。最新の資料より180日古くなるごとに重みは半分になります確度75%以上のピンをすべて表示
最初の項目は常にピンの出典です。全体の確度は、各資料が上記の開始・終了時刻をどれだけ強く裏付けているかの加重平均です。最新の資料より180日古くなるごとに、重みは半分になります。
- [1]90%deepseek.com/en/news/deepseek-v4-1-flashdeepseek.com· 投稿 2026年9月28日· 開始 2026年9月10日 ✓· スコアの 15%
DeepSeek[2][3]の発表は「2026年9月10日」の日付で、「V4.1-FlashはDeepSeek APIで現在利用可能」としている。API docsのchangelogには「DeepSeek-V4.1-Flash Release 2026/09/10」と記載され、ロイターはDeepSeekが「本日(9月10日)DeepSeek-V4.1-Flashをローンチした」と報じている。
- [2]90%Models & Pricing | DeepSeek API Docsapi-docs.deepseek.com· 追加 2026年9月28日· スコアの 15%
DeepSeek's[1][3] pricing page gives DeepSeek-V4.1-Flash a 1M context length and 384K maximum output, and per-million-token prices of $0.15 input (cache miss) and $0.60 output off-peak, $0.30 and $1.20 at peak, with peak hours 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- [3]90%DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docsapi-docs.deepseek.com· 公開 2026年9月10日· 開始 2026年9月10日· スコアの 14%
DeepSeek's[1][2] developer-docs copy of the announcement, listed as "DeepSeek-V4.1-Flash Release 2026/09/10": the model name deepseek-flash, the retirement of V4-Flash and V4-Flash-Vision-Exp, and "Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates".
- [4]90%deepseek-ai/DeepSeek-V4.1-Flash · Hugging Facehuggingface.co· 公開 2026年9月10日· スコアの 14%
The official model card: 552B backbone parameters, a Causal Encoder-Decoder that activates 8B parameters per token in prefill and 16B in decode, a KV cache of 890 bytes per token, 45T pre-training tokens, the MIT license, and the benchmark table against Opus 5.0, GPT-5.6 Sol, Kimi K3 and GLM-5.3.[1]
- [5]85%DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLEsiliconangle.com· 公開 2026年9月10日· 開始 2026年9月10日· スコアの 14%
SiliconANGLE's same-day report ("today released DeepSeek[1][2][3]-V4.1-Flash") works out that rerouted V4-Pro callers pay $1.20 instead of $3.96 per million output tokens at peak, "a cut of roughly 70%", and notes Anthropic named DeepSeek in a distillation report the same day.
修正を提案
足りない点や誤りがありますか? このピンを裏付けるリンク、別の開始日・終了日とその理由、欠けている情報や誤っている情報を、自由に書いてください。AIがこのピンの出典と照らし合わせ、より良い情報源を探し、裏付けとなるページがあれば参考資料として追加します。ピン自身の出典が引き続き最も重視されます。AIは画像も確認します。別のものが写っている画像や写りの悪い画像は、後ろに回すか差し替えます。