- Начало
- 10 сент. 2026 г.ДОСТОВЕРНОСТЬ 90%от источник
Выпущена DeepSeek-V4.1-Flash
Автоматический перевод оригинала
Оригинальное название: DeepSeek-V4.1-Flash Released
- 10 сентября 2026 г. DeepSeek выпустила DeepSeek-V4.1-Flash — «самую маленькую модель нашего нового семейства архитектур с нативным визуальным пониманием», доступную в API DeepSeek как
deepseek-flashи в веб- и мобильных приложениях DeepSeek[1][5] - V4-Flash и экспериментальная V4-Flash-Vision-Exp выведены из обращения, а их названия моделей направляются на V4.1-Flash; DeepSeek «постепенно отказывается от V4-Pro», и с 04:00 UTC 14 сентября на каждый запрос
deepseek-v4-proотвечает V4.1-Flash по тарифам V4.1-Flash до запуска V4.1-Pro[1][3] - Новые, более низкие цены API вступили в силу в 04:00 UTC 10 сентября; SiliconANGLE подсчитал, что вызывающий V4-Pro теперь платит в часы пик 1.20 доллара вместо 3.96 доллара за миллион выходных токенов — снижение примерно на 70%[1][5]
- Веса опубликованы на Hugging Face по лицензии MIT[4][5]
- Reuters отмечает, что выпуск состоялся, когда DeepSeek начинает подготовку к первичному публичному размещению акций на шанхайской бирже STAR Market[6]
Примечательные особенности
- Модель со смесью экспертов на 552 млрд параметров с новой архитектурой Causal Encoder-Decoder, которая активирует «всего 8 млрд активных параметров на входе, 16 млрд на выходе», предобученная с нуля на 45 трлн токенов текста и изображений[1][4]
- Её KV-кэш занимает 890 байт на токен, около 1/4 от V4-Flash в памяти, и требует 1/8 места на SSD; DeepSeek отмечает, что «расходы на попадания в кэш часто составляют значительную долю затрат на агентов»[1][4]
- Характеристики: контекст в 1 млн токенов, до 384 тыс. выходных токенов, режимы с рассуждением и без него, настройка усилий рассуждения от 1 до 100, нативный ввод изображений, вызовы инструментов и API в формате Anthropic[2][4]
- Цены за миллион токенов: 0.15 доллара за ввод и 0.60 доллара за вывод в непиковое время, 0.30 и 1.20 доллара в пиковое (по будням 01:00–04:00 и 06:00–10:00 UTC), с попаданиями в кэш по 0.003 доллара в непиковое время[2]
- При максимальных усилиях DeepSeek сообщает о 90.6 в Terminal-Bench 2.1 против 89.1 у Claude Opus 5 и 88.8 у GPT-5.6 Sol, 74.2% в DeepSWE v1.1 против 74.0 и 73.0 (V4-Pro — 62.7) и 88.1 в CyberGym; обе американские модели по-прежнему лидируют в GPQA Diamond (93.4 и 94.1 против 90.9)[4][5]
Источники 7ДОСТОВЕРНОСТЬ 85%Общая достоверность: 85%Насколько источник и ссылки пина подтверждают его даты.Взвешенное среднее того, насколько 7 источников, включая основной, подтверждают время начала и окончания пина; вес источника уменьшается вдвое за каждые 180 дней разницы с самым новымПоказать все пины с достоверностью 75% и выше
Первая запись — всегда источник пина. Общая достоверность — это взвешенное среднее того, насколько каждый источник подтверждает указанные выше время начала и окончания; вес источника уменьшается вдвое за каждые 180 дней разницы с самым новым.
- [1]90%deepseek.com/en/news/deepseek-v4-1-flashdeepseek.com· Размещено 28 сент. 2026 г.· Начало 10 сент. 2026 г. ✓· 15% оценки
Объявление DeepSeek[2][3] датировано «10 сентября 2026 г.» и гласит: «V4.1-Flash теперь работает в API DeepSeek»; в журнале изменений документации API указано «DeepSeek-V4.1-Flash Release 2026/09/10», а Reuters сообщает, что DeepSeek «сегодня (10 сентября) запустила DeepSeek-V4.1-Flash».
- [2]90%Models & Pricing | DeepSeek API Docsapi-docs.deepseek.com· Добавлено 28 сент. 2026 г.· 15% оценки
DeepSeek's[1][3] pricing page gives DeepSeek-V4.1-Flash a 1M context length and 384K maximum output, and per-million-token prices of $0.15 input (cache miss) and $0.60 output off-peak, $0.30 and $1.20 at peak, with peak hours 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- [3]90%DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docsapi-docs.deepseek.com· Опубликовано 10 сент. 2026 г.· Начало 10 сент. 2026 г.· 14% оценки
DeepSeek's[1][2] developer-docs copy of the announcement, listed as "DeepSeek-V4.1-Flash Release 2026/09/10": the model name deepseek-flash, the retirement of V4-Flash and V4-Flash-Vision-Exp, and "Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates".
- [4]90%deepseek-ai/DeepSeek-V4.1-Flash · Hugging Facehuggingface.co· Опубликовано 10 сент. 2026 г.· 14% оценки
The official model card: 552B backbone parameters, a Causal Encoder-Decoder that activates 8B parameters per token in prefill and 16B in decode, a KV cache of 890 bytes per token, 45T pre-training tokens, the MIT license, and the benchmark table against Opus 5.0, GPT-5.6 Sol, Kimi K3 and GLM-5.3.[1]
- [5]85%DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLEsiliconangle.com· Опубликовано 10 сент. 2026 г.· Начало 10 сент. 2026 г.· 14% оценки
SiliconANGLE's same-day report ("today released DeepSeek[1][2][3]-V4.1-Flash") works out that rerouted V4-Pro callers pay $1.20 instead of $3.96 per million output tokens at peak, "a cut of roughly 70%", and notes Anthropic named DeepSeek in a distillation report the same day.
Предложить исправление
Чего-то не хватает или есть ошибка? Напишите своими словами: ссылку, подтверждающую этот пин, другую дату начала или окончания и почему, или факт, которого нет или который неверен. ИИ сверит это с источниками пина, поищет лучшие и добавит любую страницу, которая вас подтверждает. Собственные источники пина всё равно весят больше всего. Изображение, на котором показано что-то другое или показано плохо, тоже проверяется и опускается ниже или заменяется.