- Inicio
- 10 sept 202690% DE CONFIANZAsegún la fuente
DeepSeek lanza DeepSeek-V4.1-Flash
Traducido automáticamente del original
Título original: DeepSeek-V4.1-Flash Released
- DeepSeek lanzó DeepSeek-V4.1-Flash el 10 de septiembre de 2026, "el modelo más pequeño de nuestra nueva familia de arquitecturas, con comprensión visual nativa", activo en la API de DeepSeek como
deepseek-flashy en las apps web y móvil de DeepSeek[1][5] - V4-Flash y el experimental V4-Flash-Vision-Exp quedan retirados y sus nombres de modelo se enrutan a V4.1-Flash; DeepSeek está "retirando gradualmente V4-Pro", y desde las 04:00 UTC del 14 de septiembre toda solicitud a
deepseek-v4-proes respondida por V4.1-Flash a las tarifas de V4.1-Flash hasta que se lance V4.1-Pro[1][3] - Los nuevos precios más bajos de la API entraron en vigor a las 04:00 UTC del 10 de septiembre; SiliconANGLE calcula que quien llamaba a V4-Pro ahora paga 1,20 $ en lugar de 3,96 $ por millón de tokens de salida en hora pico, un recorte de aproximadamente el 70%[1][5]
- Los pesos están en Hugging Face bajo la licencia MIT[4][5]
- Reuters señala que el lanzamiento se produjo mientras DeepSeek empieza a prepararse para una oferta pública inicial en el mercado STAR de Shanghái[6]
Características destacadas
- Un modelo de mezcla de expertos con 552.000 millones de parámetros y una nueva arquitectura Causal Encoder-Decoder que activa "solo 8.000 millones de parámetros activos para la entrada, 16.000 millones para la salida", preentrenado desde cero con 45 billones de tokens de texto e imágenes[1][4]
- Su caché KV es de 890 bytes por token, aproximadamente 1/4 del de V4-Flash en memoria, y necesita 1/8 del almacenamiento SSD; DeepSeek señala que "los cargos por aciertos de caché a menudo representan una gran parte de los costes de los agentes"[1][4]
- Especificaciones: contexto de 1M de tokens, hasta 384K tokens de salida, modos de razonamiento y sin razonamiento, un ajuste de esfuerzo de razonamiento de 1 a 100, entrada de imagen nativa, llamadas a herramientas y una API con formato Anthropic[2][4]
- Precios por millón de tokens: 0,15 $ de entrada y 0,60 $ de salida en horas de menor demanda, 0,30 $ y 1,20 $ en hora pico (días laborables de 01:00 a 04:00 y de 06:00 a 10:00 UTC), con aciertos de caché a 0,003 $ en horas de menor demanda[2]
- Con el esfuerzo máximo, DeepSeek reporta 90,6 en Terminal-Bench 2.1 frente al 89,1 de Claude Opus 5 y el 88,8 de GPT-5.6 Sol, 74,2% en DeepSWE v1.1 frente a 74,0 y 73,0 (V4-Pro 62,7), y 88,1 en CyberGym; ambos modelos estadounidenses siguen liderando en GPQA Diamond (93,4 y 94,1 frente a 90,9)[4][5]
Referencias 785% DE CONFIANZAConfianza general: 85%Hasta qué punto la fuente y las referencias del pin respaldan sus fechas.Media ponderada de la firmeza con la que 7 referencias, incluida la fuente, respaldan las horas de inicio y fin del pin; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más recienteMostrar todos los pines con un 75% de confianza o más
La primera entrada es siempre la fuente del pin. La confianza global es una media ponderada de la firmeza con la que cada referencia respalda las horas de inicio y fin usadas arriba; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más reciente.
- [1]90%deepseek.com/en/news/deepseek-v4-1-flashdeepseek.com· Publicado el 28 sept 2026· Empieza 10 sept 2026 ✓· 15% de la puntuación
El anuncio de DeepSeek[2][3] está fechado el "10 de septiembre de 2026" y dice que "V4.1-Flash ya está activo en la API de DeepSeek"; su registro de cambios de la documentación de la API incluye "DeepSeek-V4.1-Flash Release 2026/09/10", y Reuters informa que DeepSeek "hoy (10 de septiembre) lanzó DeepSeek-V4.1-Flash".
- [2]90%Models & Pricing | DeepSeek API Docsapi-docs.deepseek.com· Añadido el 28 sept 2026· 15% de la puntuación
DeepSeek's[1][3] pricing page gives DeepSeek-V4.1-Flash a 1M context length and 384K maximum output, and per-million-token prices of $0.15 input (cache miss) and $0.60 output off-peak, $0.30 and $1.20 at peak, with peak hours 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- [3]90%DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docsapi-docs.deepseek.com· Publicado el 10 sept 2026· Empieza 10 sept 2026· 14% de la puntuación
DeepSeek's[1][2] developer-docs copy of the announcement, listed as "DeepSeek-V4.1-Flash Release 2026/09/10": the model name deepseek-flash, the retirement of V4-Flash and V4-Flash-Vision-Exp, and "Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates".
- [4]90%deepseek-ai/DeepSeek-V4.1-Flash · Hugging Facehuggingface.co· Publicado el 10 sept 2026· 14% de la puntuación
The official model card: 552B backbone parameters, a Causal Encoder-Decoder that activates 8B parameters per token in prefill and 16B in decode, a KV cache of 890 bytes per token, 45T pre-training tokens, the MIT license, and the benchmark table against Opus 5.0, GPT-5.6 Sol, Kimi K3 and GLM-5.3.[1]
- [5]85%DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLEsiliconangle.com· Publicado el 10 sept 2026· Empieza 10 sept 2026· 14% de la puntuación
SiliconANGLE's same-day report ("today released DeepSeek[1][2][3]-V4.1-Flash") works out that rerouted V4-Pro callers pay $1.20 instead of $3.96 per million output tokens at peak, "a cut of roughly 70%", and notes Anthropic named DeepSeek in a distillation report the same day.
Sugerir una corrección
¿Falta algo o hay un error? Dilo con tus palabras: un enlace que respalde este pin, otra fecha de inicio o fin y por qué, o un dato que falta o está mal. La IA lo contrasta con las fuentes del pin, busca otras mejores y añade cualquier página que te dé la razón. Las fuentes del propio pin siguen contando más. La IA también mira las imágenes: una que muestra otra cosa, o la muestra mal, pasa al final o se sustituye.