- Début
- 10 sept. 2026CONFIANCE 90 %selon la source
Sortie de DeepSeek-V4.1-Flash
Traduit automatiquement de l’original
Titre original: DeepSeek-V4.1-Flash Released
- DeepSeek a lancé DeepSeek-V4.1-Flash le 10 septembre 2026, « le plus petit modèle de notre nouvelle famille d'architectures, doté d'une compréhension visuelle native », disponible sur l'API DeepSeek sous le nom
deepseek-flashet dans les applications web et mobile de DeepSeek[1][5] - V4-Flash et le modèle expérimental V4-Flash-Vision-Exp sont retirés, et leurs noms de modèle redirigent vers V4.1-Flash ; DeepSeek « élimine progressivement V4-Pro », et à partir de 4h00 UTC le 14 septembre, toute requête
deepseek-v4-proest traitée par V4.1-Flash aux tarifs de V4.1-Flash, jusqu'au lancement de V4.1-Pro[1][3] - De nouveaux tarifs API, plus bas, sont entrés en vigueur à 4h00 UTC le 10 septembre ; SiliconANGLE calcule qu'un appelant de V4-Pro paie désormais 1,20 $ au lieu de 3,96 $ par million de jetons de sortie aux heures de pointe, une baisse d'environ 70 %[1][5]
- Les poids sont disponibles sur Hugging Face sous licence MIT[4][5]
- Reuters note que cette sortie intervient alors que DeepSeek commence à se préparer pour une introduction en bourse sur le STAR Market de Shanghai[6]
Caractéristiques notables
- Un modèle à mélange d'experts de 552 milliards de paramètres avec une nouvelle architecture encodeur-décodeur causale qui n'active « que 8 milliards de paramètres pour l'entrée, 16 milliards pour la sortie », pré-entraîné à partir de zéro sur 45 000 milliards de jetons de texte et d'images[1][4]
- Son cache KV occupe 890 octets par jeton, environ un quart de celui de V4-Flash en mémoire, et ne nécessite qu'un huitième du stockage SSD ; DeepSeek note que « les frais liés aux succès de cache représentent souvent une grande part des coûts des agents »[1][4]
- Caractéristiques : contexte de 1 million de jetons, jusqu'à 384 000 jetons de sortie, modes avec ou sans réflexion, un réglage d'effort de raisonnement de 1 à 100, entrée image native, appels d'outils et une API au format Anthropic[2][4]
- Tarifs par million de jetons : 0,15 $ en entrée et 0,60 $ en sortie hors pointe, 0,30 $ et 1,20 $ aux heures de pointe (en semaine, de 1h00 à 4h00 et de 6h00 à 10h00 UTC), avec des succès de cache à 0,003 $ hors pointe[2]
- À l'effort maximal, DeepSeek rapporte 90,6 sur Terminal-Bench 2.1 contre 89,1 pour Claude Opus 5 et 88,8 pour GPT-5.6 Sol, 74,2 % sur DeepSWE v1.1 contre 74,0 et 73,0 (V4-Pro : 62,7), et 88,1 sur CyberGym ; les deux modèles américains restent en tête sur GPQA Diamond (93,4 et 94,1 contre 90,9)[4][5]
Références 7CONFIANCE 85 %Confiance globale: 85%Dans quelle mesure la source et les références du pin étayent ses dates.Moyenne pondérée de la fermeté avec laquelle 7 références, source comprise, étayent les heures de début et de fin de l’épingle ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récenteAfficher toutes les épingles à 75 % de confiance ou plus
La première entrée est toujours la source de l’épingle. La confiance globale est une moyenne pondérée de la fermeté avec laquelle chaque référence étaye les heures de début et de fin retenues ci-dessus ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récente.
- [1]90%deepseek.com/en/news/deepseek-v4-1-flashdeepseek.com· Publié le 28 sept. 2026· Début 10 sept. 2026 ✓· 15 % du score
L'annonce de DeepSeek[2][3] est datée du '10 septembre 2026' et dit 'V4.1-Flash est désormais disponible sur l'API DeepSeek' ; le journal des modifications de sa documentation API mentionne 'DeepSeek-V4.1-Flash Release 2026/09/10', et Reuters rapporte que DeepSeek a 'aujourd'hui (10 septembre) lancé DeepSeek-V4.1-Flash'.
- [2]90%Models & Pricing | DeepSeek API Docsapi-docs.deepseek.com· Ajouté le 28 sept. 2026· 15 % du score
DeepSeek's[1][3] pricing page gives DeepSeek-V4.1-Flash a 1M context length and 384K maximum output, and per-million-token prices of $0.15 input (cache miss) and $0.60 output off-peak, $0.30 and $1.20 at peak, with peak hours 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- [3]90%DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docsapi-docs.deepseek.com· Publié le 10 sept. 2026· Début 10 sept. 2026· 14 % du score
DeepSeek's[1][2] developer-docs copy of the announcement, listed as "DeepSeek-V4.1-Flash Release 2026/09/10": the model name deepseek-flash, the retirement of V4-Flash and V4-Flash-Vision-Exp, and "Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates".
- [4]90%deepseek-ai/DeepSeek-V4.1-Flash · Hugging Facehuggingface.co· Publié le 10 sept. 2026· 14 % du score
The official model card: 552B backbone parameters, a Causal Encoder-Decoder that activates 8B parameters per token in prefill and 16B in decode, a KV cache of 890 bytes per token, 45T pre-training tokens, the MIT license, and the benchmark table against Opus 5.0, GPT-5.6 Sol, Kimi K3 and GLM-5.3.[1]
- [5]85%DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLEsiliconangle.com· Publié le 10 sept. 2026· Début 10 sept. 2026· 14 % du score
SiliconANGLE's same-day report ("today released DeepSeek[1][2][3]-V4.1-Flash") works out that rerouted V4-Pro callers pay $1.20 instead of $3.96 per million output tokens at peak, "a cut of roughly 70%", and notes Anthropic named DeepSeek in a distillation report the same day.
Suggérer une correction
Il manque quelque chose ou une erreur s'est glissée ? Dites-le avec vos mots : un lien qui étaye cette épingle, une autre date de début ou de fin et pourquoi, ou une information absente ou erronée. L'IA la vérifie au regard des sources de l'épingle, en cherche de meilleures et ajoute toute page qui vous donne raison. Les sources de l'épingle restent celles qui comptent le plus. L'IA regarde aussi les images : une image qui montre autre chose, ou qui le montre mal, passe en dernier ou est remplacée.