- Beginn
- 10. Sept. 202690 % SICHERHEITlaut der Quelle
DeepSeek-V4.1-Flash veröffentlicht
Automatisch aus dem Original übersetzt
Originaltitel: DeepSeek-V4.1-Flash Released
- DeepSeek veröffentlichte DeepSeek-V4.1-Flash am 10. September 2026, „das kleinste Modell unserer neuen Architekturfamilie, mit nativem visuellem Verständnis“, live auf der DeepSeek-API als
deepseek-flashund in DeepSeeks Web- und Mobil-Apps[1][5] - V4-Flash und das experimentelle V4-Flash-Vision-Exp werden eingestellt, und ihre Modellnamen leiten zu V4.1-Flash weiter; DeepSeek „stellt V4-Pro schrittweise ein“, und ab 04:00 Uhr UTC am 14. September wird jede Anfrage an
deepseek-v4-provon V4.1-Flash zu dessen Preisen beantwortet, bis V4.1-Pro startet[1][3] - Neue, niedrigere API-Preise traten am 10. September um 04:00 Uhr UTC in Kraft; SiliconANGLE rechnet vor, dass ein V4-Pro-Aufrufer jetzt zur Spitzenzeit 1,20 $ statt 3,96 $ pro Million Ausgabetokens zahlt, ein Rückgang von rund 70 %[1][5]
- Die Gewichte stehen auf Hugging Face unter der MIT-Lizenz[4][5]
- Reuters weist darauf hin, dass die Veröffentlichung erfolgte, während sich DeepSeek auf einen Börsengang am Shanghaier STAR Market vorbereitet[6]
Bemerkenswerte Merkmale
- Ein Mixture-of-Experts-Modell mit 552 Milliarden Parametern und einer neuen Causal-Encoder-Decoder-Architektur, die „nur 8 Milliarden aktive Parameter für die Eingabe, 16 Milliarden für die Ausgabe“ aktiviert, von Grund auf mit 45 Billionen Tokens aus Text und Bildern vortrainiert[1][4]
- Sein KV-Cache umfasst 890 Byte pro Token, etwa ein Viertel dessen von V4-Flash im Speicher, und benötigt ein Achtel des SSD-Speicherplatzes; DeepSeek merkt an, dass „Cache-Treffer-Gebühren oft einen großen Anteil der Agentenkosten ausmachen“[1][4]
- Spezifikationen: 1-Millionen-Token-Kontext, bis zu 384.000 Ausgabetokens, Denk- und Nicht-Denk-Modus, eine Reasoning-Aufwand-Einstellung von 1 bis 100, native Bildeingabe, Tool-Aufrufe und eine API im Anthropic-Format[2][4]
- Preise pro Million Tokens: 0,15 $ Eingabe und 0,60 $ Ausgabe außerhalb der Spitzenzeit, 0,30 $ und 1,20 $ zur Spitzenzeit (werktags 01:00–04:00 und 06:00–10:00 Uhr UTC), mit Cache-Treffern zu 0,003 $ außerhalb der Spitzenzeit[2]
- Bei maximalem Aufwand meldet DeepSeek 90,6 auf Terminal-Bench 2.1 gegenüber 89,1 bei Claude Opus 5 und 88,8 bei GPT-5.6 Sol, 74,2 % auf DeepSWE v1.1 gegenüber 74,0 und 73,0 (V4-Pro 62,7) und 88,1 auf CyberGym; beide US-Modelle führen weiterhin bei GPQA Diamond (93,4 und 94,1 gegenüber 90,9)[4][5]
Belege 785 % SICHERHEITGesamtvertrauen: 85%Wie gut die Quelle und die Belege des Pins seine Termine stützen.Gewichteter Durchschnitt, wie fest 7 Belege einschließlich der Quelle die Start- und Endzeiten des Pins stützen; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so vielAlle Pins mit mindestens 75 % Sicherheit anzeigen
Der erste Eintrag ist immer die Quelle des Pins. Die Gesamtsicherheit ist ein gewichteter Durchschnitt, wie fest jeder Beleg die oben verwendeten Start- und Endzeiten stützt; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so viel.
- [1]90%deepseek.com/en/news/deepseek-v4-1-flashdeepseek.com· Gepostet am 28. Sept. 2026· Beginn 10. Sept. 2026 ✓· 15 % der Wertung
DeepSeeks Ankündigung ist auf „September 10, 2026“ datiert und sagt, „V4.1-Flash ist jetzt live auf der DeepSeek[2][3]-API“; dessen API-Docs-Changelog listet „DeepSeek-V4.1-Flash Release 2026/09/10“, und Reuters berichtet, DeepSeek habe „heute (10. September) DeepSeek-V4.1-Flash gestartet“.
- [2]90%Models & Pricing | DeepSeek API Docsapi-docs.deepseek.com· Hinzugefügt am 28. Sept. 2026· 15 % der Wertung
DeepSeek's[1][3] pricing page gives DeepSeek-V4.1-Flash a 1M context length and 384K maximum output, and per-million-token prices of $0.15 input (cache miss) and $0.60 output off-peak, $0.30 and $1.20 at peak, with peak hours 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- [3]90%DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docsapi-docs.deepseek.com· Veröffentlicht am 10. Sept. 2026· Beginn 10. Sept. 2026· 14 % der Wertung
DeepSeek's[1][2] developer-docs copy of the announcement, listed as "DeepSeek-V4.1-Flash Release 2026/09/10": the model name deepseek-flash, the retirement of V4-Flash and V4-Flash-Vision-Exp, and "Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates".
- [4]90%deepseek-ai/DeepSeek-V4.1-Flash · Hugging Facehuggingface.co· Veröffentlicht am 10. Sept. 2026· 14 % der Wertung
The official model card: 552B backbone parameters, a Causal Encoder-Decoder that activates 8B parameters per token in prefill and 16B in decode, a KV cache of 890 bytes per token, 45T pre-training tokens, the MIT license, and the benchmark table against Opus 5.0, GPT-5.6 Sol, Kimi K3 and GLM-5.3.[1]
- [5]85%DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLEsiliconangle.com· Veröffentlicht am 10. Sept. 2026· Beginn 10. Sept. 2026· 14 % der Wertung
SiliconANGLE's same-day report ("today released DeepSeek[1][2][3]-V4.1-Flash") works out that rerouted V4-Pro callers pay $1.20 instead of $3.96 per million output tokens at peak, "a cut of roughly 70%", and notes Anthropic named DeepSeek in a distillation report the same day.
Korrektur vorschlagen
Fehlt etwas oder stimmt etwas nicht? Sag es in deinen eigenen Worten: ein Link, der diesen Pin belegt, ein anderes Start- oder Enddatum und warum, oder eine Angabe, die fehlt oder falsch ist. Die KI prüft es an den Quellen dieses Pins, sucht nach besseren und ergänzt jede Seite, die dich bestätigt. Die eigenen Quellen des Pins zählen weiterhin am meisten. Auch Bilder sieht sich die KI an: Eines, das etwas anderes oder die Sache schlecht zeigt, wird nach hinten gestellt oder ersetzt.