- Inizio
- 10 set 2026AFFIDABILITÀ 90%da la fonte
Rilasciato DeepSeek-V4.1-Flash
Tradotto automaticamente dall’originale
Titolo originale: DeepSeek-V4.1-Flash Released
- DeepSeek ha rilasciato DeepSeek-V4.1-Flash il 10 settembre 2026, «il più piccolo modello della nostra nuova famiglia di architetture, con comprensione visiva nativa», attivo sull'API DeepSeek come
deepseek-flashe nelle app web e mobile di DeepSeek[1][5] - V4-Flash e lo sperimentale V4-Flash-Vision-Exp sono ritirati e i loro nomi di modello vengono instradati a V4.1-Flash; DeepSeek sta «eliminando gradualmente V4-Pro» e dalle 04:00 UTC del 14 settembre ogni richiesta
deepseek-v4-proriceve risposta da V4.1-Flash alle tariffe di V4.1-Flash fino al lancio di V4.1-Pro[1][3] - Nuovi prezzi API più bassi sono entrati in vigore alle 04:00 UTC del 10 settembre; SiliconANGLE calcola che chi usa V4-Pro ora paga 1,20 $ invece di 3,96 $ per milione di token in output nelle ore di punta, un taglio di circa il 70%[1][5]
- I pesi sono su Hugging Face con licenza MIT[4][5]
- Reuters osserva che il rilascio è arrivato mentre DeepSeek inizia a prepararsi per un'offerta pubblica iniziale sullo STAR Market di Shanghai[6]
Caratteristiche principali
- Un modello mixture-of-experts da 552B di parametri con una nuova architettura Causal Encoder-Decoder che attiva «solo 8B di parametri attivi per l'input, 16B per l'output», preaddestrato da zero su 45T di token di testo e immagini[1][4]
- La sua KV cache è di 890 byte per token, circa 1/4 di quella di V4-Flash in memoria, e richiede 1/8 dello spazio su SSD; DeepSeek osserva che «i costi di cache hit rappresentano spesso una quota rilevante dei costi degli agenti»[1][4]
- Specifiche: contesto da 1M di token, fino a 384K token in output, modalità con e senza ragionamento, un'impostazione di impegno di ragionamento da 1 a 100, input di immagini nativo, chiamate a strumenti e un'API in formato Anthropic[2][4]
- Prezzi per milione di token: 0,15 $ in input e 0,60 $ in output fuori dalle ore di punta, 0,30 $ e 1,20 $ nelle ore di punta (giorni feriali 01:00-04:00 e 06:00-10:00 UTC), con cache hit a 0,003 $ fuori dalle ore di punta[2]
- Al massimo impegno DeepSeek riporta 90,6 su Terminal-Bench 2.1 contro l'89,1 di Claude Opus 5 e l'88,8 di GPT-5.6 Sol, 74,2% su DeepSWE v1.1 contro 74,0 e 73,0 (V4-Pro 62,7) e 88,1 su CyberGym; entrambi i modelli statunitensi restano in testa su GPQA Diamond (93,4 e 94,1 contro 90,9)[4][5]
Fonti 7AFFIDABILITÀ 85%Affidabilità complessiva: 85%Quanto la fonte e le altre fonti del pin ne confermano le date.Media ponderata di quanto 7 fonti, compresa quella principale, confermano gli orari di inizio e fine del pin; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recenteMostra tutti i pin con affidabilità pari o superiore al 75%
La prima voce è sempre la fonte del pin. L’affidabilità complessiva è una media ponderata di quanto ogni fonte conferma gli orari di inizio e fine indicati sopra; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recente.
- [1]90%deepseek.com/en/news/deepseek-v4-1-flashdeepseek.com· Postato il 28 set 2026· Inizio 10 set 2026 ✓· 15% del punteggio
L'annuncio di DeepSeek[2][3] è datato «September 10, 2026» e dice «V4.1-Flash is now live on the DeepSeek API»; il changelog della sua documentazione API elenca «DeepSeek-V4.1-Flash Release 2026/09/10», e Reuters riporta che DeepSeek ha «lanciato oggi (10 settembre) DeepSeek-V4.1-Flash».
- [2]90%Models & Pricing | DeepSeek API Docsapi-docs.deepseek.com· Aggiunto il 28 set 2026· 15% del punteggio
DeepSeek's[1][3] pricing page gives DeepSeek-V4.1-Flash a 1M context length and 384K maximum output, and per-million-token prices of $0.15 input (cache miss) and $0.60 output off-peak, $0.30 and $1.20 at peak, with peak hours 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- [3]90%DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docsapi-docs.deepseek.com· Pubblicato il 10 set 2026· Inizio 10 set 2026· 14% del punteggio
DeepSeek's[1][2] developer-docs copy of the announcement, listed as "DeepSeek-V4.1-Flash Release 2026/09/10": the model name deepseek-flash, the retirement of V4-Flash and V4-Flash-Vision-Exp, and "Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates".
- [4]90%deepseek-ai/DeepSeek-V4.1-Flash · Hugging Facehuggingface.co· Pubblicato il 10 set 2026· 14% del punteggio
The official model card: 552B backbone parameters, a Causal Encoder-Decoder that activates 8B parameters per token in prefill and 16B in decode, a KV cache of 890 bytes per token, 45T pre-training tokens, the MIT license, and the benchmark table against Opus 5.0, GPT-5.6 Sol, Kimi K3 and GLM-5.3.[1]
- [5]85%DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLEsiliconangle.com· Pubblicato il 10 set 2026· Inizio 10 set 2026· 14% del punteggio
SiliconANGLE's same-day report ("today released DeepSeek[1][2][3]-V4.1-Flash") works out that rerouted V4-Pro callers pay $1.20 instead of $3.96 per million output tokens at peak, "a cut of roughly 70%", and notes Anthropic named DeepSeek in a distillation report the same day.
Suggerisci una correzione
Manca qualcosa o c’è un errore? Dillo con parole tue: un link che conferma questo pin, una data di inizio o fine diversa e perché, o un fatto che manca o è sbagliato. L’IA lo confronta con le fonti del pin, ne cerca di migliori e aggiunge qualsiasi pagina ti dia ragione. Le fonti del pin contano comunque di più. Anche un’immagine che mostra altro, o lo mostra male, viene esaminata e spostata in basso o sostituita.