- Mula
- 10 Sep 202690% KEYAKINANdaripada sumber
DeepSeek-V4.1-Flash Dikeluarkan
Diterjemah secara automatik daripada asal
Tajuk asal: DeepSeek-V4.1-Flash Released
- DeepSeek mengeluarkan DeepSeek-V4.1-Flash pada 10 September 2026, "model terkecil dalam keluarga seni bina baharu kami, dengan pemahaman visual asli", beroperasi pada API DeepSeek sebagai
deepseek-flashdan dalam aplikasi web dan mudah alih DeepSeek[1][5] - V4-Flash dan V4-Flash-Vision-Exp eksperimen telah dihentikan dan nama modelnya dihalakan ke V4.1-Flash; DeepSeek sedang "menghentikan V4-Pro secara berperingkat", dan mulai 04:00 UTC pada 14 September setiap permintaan
deepseek-v4-prodijawab oleh V4.1-Flash pada kadar V4.1-Flash sehingga V4.1-Pro dilancarkan[1][3] - Harga API baharu yang lebih rendah berkuat kuasa pada 04:00 UTC pada 10 September; SiliconANGLE mengira bahawa pemanggil V4-Pro kini membayar $1.20 dan bukannya $3.96 sejuta token output pada waktu puncak, pemotongan kira-kira 70%[1][5]
- Beratnya ada di Hugging Face di bawah lesen MIT[4][5]
- Reuters menyatakan keluaran itu berlaku ketika DeepSeek mula bersiap untuk tawaran awam permulaan di STAR Market Shanghai[6]
Ciri-ciri menonjol
- Model campuran pakar 552B parameter dengan seni bina Causal Encoder-Decoder baharu yang mengaktifkan "hanya 8B parameter aktif untuk input, 16B untuk output", dilatih awal dari awal pada 45T token teks dan imej[1][4]
- Cache KV-nya ialah 890 bait setiap token, kira-kira 1/4 daripada V4-Flash dalam memori, dan memerlukan 1/8 storan SSD; DeepSeek menyatakan bahawa "caj cache-hit sering menyumbang bahagian besar kos ejen"[1][4]
- Spesifikasi: konteks 1M token, sehingga 384K output, mod pemikiran dan tanpa pemikiran, tetapan usaha penaakulan dari 1 hingga 100, input imej asli, panggilan alat dan API format Anthropic[2][4]
- Harga setiap sejuta token: $0.15 input dan $0.60 output di luar puncak, $0.30 dan $1.20 pada waktu puncak (hari bekerja 01:00-04:00 dan 06:00-10:00 UTC), dengan cache hit pada $0.003 di luar puncak[2]
- Pada usaha maksimum DeepSeek melaporkan 90.6 pada Terminal-Bench 2.1 berbanding 89.1 Claude Opus 5 dan 88.8 GPT-5.6 Sol, 74.2% pada DeepSWE v1.1 berbanding 74.0 dan 73.0 (V4-Pro 62.7), dan 88.1 pada CyberGym; kedua-dua model A.S. masih mendahului pada GPQA Diamond (93.4 dan 94.1 berbanding 90.9)[4][5]
Rujukan 785% KEYAKINANKeyakinan keseluruhan: 85%Sejauh mana sumber dan rujukan pin menyokong tarikhnya.Purata berpemberat bagi sejauh mana 7 rujukan, termasuk sumber, menyokong masa mula dan tamat pin; sesebuah rujukan diambil kira separuh kurang bagi setiap 180 hari lebih lama daripada yang terbaharuTunjuk semua pin pada keyakinan 75% atau lebih baik
Entri pertama sentiasa sumber pin. Keyakinan keseluruhan ialah purata berpemberat bagi sejauh mana setiap rujukan menyokong masa mula dan tamat yang digunakan di atas; sesebuah rujukan diambil kira separuh kurang bagi setiap 180 hari lebih lama daripada yang terbaharu.
- [1]90%deepseek.com/en/news/deepseek-v4-1-flashdeepseek.com· Disiarkan 28 Sep 2026· Bermula 10 Sep 2026 ✓· 15% daripada skor
Pengumuman DeepSeek[2][3] bertarikh "10 September 2026" dan berkata "V4.1-Flash kini beroperasi pada API DeepSeek"; log perubahan dokumen API-nya menyenaraikan "DeepSeek-V4.1-Flash Release 2026/09/10", dan Reuters melaporkan DeepSeek "hari ini (10 September) melancarkan DeepSeek-V4.1-Flash".
- [2]90%Models & Pricing | DeepSeek API Docsapi-docs.deepseek.com· Ditambah 28 Sep 2026· 15% daripada skor
DeepSeek's[1][3] pricing page gives DeepSeek-V4.1-Flash a 1M context length and 384K maximum output, and per-million-token prices of $0.15 input (cache miss) and $0.60 output off-peak, $0.30 and $1.20 at peak, with peak hours 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- [3]90%DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docsapi-docs.deepseek.com· Diterbitkan 10 Sep 2026· Bermula 10 Sep 2026· 14% daripada skor
DeepSeek's[1][2] developer-docs copy of the announcement, listed as "DeepSeek-V4.1-Flash Release 2026/09/10": the model name deepseek-flash, the retirement of V4-Flash and V4-Flash-Vision-Exp, and "Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates".
- [4]90%deepseek-ai/DeepSeek-V4.1-Flash · Hugging Facehuggingface.co· Diterbitkan 10 Sep 2026· 14% daripada skor
The official model card: 552B backbone parameters, a Causal Encoder-Decoder that activates 8B parameters per token in prefill and 16B in decode, a KV cache of 890 bytes per token, 45T pre-training tokens, the MIT license, and the benchmark table against Opus 5.0, GPT-5.6 Sol, Kimi K3 and GLM-5.3.[1]
- [5]85%DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLEsiliconangle.com· Diterbitkan 10 Sep 2026· Bermula 10 Sep 2026· 14% daripada skor
SiliconANGLE's same-day report ("today released DeepSeek[1][2][3]-V4.1-Flash") works out that rerouted V4-Pro callers pay $1.20 instead of $3.96 per million output tokens at peak, "a cut of roughly 70%", and notes Anthropic named DeepSeek in a distillation report the same day.
Cadangkan pembetulan
Ada yang tertinggal atau salah? Nyatakan dengan kata-kata anda sendiri: pautan yang menyokong pin ini, tarikh mula atau tamat yang berbeza beserta sebabnya, atau fakta yang tiada atau tersilap. AI menyemaknya berbanding sumber pin ini, mencari yang lebih baik, dan menambah mana-mana halaman yang menyokong anda. Sumber pin itu sendiri tetap paling diambil kira. Gambar yang menunjukkan sesuatu yang lain, atau menunjukkannya dengan buruk, turut dilihat, dan dialihkan ke bawah atau diganti.