- शुरुआत
- 10 सित॰ 202690% कॉन्फ़िडेंससोर्स से
DeepSeek ने DeepSeek-V4.1-Flash रिलीज़ किया
मूल भाषा से अपने आप अनुवादित
मूल शीर्षक: DeepSeek-V4.1-Flash Released
- DeepSeek ने 10 सितंबर 2026 को DeepSeek-V4.1-Flash रिलीज़ किया, यानी "नैटिव विज़ुअल समझ वाला, हमारे नए आर्किटेक्चर फ़ैमिली का सबसे छोटा मॉडल", जो DeepSeek API पर
deepseek-flashके रूप में और DeepSeek के वेब व मोबाइल ऐप में लाइव है[1][5] - V4-Flash और एक्सपेरिमेंटल V4-Flash-Vision-Exp को रिटायर कर दिया गया है और इनके मॉडल नाम V4.1-Flash की ओर रूट होते हैं; DeepSeek "V4-Pro को धीरे-धीरे हटा रहा है", और 14 सितंबर को 04:00 UTC से हर
deepseek-v4-proरिक्वेस्ट का जवाब V4.1-Flash की दरों पर V4.1-Flash देता है, जब तक V4.1-Pro लॉन्च नहीं होता[1][3] - नई, कम API कीमतें 10 सितंबर को 04:00 UTC से लागू हुईं; SiliconANGLE के हिसाब से पीक समय पर एक V4-Pro कॉलर अब प्रति मिलियन आउटपुट टोकन पर $3.96 के बजाय $1.20 चुकाता है, यानी लगभग 70% की कटौती[1][5]
- इसके वेट्स Hugging Face पर MIT लाइसेंस के तहत उपलब्ध हैं[4][5]
- Reuters बताता है कि यह रिलीज़ ऐसे समय आई जब DeepSeek, Shanghai के STAR Market पर अपने इनिशियल पब्लिक ऑफ़रिंग की तैयारी शुरू कर रहा है[6]
प्रमुख विशेषताएँ
- 552B-पैरामीटर वाला मिक्सचर-ऑफ़-एक्सपर्ट्स मॉडल, जिसमें एक नया Causal Encoder-Decoder आर्किटेक्चर है, जो "इनपुट के लिए सिर्फ़ 8B और आउटपुट के लिए 16B एक्टिव पैरामीटर" एक्टिवेट करता है, जिसे टेक्स्ट और इमेज के 45T टोकन पर शुरू से प्री-ट्रेन किया गया है[1][4]
- इसका KV कैश प्रति टोकन 890 बाइट्स है, जो मेमोरी में V4-Flash के लगभग 1/4 है, और इसे SSD स्टोरेज का सिर्फ़ 1/8 चाहिए; DeepSeek बताता है कि "कैश-हिट चार्ज अक्सर एजेंट की लागत का बड़ा हिस्सा होते हैं"[1][4]
- स्पेसिफ़िकेशन: 1M-टोकन कॉन्टेक्स्ट, 384K तक आउटपुट टोकन, थिंकिंग और नॉन-थिंकिंग मोड, 1 से 100 तक रीज़निंग-इफ़र्ट सेटिंग, नैटिव इमेज इनपुट, टूल कॉल और एक Anthropic-फ़ॉर्मैट API[2][4]
- प्रति मिलियन टोकन कीमतें: ऑफ़-पीक पर $0.15 इनपुट और $0.60 आउटपुट, पीक पर (सप्ताह के दिनों में 01:00-04:00 और 06:00-10:00 UTC) $0.30 और $1.20, और ऑफ़-पीक पर कैश हिट $0.003 पर[2]
- मैक्सिमम इफ़र्ट पर DeepSeek Terminal-Bench 2.1 पर 90.6 बताता है, जबकि Claude Opus 5 का 89.1 और GPT-5.6 Sol का 88.8 है; DeepSWE v1.1 पर 74.2%, जबकि 74.0 और 73.0 (V4-Pro का 62.7); और CyberGym पर 88.1; हालाँकि दोनों US मॉडल अब भी GPQA Diamond पर आगे हैं (93.4 और 94.1, जबकि 90.9)[4][5]
संदर्भ 785% कॉन्फ़िडेंसकुल भरोसा: 85%पिन का स्रोत और संदर्भ उसकी तारीखों की कितनी पुष्टि करते हैं।सोर्स सहित 7 संदर्भ पिन के शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करते हैं, इसका भारित औसत; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है75% या उससे बेहतर कॉन्फ़िडेंस वाले सभी पिन दिखाएं
पहली एंट्री हमेशा पिन का सोर्स होती है। कुल कॉन्फ़िडेंस एक भारित औसत है कि हर संदर्भ ऊपर इस्तेमाल किए गए शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करता है; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है।
- [1]90%deepseek.com/en/news/deepseek-v4-1-flashdeepseek.com· 28 सित॰ 2026 को पोस्ट किया गया· शुरुआत 10 सित॰ 2026 ✓· स्कोर का 15%
DeepSeek[2][3] की घोषणा पर तारीख़ "September 10, 2026" है, और उसमें कहा गया है 'V4.1-Flash अब DeepSeek API पर लाइव है'; इसका API-docs चेंजलॉग 'DeepSeek-V4.1-Flash Release 2026/09/10' सूचीबद्ध करता है, और Reuters की रिपोर्ट है कि DeepSeek ने 'आज (10 सितंबर) DeepSeek-V4.1-Flash लॉन्च किया।'
- [2]90%Models & Pricing | DeepSeek API Docsapi-docs.deepseek.com· 28 सित॰ 2026 को जोड़ा गया· स्कोर का 15%
DeepSeek's[1][3] pricing page gives DeepSeek-V4.1-Flash a 1M context length and 384K maximum output, and per-million-token prices of $0.15 input (cache miss) and $0.60 output off-peak, $0.30 and $1.20 at peak, with peak hours 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- [3]90%DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docsapi-docs.deepseek.com· 10 सित॰ 2026 को प्रकाशित· शुरुआत 10 सित॰ 2026· स्कोर का 14%
DeepSeek's[1][2] developer-docs copy of the announcement, listed as "DeepSeek-V4.1-Flash Release 2026/09/10": the model name deepseek-flash, the retirement of V4-Flash and V4-Flash-Vision-Exp, and "Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates".
- [4]90%deepseek-ai/DeepSeek-V4.1-Flash · Hugging Facehuggingface.co· 10 सित॰ 2026 को प्रकाशित· स्कोर का 14%
The official model card: 552B backbone parameters, a Causal Encoder-Decoder that activates 8B parameters per token in prefill and 16B in decode, a KV cache of 890 bytes per token, 45T pre-training tokens, the MIT license, and the benchmark table against Opus 5.0, GPT-5.6 Sol, Kimi K3 and GLM-5.3.[1]
- [5]85%DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLEsiliconangle.com· 10 सित॰ 2026 को प्रकाशित· शुरुआत 10 सित॰ 2026· स्कोर का 14%
SiliconANGLE's same-day report ("today released DeepSeek[1][2][3]-V4.1-Flash") works out that rerouted V4-Pro callers pay $1.20 instead of $3.96 per million output tokens at peak, "a cut of roughly 70%", and notes Anthropic named DeepSeek in a distillation report the same day.
सुधार सुझाएं
कुछ छूट गया या गलत है? अपने शब्दों में बताएं: कोई लिंक जो इस पिन का समर्थन करता हो, कोई अलग शुरुआत या खत्म होने की तारीख और उसकी वजह, या कोई तथ्य जो छूट गया हो या गलत हो। AI इसे इस पिन के सोर्स से मिलाकर जांचता है, बेहतर सोर्स खोजता है, और जो भी पेज आपकी बात का समर्थन करता है उसे जोड़ देता है। पिन के अपने सोर्स की अहमियत फिर भी सबसे ज़्यादा रहती है। AI तस्वीरें भी देखता है: जो तस्वीर कुछ और दिखाती हो या ठीक से न दिखाती हो, उसे नीचे कर दिया जाता है या बदल दिया जाता है।