- เริ่ม
- 10 ก.ย. 2026ความเชื่อมั่น 90%จาก แหล่งที่มา
เปิดตัว DeepSeek-V4.1-Flash
แปลอัตโนมัติจากต้นฉบับ
ชื่อต้นฉบับ: DeepSeek-V4.1-Flash Released
- DeepSeek เปิดตัว DeepSeek-V4.1-Flash เมื่อวันที่ 10 กันยายน 2026 “โมเดลที่เล็กที่สุดในตระกูลสถาปัตยกรรมใหม่ของเรา พร้อมความเข้าใจภาพโดยกำเนิด” ใช้งานจริงบน DeepSeek API ในชื่อ
deepseek-flashและในแอปเว็บและมือถือของ DeepSeek[1][5] - V4-Flash และ V4-Flash-Vision-Exp รุ่นทดลองถูกยกเลิกและชื่อโมเดลถูกส่งต่อไปยัง V4.1-Flash DeepSeek “กำลังทยอยเลิก V4-Pro” และตั้งแต่ 04:00 UTC วันที่ 14 กันยายน ทุกคำขอ
deepseek-v4-proจะถูกตอบด้วย V4.1-Flash ในอัตราของ V4.1-Flash จนกว่า V4.1-Pro จะเปิดตัว[1][3] - ราคา API ใหม่ที่ต่ำลงมีผลตั้งแต่ 04:00 UTC วันที่ 10 กันยายน SiliconANGLE คำนวณว่าผู้ใช้ V4-Pro ตอนนี้จ่าย 1.20 ดอลลาร์แทน 3.96 ดอลลาร์ต่อหนึ่งล้านโทเค็นเอาต์พุตในช่วงพีก ลดลงราว 70%[1][5]
- น้ำหนักโมเดลอยู่บน Hugging Face ภายใต้สัญญาอนุญาต MIT[4][5]
- Reuters ระบุว่าการเปิดตัวเกิดขึ้นขณะ DeepSeek เริ่มเตรียมการเสนอขายหุ้นต่อประชาชนครั้งแรกในตลาด STAR ของเซี่ยงไฮ้[6]
จุดเด่น
- โมเดล mixture-of-experts ขนาด 552B พารามิเตอร์ ด้วยสถาปัตยกรรม Causal Encoder-Decoder ใหม่ที่เปิดใช้งาน “เพียง 8B พารามิเตอร์สำหรับอินพุต และ 16B สำหรับเอาต์พุต” ฝึกล่วงหน้าตั้งแต่ต้นด้วยข้อความและรูปภาพ 45T โทเค็น[1][4]
- KV cache ของโมเดลอยู่ที่ 890 ไบต์ต่อโทเค็น ประมาณ 1/4 ของ V4-Flash ในหน่วยความจำ และใช้พื้นที่ SSD เพียง 1/8 โดย DeepSeek ระบุว่า “ค่าบริการเมื่อแคชถูกใช้มักเป็นสัดส่วนใหญ่ของต้นทุนเอเจนต์”[1][4]
- ข้อมูลจำเพาะ: บริบท 1M โทเค็น เอาต์พุตสูงสุด 384K โทเค็น โหมดคิดและไม่คิด การตั้งค่าความพยายามในการให้เหตุผลตั้งแต่ 1 ถึง 100 อินพุตรูปภาพโดยกำเนิด การเรียกใช้เครื่องมือ และ API รูปแบบเดียวกับ Anthropic[2][4]
- ราคาต่อหนึ่งล้านโทเค็น: อินพุต 0.15 ดอลลาร์และเอาต์พุต 0.60 ดอลลาร์ในช่วงนอกพีก 0.30 ดอลลาร์และ 1.20 ดอลลาร์ในช่วงพีก (วันธรรมดา 01:00-04:00 และ 06:00-10:00 UTC) โดยแคชที่ถูกใช้ราคา 0.003 ดอลลาร์ในช่วงนอกพีก[2]
- ที่ความพยายามสูงสุด DeepSeek รายงาน 90.6 ใน Terminal-Bench 2.1 เทียบกับ 89.1 ของ Claude Opus 5 และ 88.8 ของ GPT-5.6 Sol, 74.2% ใน DeepSWE v1.1 เทียบกับ 74.0 และ 73.0 (V4-Pro 62.7) และ 88.1 ใน CyberGym ส่วนโมเดลสหรัฐฯ ทั้งสองยังนำใน GPQA Diamond (93.4 และ 94.1 เทียบกับ 90.9)[4][5]
แหล่งอ้างอิง 7ความเชื่อมั่น 85%ความเชื่อมั่นโดยรวม: 85%แหล่งที่มาและแหล่งอ้างอิงของหมุดยืนยันวันที่ได้ดีเพียงใดค่าเฉลี่ยถ่วงน้ำหนักว่าแหล่งอ้างอิง 7 แหล่ง รวมแหล่งที่มา สนับสนุนเวลาเริ่มและสิ้นสุดของหมุดมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุดแสดงหมุดทั้งหมดที่มีความเชื่อมั่น 75% ขึ้นไป
รายการแรกคือแหล่งที่มาของหมุดเสมอ ความเชื่อมั่นโดยรวมคือค่าเฉลี่ยถ่วงน้ำหนักว่าแต่ละแหล่งอ้างอิงสนับสนุนเวลาเริ่มและสิ้นสุดด้านบนมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุด
- [1]90%deepseek.com/en/news/deepseek-v4-1-flashdeepseek.com· โพสต์ 28 ก.ย. 2026· เริ่ม 10 ก.ย. 2026 ✓· 15% ของคะแนน
ประกาศของ DeepSeek[2][3] ลงวันที่ “10 กันยายน 2026” และระบุว่า “V4.1-Flash ใช้งานจริงบน DeepSeek API แล้ว” บันทึกการเปลี่ยนแปลงในเอกสาร API ระบุ “DeepSeek-V4.1-Flash Release 2026/09/10” และ Reuters รายงานว่า DeepSeek “วันนี้ (10 กันยายน) เปิดตัว DeepSeek-V4.1-Flash”
- [2]90%Models & Pricing | DeepSeek API Docsapi-docs.deepseek.com· เพิ่มเมื่อ 28 ก.ย. 2026· 15% ของคะแนน
DeepSeek's[1][3] pricing page gives DeepSeek-V4.1-Flash a 1M context length and 384K maximum output, and per-million-token prices of $0.15 input (cache miss) and $0.60 output off-peak, $0.30 and $1.20 at peak, with peak hours 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- [3]90%DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docsapi-docs.deepseek.com· เผยแพร่ 10 ก.ย. 2026· เริ่ม 10 ก.ย. 2026· 14% ของคะแนน
DeepSeek's[1][2] developer-docs copy of the announcement, listed as "DeepSeek-V4.1-Flash Release 2026/09/10": the model name deepseek-flash, the retirement of V4-Flash and V4-Flash-Vision-Exp, and "Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates".
- [4]90%deepseek-ai/DeepSeek-V4.1-Flash · Hugging Facehuggingface.co· เผยแพร่ 10 ก.ย. 2026· 14% ของคะแนน
The official model card: 552B backbone parameters, a Causal Encoder-Decoder that activates 8B parameters per token in prefill and 16B in decode, a KV cache of 890 bytes per token, 45T pre-training tokens, the MIT license, and the benchmark table against Opus 5.0, GPT-5.6 Sol, Kimi K3 and GLM-5.3.[1]
- [5]85%DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLEsiliconangle.com· เผยแพร่ 10 ก.ย. 2026· เริ่ม 10 ก.ย. 2026· 14% ของคะแนน
SiliconANGLE's same-day report ("today released DeepSeek[1][2][3]-V4.1-Flash") works out that rerouted V4-Pro callers pay $1.20 instead of $3.96 per million output tokens at peak, "a cut of roughly 70%", and notes Anthropic named DeepSeek in a distillation report the same day.
เสนอการแก้ไข
มีอะไรขาดหรือผิดไหม บอกด้วยคำพูดของคุณเอง: ลิงก์ที่สนับสนุนหมุดนี้ วันที่เริ่มหรือสิ้นสุดที่ต่างออกไปพร้อมเหตุผล หรือข้อเท็จจริงที่ขาดหรือผิด AI จะตรวจสอบกับแหล่งที่มาของหมุด ค้นหาแหล่งที่ดีกว่า และเพิ่มหน้าที่สนับสนุนคุณ แหล่งที่มาของหมุดเองยังคงมีน้ำหนักมากที่สุด รูปภาพที่แสดงสิ่งอื่นหรือแสดงได้ไม่ดีก็จะถูกตรวจสอบ และเลื่อนลงหรือแทนที่