- Bắt đầu
- 10 thg 9, 2026ĐỘ TIN CẬY 90%từ nguồn
DeepSeek-V4.1-Flash ra mắt
Được dịch tự động từ bản gốc
Tiêu đề gốc: DeepSeek-V4.1-Flash Released
- Ngày 10 tháng 9 năm 2026, DeepSeek phát hành DeepSeek-V4.1-Flash, “mô hình nhỏ nhất trong họ kiến trúc mới của chúng tôi, với khả năng hiểu hình ảnh nguyên bản”, hoạt động trên API DeepSeek với tên
deepseek-flashvà trong ứng dụng web và di động của DeepSeek[1][5] - V4-Flash và V4-Flash-Vision-Exp thử nghiệm bị ngừng, tên mô hình của chúng được chuyển hướng sang V4.1-Flash; DeepSeek đang “loại bỏ dần V4-Pro”, và từ 04:00 UTC ngày 14 tháng 9, mọi yêu cầu
deepseek-v4-prođều được V4.1-Flash trả lời theo mức giá của V4.1-Flash cho đến khi V4.1-Pro ra mắt[1][3] - Mức giá API mới, thấp hơn có hiệu lực từ 04:00 UTC ngày 10 tháng 9; SiliconANGLE tính rằng người gọi V4-Pro nay trả 1.20 đô la thay vì 3.96 đô la cho mỗi triệu token đầu ra vào giờ cao điểm, giảm khoảng 70%[1][5]
- Trọng số có trên Hugging Face theo giấy phép MIT[4][5]
- Reuters lưu ý bản phát hành diễn ra khi DeepSeek bắt đầu chuẩn bị cho đợt phát hành cổ phiếu lần đầu ra công chúng (IPO) trên sàn STAR Market của Thượng Hải[6]
Tính năng nổi bật
- Mô hình kết hợp nhiều chuyên gia 552B tham số với kiến trúc Causal Encoder-Decoder mới, kích hoạt “chỉ 8B tham số hoạt động cho đầu vào, 16B cho đầu ra”, được huấn luyện trước từ đầu trên 45T token văn bản và hình ảnh[1][4]
- Bộ nhớ đệm KV của nó là 890 byte mỗi token, bằng khoảng 1/4 của V4-Flash về bộ nhớ, và cần 1/8 dung lượng SSD; DeepSeek lưu ý rằng “phí trúng bộ nhớ đệm thường chiếm một phần lớn chi phí của tác tử”[1][4]
- Thông số: ngữ cảnh 1M token, tối đa 384K token đầu ra, chế độ suy nghĩ và không suy nghĩ, thiết lập mức nỗ lực suy luận từ 1 đến 100, đầu vào hình ảnh nguyên bản, gọi công cụ và API theo định dạng Anthropic[2][4]
- Giá cho mỗi triệu token: 0.15 đô la đầu vào và 0.60 đô la đầu ra ngoài giờ cao điểm, 0.30 đô la và 1.20 đô la vào giờ cao điểm (các ngày trong tuần 01:00-04:00 và 06:00-10:00 UTC), với trúng bộ nhớ đệm là 0.003 đô la ngoài giờ cao điểm[2]
- Ở mức nỗ lực tối đa, DeepSeek báo cáo 90.6 trên Terminal-Bench 2.1 so với 89.1 của Claude Opus 5 và 88.8 của GPT-5.6 Sol, 74.2% trên DeepSWE v1.1 so với 74.0 và 73.0 (V4-Pro đạt 62.7), và 88.1 trên CyberGym; cả hai mô hình của Mỹ vẫn dẫn đầu trên GPQA Diamond (93.4 và 94.1 so với 90.9)[4][5]
Tài liệu tham khảo 7ĐỘ TIN CẬY 85%Độ tin cậy tổng thể: 85%Mức độ nguồn và tài liệu tham khảo của ghim củng cố các ngày của nó.Trung bình có trọng số về mức độ 7 tài liệu, gồm cả nguồn, ủng hộ thời điểm bắt đầu và kết thúc của ghim; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhấtHiện tất cả ghim có độ tin cậy từ 75% trở lên
Mục đầu tiên luôn là nguồn của ghim. Độ tin cậy tổng thể là trung bình có trọng số về mức độ mỗi tài liệu ủng hộ thời điểm bắt đầu và kết thúc được dùng ở trên; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhất.
- [1]90%deepseek.com/en/news/deepseek-v4-1-flashdeepseek.com· Đăng 28 thg 9, 2026· Bắt đầu 10 thg 9, 2026 ✓· 15% điểm số
Thông báo của DeepSeek[2][3] đề ngày “September 10, 2026” và nói “V4.1-Flash hiện đã hoạt động trên API DeepSeek”; nhật ký thay đổi trong tài liệu API của hãng liệt kê “DeepSeek-V4.1-Flash Release 2026/09/10”, và Reuters đưa tin DeepSeek “hôm nay (10 tháng 9) đã ra mắt DeepSeek-V4.1-Flash”.
- [2]90%Models & Pricing | DeepSeek API Docsapi-docs.deepseek.com· Thêm 28 thg 9, 2026· 15% điểm số
DeepSeek's[1][3] pricing page gives DeepSeek-V4.1-Flash a 1M context length and 384K maximum output, and per-million-token prices of $0.15 input (cache miss) and $0.60 output off-peak, $0.30 and $1.20 at peak, with peak hours 01:00-04:00 and 06:00-10:00 UTC on weekdays.
- [3]90%DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docsapi-docs.deepseek.com· Xuất bản 10 thg 9, 2026· Bắt đầu 10 thg 9, 2026· 14% điểm số
DeepSeek's[1][2] developer-docs copy of the announcement, listed as "DeepSeek-V4.1-Flash Release 2026/09/10": the model name deepseek-flash, the retirement of V4-Flash and V4-Flash-Vision-Exp, and "Starting at 04:00 UTC on Sept 14, 2026, all deepseek-v4-pro requests will route to V4.1-Flash at V4.1-Flash rates".
- [4]90%deepseek-ai/DeepSeek-V4.1-Flash · Hugging Facehuggingface.co· Xuất bản 10 thg 9, 2026· 14% điểm số
The official model card: 552B backbone parameters, a Causal Encoder-Decoder that activates 8B parameters per token in prefill and 16B in decode, a KV cache of 890 bytes per token, 45T pre-training tokens, the MIT license, and the benchmark table against Opus 5.0, GPT-5.6 Sol, Kimi K3 and GLM-5.3.[1]
- [5]85%DeepSeek releases V4.1-Flash, says it outperforms flagship V4-Pro - SiliconANGLEsiliconangle.com· Xuất bản 10 thg 9, 2026· Bắt đầu 10 thg 9, 2026· 14% điểm số
SiliconANGLE's same-day report ("today released DeepSeek[1][2][3]-V4.1-Flash") works out that rerouted V4-Pro callers pay $1.20 instead of $3.96 per million output tokens at peak, "a cut of roughly 70%", and notes Anthropic named DeepSeek in a distillation report the same day.
Đề xuất chỉnh sửa
Thiếu hay sai điều gì? Hãy nói bằng lời của bạn: một liên kết củng cố ghim này, một ngày bắt đầu hoặc kết thúc khác kèm lý do, hoặc một thông tin còn thiếu hay sai. AI đối chiếu với các nguồn của ghim này, tìm nguồn tốt hơn và thêm mọi trang ủng hộ bạn. Các nguồn của chính ghim vẫn được tính nhiều nhất. Hình ảnh thể hiện nội dung khác hoặc thể hiện kém cũng được xem xét, rồi bị hạ xuống hoặc thay thế.