- Bắt đầu
- 3 thg 3, 2026ĐỘ TIN CẬY 90%từ nguồn
Gemini 3.1 Flash-Lite ra mắt
Được dịch tự động từ bản gốc
Tiêu đề gốc: Gemini 3.1 Flash-Lite Released
- Google giới thiệu Gemini 3.1 Flash-Lite vào ngày 3 tháng 3 năm 2026, “mô hình dòng Gemini 3 nhanh nhất và tiết kiệm chi phí nhất của chúng tôi”, được xây dựng cho các khối lượng công việc lớn của nhà phát triển[1]
- Mô hình nhanh hơn 2.5 Flash, với thời gian đến token trả lời đầu tiên nhanh hơn 2.5 lần và tốc độ đầu ra tăng 45% ở chất lượng tương đương hoặc tốt hơn[1]
Tính năng nổi bật
- Giá $0.25 cho mỗi triệu token đầu vào và $1.50 cho mỗi triệu token đầu ra[1]
- Phù hợp cho dịch thuật, kiểm duyệt nội dung, tạo giao diện người dùng và xây dựng mô phỏng[1]
- Bản xem trước qua Gemini API trong Google AI Studio và Vertex AI[1]
Điểm chuẩn[3]
| Bài kiểm tra | Gemini 3.1 Flash-Lite | Gemini 2.5 Flash | Gemini 2.5 Flash-Lite | GPT-5 mini | Claude 4.5 Haiku | Grok 4.1 Fast |
|---|---|---|---|---|---|---|
| Giá đầu vào ($/1M token, không lưu đệm, Càng thấp càng tốt) | $0.25 | $0.30 | $0.10 | $0.25 | $1.00 | $0.20 |
| Giá đầu ra ($/1M token, Càng thấp càng tốt) | $1.50 | $2.50 | $0.40 | $2.00 | $5.00 | $0.50 |
| Tốc độ đầu ra (Token / giây) | 363 | 249 | 366 | 71 | 108 | 145 |
| Humanity’s Last Exam (Lý luận học thuật (toàn bộ tập, văn bản + MM), Không dùng công cụ) | 16.0% | 11.0% | 6.9% | 16.7% | 9.7% | 17.6% |
| GPQA Diamond (Kiến thức khoa học, Không dùng công cụ) | 86.9% | 82.8% | 66.7% | 82.3% | 73.0% | 84.3% |
| MMMU-Pro (Hiểu và suy luận đa phương thức, Không dùng công cụ) | 76.8% | 66.7% | 51.0% | 74.1% | 58.0% | 63.0% |
| CharXiv Reasoning (Tổng hợp thông tin từ các biểu đồ phức tạp) | 73.2% | 63.7% | 55.5% | 75.5% | 61.7% | 31.6% |
| Video-MMMU (Tiếp thu kiến thức từ video) | 84.8% | 79.2% | 60.7% | 82.5% | — | 74.6% |
| SimpleQA Verified (Kiến thức tham số) | 43.3% | 28.1% | 11.5% | 9.5% | 5.5% | 19.5% |
| FACTS Benchmark Suite (Bài kiểm tra tính xác thực trên các mảng căn cứ, tham số, tìm kiếm và MM.) | 40.6% | 50.4% | 17.9% | 33.7% | 18.6% | 42.1% |
| MMMLU (Hỏi đáp đa ngôn ngữ) | 88.9% | 86.6% | 84.5% | 84.9% | 83.0% | 86.8% |
| LiveCodeBench (Tạo mã (UI: 1/1/2025-5/1/2025)) | 72.0% | 62.6% | 34.3% | 80.4% | 53.2% | 76.5% |
| MRCR v2 (8-needle) (Hiệu năng ngữ cảnh dài, 128k (trung bình)) | 60.1% | 54.3% | 30.6% | 52.5% | 35.3% | 54.6% |
| MRCR v2 (8-needle) (Hiệu năng ngữ cảnh dài, 1M (theo điểm)) | 12.3% | 21.0% | 5.4% | — | — | 6.1% |
Tài liệu tham khảo 3ĐỘ TIN CẬY 85%Độ tin cậy tổng thể: 85%Mức độ nguồn và tài liệu tham khảo của ghim củng cố các ngày của nó.Trung bình có trọng số về mức độ 3 tài liệu, gồm cả nguồn, ủng hộ thời điểm bắt đầu và kết thúc của ghim; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhấtHiện tất cả ghim có độ tin cậy từ 75% trở lên
Mục đầu tiên luôn là nguồn của ghim. Độ tin cậy tổng thể là trung bình có trọng số về mức độ mỗi tài liệu ủng hộ thời điểm bắt đầu và kết thúc được dùng ở trên; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhất.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-flash-liteblog.google· Đăng 30 thg 9, 2026· Bắt đầu 3 thg 3, 2026 ✓· 41% điểm số
Bài đăng “Gemini 3.1 Flash-Lite: Được xây dựng cho trí tuệ ở quy mô lớn” của Google đề ngày 3 tháng 3 năm 2026 và nêu rằng nó đang được triển khai bản xem trước ngay trong ngày hôm đó cho nhà phát triển qua Gemini API và cho doanh nghiệp qua Vertex AI.
- [2]75%Gemini (language model) - Wikipediaen.wikipedia.org· Thêm 30 thg 9, 2026· 41% điểm số
The Wikipedia article lists Gemini 3.1 Flash-Lite as released on 3 March 2026.
- [3]95%Gemini 3.1 Flash-Lite - Model Carddeepmind.google· Xuất bản 3 thg 3, 2026· 18% điểm số
DeepMind's model card gives the benchmark table against the model's predecessor and named rivals.
Đề xuất chỉnh sửa
Thiếu hay sai điều gì? Hãy nói bằng lời của bạn: một liên kết củng cố ghim này, một ngày bắt đầu hoặc kết thúc khác kèm lý do, hoặc một thông tin còn thiếu hay sai. AI đối chiếu với các nguồn của ghim này, tìm nguồn tốt hơn và thêm mọi trang ủng hộ bạn. Các nguồn của chính ghim vẫn được tính nhiều nhất. Hình ảnh thể hiện nội dung khác hoặc thể hiện kém cũng được xem xét, rồi bị hạ xuống hoặc thay thế.