- 开始
- 2026年3月3日可信度 90%来自来源
Gemini 3.1 Flash-Lite 发布
由原文自动翻译
原标题: Gemini 3.1 Flash-Lite Released
谷歌发布Gemini 3.1 Flash-Lite预览版,这是Gemini 3系列中速度最快、成本效益最高的模型,定价为每百万输入token 0.25美元、每百万输出token 1.50美元。
- 谷歌于2026年3月3日推出Gemini 3.1 Flash-Lite,称其为“Gemini 3系列中速度最快、成本效益最高的模型”,面向大批量开发者工作负载[1]
- 它比2.5 Flash更快,首个回答token的响应速度快2.5倍,输出速度提升45%,质量相当或更好[1]
主要特性
- 定价为每百万输入token 0.25美元、每百万输出token 1.50美元[1]
- 适用于翻译、内容审核、生成用户界面和构建模拟[1]
- 预览版可通过Google AI Studio和Vertex AI中的Gemini API使用[1]
基准测试[3]
| 基准测试 | Gemini 3.1 Flash-Lite | Gemini 2.5 Flash | Gemini 2.5 Flash-Lite | GPT-5 mini | Claude 4.5 Haiku | Grok 4.1 Fast |
|---|---|---|---|---|---|---|
| 输入价格(美元/百万token,无缓存,越低越好) | $0.25 | $0.30 | $0.10 | $0.25 | $1.00 | $0.20 |
| 输出价格(美元/百万token,越低越好) | $1.50 | $2.50 | $0.40 | $2.00 | $5.00 | $0.50 |
| 输出速度(token/秒) | 363 | 249 | 366 | 71 | 108 | 145 |
| Humanity’s Last Exam(学术推理,完整集,文本+多模态,不使用工具) | 16.0% | 11.0% | 6.9% | 16.7% | 9.7% | 17.6% |
| GPQA Diamond(科学知识,不使用工具) | 86.9% | 82.8% | 66.7% | 82.3% | 73.0% | 84.3% |
| MMMU-Pro(多模态理解与推理,不使用工具) | 76.8% | 66.7% | 51.0% | 74.1% | 58.0% | 63.0% |
| CharXiv Reasoning(复杂图表的信息综合) | 73.2% | 63.7% | 55.5% | 75.5% | 61.7% | 31.6% |
| Video-MMMU(从视频中获取知识) | 84.8% | 79.2% | 60.7% | 82.5% | — | 74.6% |
| SimpleQA Verified(参数化知识) | 43.3% | 28.1% | 11.5% | 9.5% | 5.5% | 19.5% |
| FACTS Benchmark Suite(涵盖依据、参数化、搜索和多模态的事实性基准) | 40.6% | 50.4% | 17.9% | 33.7% | 18.6% | 42.1% |
| MMMLU(多语言问答) | 88.9% | 86.6% | 84.5% | 84.9% | 83.0% | 86.8% |
| LiveCodeBench(代码生成(UI:2025年1月1日至5月1日)) | 72.0% | 62.6% | 34.3% | 80.4% | 53.2% | 76.5% |
| MRCR v2 (8-needle)(长上下文表现,128k(平均)) | 60.1% | 54.3% | 30.6% | 52.5% | 35.3% | 54.6% |
| MRCR v2 (8-needle)(长上下文表现,1M(逐点)) | 12.3% | 21.0% | 5.4% | — | — | 6.1% |
参考资料 3可信度 85%总体可信度: 85%该图钉的来源和参考资料对其日期的支持程度。包括来源在内的 3 份资料对图钉开始和结束时间支持程度的加权平均;资料每比最新的一份旧 180 天,权重减半显示所有可信度不低于 75% 的图钉
第一项始终是图钉的来源。总体可信度是各份资料对上方所用开始和结束时间支持程度的加权平均;资料每比最新的一份旧 180 天,权重减半。
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-flash-liteblog.google· 发布于 2026年9月30日· 开始 2026年3月3日 ✓· 占评分 41%
谷歌文章《Gemini 3.1 Flash-Lite: Built for intelligence at scale》日期为2026年3月3日,并称当天起向开发者通过Gemini API、向企业通过Vertex AI推出预览版。
- [2]75%Gemini (language model) - Wikipediaen.wikipedia.org· 添加于 2026年9月30日· 占评分 41%
The Wikipedia article lists Gemini 3.1 Flash-Lite as released on 3 March 2026.
- [3]95%Gemini 3.1 Flash-Lite - Model Carddeepmind.google· 发表于 2026年3月3日· 占评分 18%
DeepMind's model card gives the benchmark table against the model's predecessor and named rivals.
建议更正
有遗漏或错误吗?用你自己的话说明:能佐证此图钉的链接、不同的开始或结束日期及理由,或缺失、有误的信息。AI 会对照此图钉的来源进行核实,搜索更好的来源,并添加任何支持你说法的页面。图钉自身的来源仍然最重要。AI 也会查看图片:显示的是别的东西或显示效果差的图片会被移到后面或替换。