今天,我们推出gemini 3.1 flash-lite,这是我们最快且最具成本效益的gemini 3系列机型。专为大规模大规模开发工作负载而设计,3.1 flash-lite 以其价格和型号等级提供高品质。
从今天开始,3.1 Flash-Lite 将通过谷歌AI Studio中的Gemini API面向开发者推出预览版,并通过Vertex AI面向企业推出。
无需妥协即可提高成本效益
售价仅为0.25亿美元(每百万美元)的输入代币和150万美元/百万美元的输出代币,3.1 Flash-Lite 以大型机型的一小部分成本实现了更高的性能。根据人工分析基准,它优于2.5 Flash,具有2.5倍更快的首次答案令牌速度和45%的输出速度,同时保持相似或更优的质量。高频工作流程需要这种低延迟,使其成为开发者构建响应式实时体验的理想模型。

3.1 Flash-Lite 在 Arena.ai 排行榜上以1432分的成绩获得Elo,在推理和多模态理解基准方面优于其他同类车型,其中GPQA Diamond的得分为86.9%,MMMU Pro的得分为76.8%,甚至超过了前几代(如2.5 Flash)的大型双子座车型。

面向开发者的大规模自适应智能
除了原始性能外,Gemini 3.1 Flash-Lite 还具备人工智能工作室和 Vertex AI 的思维水平标准,使开发者能够控制并灵活选择该模型对任务的“思考”程度,而该模型对于管理高频工作负载至关重要。3.1 Flash-Lite 可以大规模处理任务,例如大批量翻译和内容审核,其中成本是首要任务。它还能够处理更复杂的工作负载,需要更深入的推理,例如生成用户界面和仪表板、创建模拟或遵循指令。
早期获取AI Studio和Vertex AI的开发者,以及Latitude、Cartwheel和Whering等公司,已经使用3.1 Flash-Lite大规模解决复杂问题。早期测试人员强调了3.1 Flash-Lite的高效性和推理能力,表示它能够精确处理复杂的输入,并采用更大层次的模型,同时遵循指令并保持依从性。










