谷歌作为最新Gemini系列的一部分,发布了Gemini 3.1 Flash-Lite模型,试图在人工智能领域实现又一次飞跃。该模型在设计时考虑了经济性,定价为每百万输入令牌0.25美元,每百万输出令牌1.50美元。这相对于Gemini 3.1 Pro而言成本较低。
Gemini 3.1 Flash-Lite相比其他Gemini模型拥有更快的速度。内部实验结果显示,与之前的Gemini 2.5 Flash模型相比,其整体响应生成速度提升了45%,生成第一个输出令牌前的等待时间缩短了2.5倍。
该模型能够处理最多100万个令牌的多模态提示,并能生成包含64,000个令牌的响应,可用于生成基于文本的可视化资产,如软件代码。在11项基准测试中,它展现了部分卓越的性能,特别是在GPAQ Diamond测试中取得了优异成绩。
Gemini 3.1 Flash-Lite更适合大规模任务,而非需要高度推理能力的任务。谷歌展示了利用该模型的演示,例如通过自然语言提示生成天气追踪仪表板,或为电子商务网站添加产品列表等。
这款新模型通过Google Cloud的Vertex AI和Google AI Studio以预览版形式提供,开发者可借此构建简单的应用程序。


