谷歌发布人工智能(AI)语言模型"双子座3"产品系列的轻量模型,正式投身AI服务的价格与速度竞争。此次新产品的特点是在保持与原有高性能模型相似性能的同时,凭借更低的成本和更快的响应速度脱颖而出。
谷歌于当地时间12月17日公开了双子座3系列的新模型"Flash"。该模型旨在比同系列的高阶AI模型"Pro"和"DeepSeek"更轻量、响应更迅速。其核心在于通过"模型蒸馏"这一轻量化技术,压缩了Pro模型的核心性能,从而同时提升了处理速度并降低了服务成本。
双子座3 Flash在实际性能指标上也展现出引人注目的成果。在衡量通识知识与问题解决能力的MMLU-Pro、SWE-bench、GPQA等多种基准测试中,其得分与高阶模型相差无几,部分项目甚至表现更优。例如,在通识问题测试中,双子座3 Flash获得81.2分,小幅领先Pro模型(81%);在编码性能项目SWE-bench中也取得了78%的成绩,高于Pro模型。
该模型不仅应用于谷歌搜索等普通用户服务,也将适用于面向企业客户的API。尤其在企业层面,其成本节约效果显著。Flash模型可按每令牌0.5至3美元的费用使用,这仅为同系列高阶模型的四分之一左右。"令牌"是AI为处理信息而将句子细分的单位,考虑到目前每日使用量已超过1万亿令牌,处理速度与成本效益变得愈发重要。
此举可解读为谷歌针对近期生成式AI市场快速增长所采取的应对策略。其意图是在确保高性能模型带来的技术优势的同时,通过轻量模型提升用户可及性。特别是在追求无损性能的前提下同时实现快速处理与成本节约,使其有望广泛应用于聊天机器人、搜索、编码自动化等多种服务领域。
这一趋势值得关注,因其可能加速未来整个AI行业从"大型模型"向"定制化轻量模型"的转变。相较于固化的性能中心竞争,针对多样化需求制定的灵活产品线战略,正更有可能成为下一代AI市场的主流。


