首页 > 新闻 > 科技 > 正文

Google发布三款全新Gemini模型,完善Gemini模型矩阵

2026-07-22 13:42:21
字体:
来源:转载
供稿:网友
7月22日消息,Google正式发布三款全新Gemini模型,包括Gemini 3.6 FlashGemini 3.5 Flash-LiteGemini 3.5 Flash Cyber,进一步完善Gemini模型矩阵。与此前围绕模型能力上限展开竞争不同,此次发布更加聚焦AI Agent时代开发者最关注的三个指标——效率、延迟和成本,希望帮助企业以更低成本构建和部署AI Agent。

Google表示,随着越来越多开发者和企业开始构建生产级AI Agent,更高的Token利用率、更低的响应延迟以及更加稳定可靠的模型表现,正成为新的核心需求。Flash系列模型正是围绕这一目标打造,在模型能力与运行效率之间寻求平衡,以支撑大规模Agent工作流。

此次更新中,Gemini 3.6 Flash成为新的主力模型。Google称,该模型基于开发者对Gemini 3.5 Flash的反馈进行了优化,不仅提升了编程、知识处理和多模态能力,还进一步提高了Token利用效率。

官方数据显示,在Artificial Analysis Index测试中,Gemini 3.6 Flash相比Gemini 3.5 Flash平均减少17%的输出Token,同时完成复杂多步骤任务时需要更少的推理步骤和工具调用,从而降低整体Agent运行成本。模型价格也同步下调至每百万输入Token 1.5美元、每百万输出Token 7.5美元。

Google同时公布了一系列基准测试结果。在DeepSWE、MLE Bench等编程与机器学习评测中,Gemini 3.6 Flash均较上一代实现性能提升,并进一步降低了无效代码修改和重复执行循环的情况。此外,新模型强化了针对化学、生物、放射性、核安全(CBRN)以及网络攻击等领域的安全防护能力,提高了抵御越狱攻击(Jailbreak)的能力,同时尽可能减少对正常使用场景的误拒绝。

除了主力模型,Google还推出了Gemini 3.5 Flash-Lite。

该模型定位于低延迟、高吞吐量场景,主要面向Agent搜索、文档处理等需要大规模调用的企业应用。Google表示,Gemini 3.5 Flash-Lite是目前3.5系列中速度最快的模型,根据Artificial Analysis测算,其输出速度可达到每秒350个Token。

价格方面,该模型进一步降低至每百万输入Token 0.3美元、每百万输出Token 2.5美元。官方称,相较Gemini 3.1 Flash-Lite,新模型在编程、长上下文理解、Agent任务执行等多个基准测试中均有明显提升,在部分Agent和编程评测中甚至超过Gemini 3 Flash。

Google表示,Gemini 3.5 Flash-Lite支持不同思考深度配置,开发者可以根据不同任务,在低延迟、低成本与复杂推理能力之间进行权衡。同时,该模型已内置Computer Use能力,可帮助开发者构建能够跨浏览器、移动端和桌面环境执行任务的AI Agent。

第三款产品则瞄准网络安全领域。

Google推出了专门针对网络安全优化的Gemini 3.5 Flash Cyber。该模型基于Gemini 3.5 Flash训练,并针对漏洞发现、验证和自动修复进行了专项微调,旨在以较低成本完成软件漏洞检测和修复工作。

随着三款新模型正式发布,Google也同步开放了相应产品。其中,Gemini 3.6 Flash和Gemini 3.5 Flash-Lite已上线Gemini API、Google AI Studio、Android Studio,并面向企业开放至Gemini Enterprise Agent Platform,同时也逐步集成至Gemini应用及Google搜索等产品中。

值得关注的是,Google在官方博客中还透露,Gemini 3.5 Pro目前仍在合作伙伴测试阶段,将在准备就绪后正式发布。同时,公司已启动Gemini 4迄今规模最大的预训练工作。
发表评论 共有条评论
用户名: 密码:
验证码: 匿名发表