7月21日消息,据《商业内幕》报道,谷歌正在推出多款全新 AI 模型,但并非市场翘首以盼的那一款。
该公司于周二发布三款 Gemini 系列模型,称它们运行智能体时速度更快、成本更低。谷歌持续将重心向运行效率倾斜,而非单纯追逐极致性能。
这样的布局并非全然出于主动选择:谷歌表示,原本承诺 6 月推出的新一代前沿模型 Gemini 3.5 Pro 仍在持续优化调试。谷歌同时预告了下一代旗舰大模型 Gemini 4,但这款产品预计还要等待数月才会面世。
本周上线的多款新模型中,谷歌将 Gemini 3.6 Flash 定位为 “主力通用模型”。相较于 3.5 Flash,它在代码编写等任务上表现更强。根据人工智能分析指数(Artificial Analysis Index)基准测试,相比前代产品,3.6 Flash 最高可减少 17% 的 token 消耗量(token 即 AI 处理的文本单位)。
谷歌还发布了 Gemini 3.5 Flash Lite,官方称这是 3.5 系列中速度最快、性价比最高的版本。此外还有 Gemini 3.5 Flash Cyber,专门用于挖掘并修复网络安全漏洞。谷歌表示,该模型性能对标竞品,同时每 token 定价低于更大规格的模型。谷歌 Gemini 产品管理高级总监在博客文章中公布了上述信息。
价格优势至关重要。近几个月 Anthropic 与 OpenAI 均推出网络安全专用模型,而谷歌再次希望凭借更低成本形成竞争优势。
越来越多企业意识到,大量消耗 token 未必能换来最优效果,因此开始控制 AI 相关开支,转向更注重成本效益的模型,这为谷歌创造了战略机遇。
谷歌首席执行官桑达尔・皮查伊今年早些时候表示:“不少企业才年中就快要耗尽全年 token 预算。如果企业混合使用 Flash 系列与其他前沿模型,能够省下一大笔资金。”
谷歌称,新系列模型在运行 AI 智能体场景下,实现了效率与性能的理想平衡。
Gemini 3.5 Pro 依旧缺席
谷歌表示,重磅前沿模型 Gemini 3.5 Pro 正在合作伙伴间开展测试,将在 “准备就绪后尽快推出”。
《商业内幕》6 月曾报道,谷歌将 3.5 Pro 原定发布时间推迟至 7 月;彭博社近期消息显示,该模型可能再度延期。
截至周二,在 Artificial Analysis 综合排行榜上(从数学、逻辑推理等多个维度对模型打分),谷歌没有任何一款模型跻身前十。
谷歌周二还透露,已经启动 Gemini 4 迄今为止规模最大的预训练工程。按照惯例,谷歌一般在每年年末推出这类重磅旗舰模型。目前尚不确定 Gemini 3.5 Pro 正式面世后,能否帮助谷歌在过渡期重回第一梯队。
不过,随着企业理性规划 AI 支出、限制 token 用量,谷歌当下的产品布局已经做好迎接市场需求的准备。(AI普瑞斯编译)













