大模型市场正呈现截然不同的定价策略:一边是部分企业上调价格,另一边则出现大幅折扣。谷歌最新推出的Gemini 3.7 Flash模型,以限时五折的优惠引发开发者社区热议。这款专为编码和智能体工作流设计的模型,在年底前将以每百万输入token 0.75美元、输出3.75美元的价格提供服务,仅为标准定价的一半。
该优惠有效期至2026年末,2027年起将恢复至每百万输入1.5美元、输出7.5美元的原价。谷歌DeepMind新任高级副总裁科拉伊·卡武库奥卢透露,从3.5版本到3.7版本仅用三个月完成迭代,新模型在多任务处理能力上显著提升。这种快速迭代策略与7月刚发布的Gemini 3.6 Flash形成呼应,显示出谷歌在Flash系列上的持续投入。
第三方评测机构数据显示,Gemini 3.7 Flash在高推理模式下获得56分,较前代提升4分,在智能评分榜上位列第九,超越同期发布的DeepSeek V4 Pro 0813和智谱GLM-5.2。其输出速度达到每秒340个token,是GPT-5.6 Terra和GLM-5.2的三倍,平均任务完成时间缩短至1.7分钟,在智能、速度和成本间取得平衡。
成本优势成为该模型最大卖点。当前折扣价下,高推理模式单任务成本约0.4美元,较前代降低30%;中等推理模式更降至0.26美元。有开发者测算,即使将整个Next.js代码库导入进行重构,API调用成本也完全可控。这种定价策略被解读为谷歌降低开发者迁移门槛、争夺智能体时代默认工作模型的战略举措。
但市场也存在不同声音。部分开发者指出,智能体模型的核心挑战在于长时间任务的稳定性,快速低成本的模型能否在数百个步骤中保持决策准确性仍需验证。这种质疑反映出开发者对模型可靠性的关注,远超过对短期价格优惠的追捧。
值得关注的是,谷歌旗舰模型更新进度明显滞后。今年5月I/O大会预告的Gemini 3.5 Pro至今未发布,而Flash系列已从3.5快速迭代至3.7。这种产品策略调整引发猜测,有传言称谷歌可能放弃超大规模前沿模型研发,转而聚焦性价比更高的Flash级别模型,通过扩大调用量和产品覆盖建立优势。
近期谷歌DeepMind管理层变动加剧了这种猜测。创始人德米斯·哈萨比斯转任董事长及Alphabet首席科学家,卡武库奥卢升任高级副总裁,工作27年的传奇工程师杰夫·迪恩离职创业。部门重组传言与模型路线调整交织,使谷歌AI战略方向显得扑朔迷离。
尽管面临模型延期、人事变动和竞争对手压力,谷歌仍握有独特优势。自研芯片、算力储备和海量产品入口构成的生态壁垒,使其在大模型竞争中的地位难以被轻易撼动。随着行业进入精细化运营阶段,技术路线与商业策略的博弈将更加激烈。











