美东 8 月 13 日,谷歌火速推出Gemini 3.7 Flash,距离上一代 3.6 Flash 发布仅 3 周,再度加速中端工作模型迭代。新版本主打编程、多步骤智能体、复杂企业工作流三大核心能力,同时 Token 价格直接腰斩;但另一边,市场寄予厚望的旗舰 Gemini 3.5 Pro 依旧无明确上线时间表,一快一慢形成鲜明反差,也让资本市场对谷歌高端模型竞争力持续存疑。
本次 3.7 Flash 核心升级全部瞄准开发者刚需的工程化编码场景,不再局限简单代码片段生成,重点强化 Bug 排查、完整项目交付、多工具协同执行。
FrontierCode 生产代码测试得分从 34.4% 升至43.6%;
长时序软件工程 DeepSWE 指标从 49.0% 大涨至65.3%;
Web 开发综合 Elo 评分提升 50 分至 1588,超越同期主流竞品。
模型在多轮任务自主规划、故障自动修复上优化明显,执行复杂办公、开发流程时,人工干预次数大幅减少,适配 AI Agent 批量自动化落地,同时强化网络安全、数据风控防护,规避模型滥用风险。目前该模型已上线 Google AI Studio、Android Studio,Gemini Spark 办公智能体同步切换至 3.7 Flash 基座。
输入 Token:0.75 美元 / 百万,仅为上代一半;
输出 Token:3.75 美元 / 百万,同样腰斩。
2027 年起价格恢复原价。对比 Anthropic、OpenAI 同类工作模型,谷歌定价优势突出,意在靠低成本吸引企业、开发者大规模部署智能体应用。
这已是谷歌近一个月内第四款 Flash 系列产品:7 月 21 日同步推出 3.6 Flash、轻量 3.5 Flash-Lite、安全专用 3.5 Flash Cyber,分层覆盖高吞吐、低延迟、代码安全等细分场景,形成完整中端产品矩阵,以高频迭代挤压竞品开发者份额。
谷歌同时披露,下一代 Gemini 4 已启动大规模预训练,但远水解不了近渴,短期高端赛道持续被动。
1.以 Flash 系列守住基础设施入口:靠低价、强代码能力抓住开发者与中小企业,抢占 AI 智能、办公自动化落地市场,先做大 API 调用规模;
2.暂缓旗舰竞速,优先补齐商业化闭环:皮查伊在财报会上明确,公司重心转向可落地的工作型模型,靠云、开发工具、移动生态消化算力投入;
3.双线并行布局 Gemini 4 远期算力储备,寄望下一代完成高端反超。