① 资讯摘要
北美时间 8 月 13 日,Google DeepMind 发布新一代轻量主力模型 Gemini 3.7 Flash,官方将其定位为”迄今用于编码与智能体(Agent)领域最聪明的 Flash 级模型”,主攻编程、多步骤任务、工具调用与复杂知识工作。值得注意,这距离上一代 Gemini 3.6 Flash 发布仅过去约三周,迭代节奏明显提速。据 36kr、新浪财经、网易科技等多家媒体报道,本次发布也是哈萨比斯交棒 Koray 之后,谷歌首款公开亮相的 Gemini 模型。
价格是最受关注的变化:2026 年 12 月 31 日前,Gemini 3.7 Flash 的推介价为每百万输入 token 0.75 美元、每百万输出 token 3.75 美元,正好是 3.6 Flash 原价的一半;自 2027 年 1 月 1 日起,两项价格将分别回升至 1.50 美元与 7.50 美元。模型支持最高 100 万 token 上下文、最大 6.4 万 token 输出,并已同步上线 Gemini Spark 订阅,面向 160 多个国家和地区的 Google AI Pro / Ultra 用户开放。
② 为什么值得关注
这是大模型”价格战”从挑战者烧向巨头的信号。过去一年,”把单位智能成本打下来”主要是 DeepSeek、阿里等挑战者的叙事;如今谷歌主动把自家主力 Flash 的价格砍半,说明即使是算力与生态最雄厚的玩家,也不得不加入”快而省”的竞速。对依赖 API 的开发者与企业来说,这意味着同等预算能跑更多、更复杂的任务。
竞争焦点从”参数规模”转向”性价比 + 迭代速度”。三周迭代、价格腰斩、直击 Agent 场景——谷歌释放的信号很明确:下一阶段比的不是单次跑分的峰值,而是”足够聪明、足够便宜、足够快”的持续供给能力。结合本周字节 Seed 2.1 Turbo、DeepSeek V4 Pro、xAI Grok 4.6、英伟达 Nemotron 3.5 Lightning 的扎堆发布,一条”轻量高速模型”的主线已经清晰。
Agent 经济的成本拐点到了。在每天调用数十万甚至上千万次的 Agent 自动化与企业工作流里,单价腰斩会被指数级放大。模型越便宜,越多的自动化流程才”算得过账”——这正是 AI 从 demo 走向生产的关键门槛。
③ 分角色实操建议
对开发者 / 技术负责人:现在是用 Flash 级模型搭建与压测 Agent 的成本洼地。限时价持续到年底,适合把高频、可并行、对延迟敏感的调用场景(代码生成、文档处理、网页操作)迁过来做 A/B,趁低价把架构跑顺。注意把”限时价”和”2027 年翻倍价”分开测算,别把促销价当成长期成本基线。
对企业 / 产品负责人:不要把成本结构焊死在单一厂商的促销价上。更稳的做法是预留多模型路由能力(类似英伟达开源的 NeMo Switchyard 思路),按任务难度动态选模型——简单活交给便宜的 Flash,难活才上旗舰。这样即便 2027 年价格回升,整体账单依然可控。
对投资者:关注”单位智能成本”持续下降带来的应用层机会:当调用成本不再是瓶颈,受益的会是上层的工作流、SaaS 与垂直 Agent。同时,谷歌在 Koray 接棒后的产品节奏(三周一小更、价格主动下探)本身,也是观察其 AI 竞争力修复的重要窗口。
④ 结语
Gemini 3.7 Flash 的意义,不只是一款”更便宜更快”的模型,而是谷歌正式加入大模型价格战的宣言。当巨头也开始用三周迭代和价格腰斩抢开发者,AI 应用的爆发才真正有了成本基础。本篇为热点资讯解读,不含任何合作或联盟链接。
关注「AI商业快讯」,每天一篇 AI 热点深度解读,帮你用最少的精力跟上最关键的行业变化。