谷歌Gemini 3.7 Flash三周闪电迭代,编程能力暴涨价格腰斩

首页 / AI资讯 / 大模型

0:00
0:00
1x
定时

当地时间8月13日,谷歌DeepMind投下了一枚加速迭代的重磅炸弹:Gemini 3.7 Flash正式发布,距离上一代3.6 Flash推出仅仅过去三周。这是谷歌首次在Flash系列上实现如此高频的版本更替,也把前沿大模型的发布节奏从行业惯例的半年一次压缩到了以周为单位。新模型专为编码和Agent工作流设计,在DeepSWE编程智能体基准上拿到65.3%的得分,相对3.6 Flash的49.0%提升了约33%,FrontierCode得分43.6%同样大幅领先上代,并超越Anthropic的Claude Sonnet 5。更让开发者兴奋的是价格,每百万token输入0.75美元、输出3.75美元,仅为3.6 Flash标准定价的一半,限时优惠将持续到今年年底。

三周迭代一代:谷歌把发布节奏压缩成周更

Gemini 3.7 Flash的发布速度,本身就是一条新闻。就在7月,谷歌才一口气推出包括3.6 Flash在内的三个模型,如今不到一个月,Flash系列再次更新,从3.5到3.7只用了三个月。刚升任谷歌DeepMind高级副总裁的科拉伊·卡武库奥卢在社交平台发文表示,3.7 Flash是当前最新的主力模型,团队一直在Flash系列上快速迭代,使其在广泛任务中变得更有帮助。这种节奏背后,是谷歌对模型评测与训练管线的深度工业化,意味着它已经把"持续对标竞品、按周发布改进"变成一套可复制的生产流程。

高频迭代的价值在于把技术优势快速转化为市场份额。开发者不再需要等半年才能用上更强的模型,而是在三周内就能体验到能力跃升与价格下调的双重红利。对Anthropic和OpenAI来说,谷歌这种"小步快跑"的打法正在形成持续压力,旗舰模型的领先窗口被不断压缩,竞品的迭代窗口却越缩越短,大模型赛道的竞争节奏被彻底改写。

DeepSWE 65.3%:编程能力单代跃升三分之一

编程与Agent是3.7 Flash最核心的攻坚方向,两组数据最能说明问题。在DeepSWE自主软件工程基准上,3.7 Flash拿到65.3%的得分,意味着它能自主解决约三分之二的真实GitHub软件工程任务,而3.6 Flash只有49.0%,单代相对提升约33%。在FrontierCode上,3.7 Flash的43.6%比上代的34.4%提升了约27%,同时超过了Claude Sonnet 5。这些分数直接决定了模型在Cursor、GitHub Copilot等编程工具中的实际体验,也是开发者用脚投票的关键依据。

速度是3.7 Flash的另一张王牌。其输出速度约为每秒340个token,接近GPT-5.6 Terra和GLM-5.2的3倍;在高推理模式下,平均单任务完成时间仅1.7分钟,是目前在智能与任务耗时之间平衡得最好的模型之一。Artificial Analysis的评测显示,高推理模式下3.7 Flash的智能得分为56,排在榜单第9位,超过同期上新的DeepSeek V4 Pro 0813和智谱GLM-5.2,后两者最高推理得分均为53。对于追求规模化部署的开发者来说,这种"又快又省又强"的组合极具吸引力。

限时五折定价:一场针对开发者心智的价格战

这次发布最受开发者关注的,是那张限时五折的"体验券"。按照谷歌公布的价格,3.7 Flash每百万token输入0.75美元、输出3.75美元,只有3.6 Flash标准价格的一半,优惠持续到2026年12月31日。不过这并不是永久降价,2027年1月1日起,价格将恢复至每百万token输入1.5美元、输出7.5美元。也就是说,谷歌为开发者提供了一张有效期四个多月的半价通行证,目的很明确:以最低的迁移成本把开发者拉进3.7 Flash的生态,用体验黏住用户。

成本测算进一步放大了这个优势。Artificial Analysis的数据显示,在折扣价格下,3.7 Flash高推理模式的单任务平均成本约0.4美元,比3.6 Flash低30%,中等推理模式下更是降至0.26美元。对于高频调用API的生产级项目,这直接意味着账单金额的显著下降。在DeepSeek涨价、Gemini降价的同一周,大模型市场的价格策略走向了两个相反的方向,谷歌显然在赌:当性能接近时,价格与迭代速度将成为开发者选型的决定性因素。

全线铺开:从AI Studio到Copilot与Cursor

3.7 Flash的发布不是孤立的模型更新,而是一次覆盖全渠道的生态铺货。上线首日,模型就登陆了Google AI Studio、Antigravity、OpenRouter以及GitHub Copilot和Cursor等第三方平台,1M token的多模态上下文窗口全程可用。其中,GitHub Copilot的接入尤其值得玩味,谷歌把自家模型放进微软旗下的开发者工具,既说明编程助手正在走向模型无关的多模型时代,也意味着谷歌愿意在别人的生态里争夺开发者心智,只要模型能触达用户。

这种渠道策略与价格策略的组合,勾勒出谷歌在开发者市场的完整打法:用高频迭代保持能力在线,用半价优惠降低迁移成本,用全渠道分发扩大触达面,再用Flash系列"智能、速度与成本平衡点"的定位守住规模化部署的基本盘。对普通开发者和企业来说,3.7 Flash的出现让高性能编程模型的门槛进一步下探,而对整个大模型行业来说,谷歌用三周一代的节奏证明了:当模型迭代工业化之后,竞争的主战场已经从"谁更强"转向"谁更快、谁更便宜、谁更好用"。

新一代DeepMind掌门人的第一把火

3.7 Flash还是谷歌AI核心层交接后的标志性动作。在哈萨比斯转任董事长兼Alphabet首席科学家之后,科拉伊·卡武库奥卢接掌DeepMind日常研发,这次发布正是他升任高级副总裁后的首次重大亮相。他在社交平台亲自为3.7 Flash站台,强调Flash系列快速迭代的价值,显示出新掌门延续并加速谷歌"以周为单位"推进模型更新的决心。此前谷歌核心层的多轮人事变动曾引发外界对模型研发节奏的担忧,而三周一代的3.7 Flash,用事实回应了这种疑虑。

从战略定位看,卡武库奥卢延续了谷歌对Flash系列的清晰定位:不争夺能力榜首,而是在智能、速度与成本之间寻找规模化部署的最优平衡点。这种务实路线与OpenAI押注旗舰极限能力、Anthropic深耕企业深度推理的路线形成差异化,也让谷歌在开发者市场建立起"性价比首选"的心智。新掌门的第一把火没有烧向口号,而是烧向了代码与账单,这或许正是谷歌应对大模型竞争最有效的姿态。

素材来源:Google Blog、Techmeme、凤凰网科技、InfoQ 发布时间:2026-08-15