产业 / 媒体
编程能力大幅提升,价格较前代直降50%
谷歌以极快节奏再度更新Flash系列模型——距Gemini 3.6 Flash发布仅三周,Gemini 3.7 Flash便已正式上线。谷歌将其定位为迄今最强的编程与AI智能体工作模型,并将这次能力跃升归因于「出色的算法改进」。在编程领域,新模型表现最为突出:FrontierCode基准测试得分从34.4%跃升至43.6%,DeepSWE基准则从49.0%提升至65.3%。按谷歌自身的测量结果,3.7 Flash在上述指标上已超越Claude Sonnet 5与GPT-5.6 Terra。与此同时,网页开发、文档理解和业务流程自动化等方面也录得进步。在定价方面,3.7 Flash的输入价格为每百万token 0.75美元,输出为3.75美元,较3.6 Flash发布时降低50%,两款模型目前已并列相同价位。该定价承诺维持至年底。
谷歌于2026年8月13日正式发布Gemini 3.7 Flash,距上一代3.6 Flash上线仅三周时间。这一罕见的高频迭代节奏表明,谷歌正在加速其Flash系列的产品演进。公司将3.7 Flash定位为「迄今最强的编程与AI智能体工作模型」,并将能力提升归因于底层算法层面的重大改进,而非单纯依赖算力扩展。
在编程能力方面,3.7 Flash的进步最为显著。FrontierCode基准测试得分从前代的34.4%跃升至43.6%,提升幅度接近九个百分点;DeepSWE基准则从49.0%大幅提升至65.3%,涨幅超过16个百分点。这两项指标均是衡量模型在真实软件工程任务中表现的重要参考,数字的跃升意味着模型在代码生成质量与复杂任务处理能力上均有实质性突破。
按照谷歌自身发布的基准测试数据,Gemini 3.7 Flash在编程相关指标上已超越Anthropic的Claude Sonnet 5以及OpenAI的GPT-5.6 Terra。除编程外,谷歌还报告了网页开发、文档理解和业务流程自动化三个领域的性能提升,进一步强化了该模型作为通用工作模型的定位。不过,独立第三方对上述基准结果的验证尚待跟进。
定价策略是此次发布的另一大亮点。3.7 Flash的API定价为每百万输入token 0.75美元、每百万输出token 3.75美元,较3.6 Flash发布时的价格直降50%。目前两款模型已并列相同价位,这意味着用户可以以相同成本获得更强的新模型能力。谷歌承诺该定价将维持至2026年底,但并未对模型本身的可用周期作出同等承诺。
Gemini 3.7 Flash现已通过Google API、AI Studio及Antigravity平台向开发者开放。对于需要在成本与性能之间寻求平衡的AI智能体开发场景,该模型的高性价比定位具有明显吸引力。随着各大厂商在模型迭代速度与价格竞争上持续加码,AI基础模型市场的竞争烈度正在进一步升级。
要点
- Gemini 3.7 Flash在FrontierCode和DeepSWE两项编程基准上均大幅领先前代,谷歌称其已超越Claude Sonnet 5与GPT-5.6 Terra。
- 新模型定价较3.6 Flash发布时降低50%,每百万输入token仅需0.75美元,该价格承诺维持至2026年底。
- 谷歌将此次能力提升归因于算法改进而非算力扩展,并在编程、网页开发、文档理解和业务自动化等多个维度报告了进步。
- 从3.6 Flash到3.7 Flash仅间隔三周,折射出头部AI厂商在模型迭代节奏上的持续提速趋势。
原始标题:Gemini 3.7 Flash lands with coding gains and undercuts its three-week-old predecessor's price by 50%
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。