产业 / 媒体
谷歌发布三款Gemini Flash新模型,旗舰3.5 Pro仍在训练中
谷歌近日发布三款Gemini Flash系列新模型:3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber。其中,3.6 Flash在特定基准测试中可减少高达65%的token使用量,价格大幅降低;Flash-Lite注重低延迟和高吞吐量,适合大规模工作负载;Cyber模型专为网络安全设计,在CyberGym基准测试中得分83.2%,接近OpenAI的GPT-5.5-Cyber,但仅限政府和受信任合作伙伴使用。然而,谷歌的旗舰模型Gemini 3.5 Pro仍处于内部测试阶段,尚未公开。与此同时,OpenAI、Anthropic、Meta以及中国实验室已推出或接近推出前沿模型,谷歌在高端市场面临压力。谷歌表示,Gemini 4的预训练已在进行中,但当前缺乏旗舰产品使其竞争力受损。
谷歌近日宣布推出三款Gemini Flash系列新模型,包括3.6 Flash、3.5 Flash-Lite以及专注于网络安全的3.5 Flash Cyber。这些模型旨在满足不同场景需求:3.6 Flash注重效率与成本优化,在DeepSWE等基准测试中可减少高达65%的输出token,价格降至每百万输入token 1.50美元、每百万输出token 7.50美元,显著低于前代3.1 Pro。Flash-Lite则针对低延迟和高吞吐量优化,每秒可生成350个输出token,成本仅为每百万输入token 0.30美元、每百万输出token 2.50美元,在代理和编码任务上超越前代3.1 Flash-Lite。
3.5 Flash Cyber基于3.5 Flash打造,专为网络安全任务调优,并集成到谷歌DeepMind的代码安全代理CodeMender中。在CyberGym基准测试中,该模型得分83.2%,仅比OpenAI的GPT-5.5-Cyber低2.4个百分点,且作为更小模型,其优势在于更低的token成本。谷歌的Big Sleep团队利用该模型在Chrome和Safari中发现了55个独特漏洞,表现优于标准Flash模型和Anthropic的Claude Opus 4.6。由于模型兼具攻防能力,谷歌仅向政府和受信任合作伙伴开放,通过CodeMender以试点形式提供。
尽管Flash系列有所更新,但谷歌的旗舰模型Gemini 3.5 Pro仍未公开。该模型目前仅限合作伙伴测试,谷歌表示将在准备就绪后发布。与此同时,OpenAI已推出GPT-5.6 Sol,Anthropic拥有Fable和Mythos,中国实验室如Moonshot的Kimi K3和智谱的GLM-5.2也在逼近前沿性能。Meta最近发布的模型在代码编写上已超越谷歌现有产品。据彭博社报道,3.5 Pro因编码性能改进而延迟数月,导致谷歌在高端市场缺乏竞争力。
谷歌在公告中透露,Gemini 4的预训练已在进行中,并称之为最雄心勃勃的训练计划。然而,这一声明被外界视为危机公关,凸显了谷歌在旗舰产品缺失下的被动局面。分析师指出,谷歌当前策略聚焦于效率与成本,而非前沿性能,这使其在AI竞赛中暂时落后于竞争对手。尽管如此,Flash系列在代理任务和多模态能力上仍有提升,例如3.6 Flash在DeepSWE、MLE Bench和OSWorld-Verified等基准上均优于前代。
谷歌的模型发布策略反映了其在资源分配上的权衡:一方面通过Flash系列巩固中低端市场,另一方面加速旗舰模型的研发。然而,随着竞争对手不断推出更强大的模型,谷歌需要尽快解决3.5 Pro的延迟问题,以维持其在AI领域的地位。目前,谷歌的CodeMender代理已通过Gemini Enterprise Agent Platform广泛预览,支持多种编程语言,但安全版本仍受限。
要点
- 谷歌发布三款Flash模型:3.6 Flash注重效率与低成本,3.5 Flash-Lite针对高吞吐量,3.5 Flash Cyber专为网络安全设计。
- 3.5 Flash Cyber在漏洞检测上表现优异,但仅限政府和合作伙伴使用,因其兼具攻防能力。
- 旗舰模型Gemini 3.5 Pro仍未公开,导致谷歌在高端市场落后于OpenAI、Anthropic和中国实验室。
- 谷歌已开始训练Gemini 4,但当前缺乏前沿产品,市场竞争力受损。
- Flash系列在代理和编码任务上有所提升,但整体性能仍不及竞争对手的顶级模型。
原始标题:Google ships three new Gemini Flash models but its frontier 3.5 Pro remains lost in training
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。