AI资讯 / 产业

产业 / 媒体

微软发布首个网络安全专属AI模型MAI-Cyber-1-Flash,CyberGym基准测试成绩领先竞品

IT之家

微软首席执行官萨蒂亚·纳德拉于2026年7月28日在X平台宣布,微软推出首个专为网络安全场景研发的AI模型MAI-Cyber-1-Flash。该模型在CyberGym基准测试中取得95.95%的成功率,显著高于Anthropic的Claude Mythos 5(83.8%)和OpenAI的GPT-5.5 Cyber(85.6%)。MAI-Cyber-1-Flash已接入微软多智能体安全系统MDASH,可自主处理约90%的网络安全任务,剩余复杂任务则调用GPT-5.4协同完成。与现有MDASH配置相比,新组合的运行成本降低近50%。微软同步推出多智能体系统Perception,用于持续监测威胁、修补漏洞并关闭新的攻击入口。该模型经过红队评估、自动化测试及第三方审查,训练数据来源于微软每日处理的逾100万亿条安全信号。

微软CEO萨蒂亚·纳德拉于7月28日在X平台正式宣布,微软推出首个专为网络安全场景设计的AI模型MAI-Cyber-1-Flash。纳德拉将其定位为微软在网络安全领域的重要里程碑,并强调该模型并非通用大模型的简单迁移,而是从底层针对安全任务进行专项训练和优化的垂直模型。

在性能表现上,MAI-Cyber-1-Flash与MDASH多智能体系统的组合在CyberGym基准测试中取得95.95%的最高成绩,远超竞争对手。Anthropic的Claude Mythos 5得分为83.8%,OpenAI的GPT-5.6 Sol为83.6%,GPT-5.5 Cyber为85.6%。这一差距表明,专为安全场景训练的垂直模型在特定领域基准上具备明显优势。

在实际部署架构上,MAI-Cyber-1-Flash被整合进微软的多智能体安全系统MDASH,承担约90%的常规网络安全任务处理。对于剩余10%的高复杂度任务,系统会自动调用规模更大的GPT-5.4模型进行协同处理。这种分层调度机制在保障处理能力的同时,也有效控制了整体运营成本。

成本效益是此次发布的另一大亮点。微软表示,MAI-Cyber-1-Flash与GPT-5.4的新组合,相较于此前使用GPT-5.4、GPT-5.4 Mini和GPT-5.3 Codex的MDASH配置,综合成本降低了近50%。这对于需要大规模部署安全AI能力的企业客户而言,具有显著的经济吸引力。

与此同时,微软还推出了名为Perception的多智能体系统,专门服务于MDASH中的多类安全工作流。Perception可持续监测网络威胁、自动修补已知漏洞,并主动关闭新出现的攻击入口,未来还将扩展至更多安全工作流场景。微软表示,MAI-Cyber-1-Flash每天处理的安全信号超过100万亿条,漏洞、攻击、防御及处置结果均被纳入强化学习训练流程,并经过AI红队评估、自动化测试、专家对抗测试和第三方独立评估等多重验证。

要点

  • MAI-Cyber-1-Flash是微软首个专为网络安全场景研发的垂直AI模型,在CyberGym基准测试中以95.95%的成功率领先Claude Mythos 5和GPT-5.5 Cyber等竞品
  • 该模型与MDASH多智能体系统结合后,可处理约90%的常规安全任务,复杂任务由GPT-5.4补充,整体成本较旧配置降低近50%
  • 微软同步推出Perception多智能体系统,实现对网络威胁的持续监测、漏洞修补和攻击入口关闭
  • 模型训练数据来源于微软每日超100万亿条安全信号,并经过红队评估、自动化测试及第三方审查等多重安全验证
查看原始来源

原始标题:纳德拉官宣微软首个 AI 安全模型 MAI-Cyber-1-Flash,跑分超 Mythos 5 和 GPT-5.5 Cyber

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。