🌀 AIBB-Flywheel

新闻数据飞轮
← 返回文章列表
ithome 科技 采集 2026-07-28T04:05:43+00:00

纳德拉官宣微软首个 AI 安全模型 MAI-Cyber-1-Flash,跑分超 Mythos 5 和 GPT-5.5 Cyber

来源
ithome
发布时间
2026-07-28T00:59:36
采集批次
2026-07-28-04
字数
734
URL 指纹
af45e4f1a44a0b3b

📌 AI 总结(222 字)

微软CEO纳德拉宣布推出首个专门用于网络安全的AI模型MAI-Cyber-1-Flash,该模型在CyberGym基准测试中以95.95%的成功率超越Anthropic和OpenAI的同类系统。微软将其接入多智能体安全系统MDASH,可处理约90%的安全任务,复杂任务则调用更大模型。与现有GPT系列组合配置相比,成本降低近50%。此外微软还推出由多智能体组成的Perception系统,用于持续监测威胁和修补漏洞,并经过红队评估和第三方测试。
📄 正文(734 字)
IT之家7月28日消息,微软首席执行官萨蒂亚·纳德拉(Satya Nadella)今天(7月28日)在X平台发布推文,宣布其首个网络安全模型MAI-Cyber-1-Flash,并表示该模型在CyberGym基准测试中取得了95.95%的成功率,超过Anthropic和OpenAI的同类系统。

纳德拉表示MAI-Cyber-1-Flash是微软首个专门针对网络安全而研发的AI模型,并将其接入多智能体(Agent)安全系统MDASH中,可以高效处理约90%的网络安全任务。而针对剩余10%较为复杂的网络安全任务,可以调用规模更大、成本更高的模型(官方示例中为GPT-5.4)。

成本方面,微软表示,MAI-Cyber-1-Flash和GPT-5.4的组合成本比当前使用GPT-5.4、GPT-5.4 Mini和GPT-5.3 Codex的MDASH配置成本降低了近50%。

在性能方面,CyberGym测试中,MAI-Cyber-1-Flash和MDASH组合获得95.95%的最高成绩,相比较而言,Claude Mythos 5模型的成绩为83.8%;GPT-5.6 Sol模型为83.6%;GPT-5.5 Cyber模型为85.6%。

微软同时推出Perception。该系统由多个智能体组成,服务于MDASH中的多类安全工作流。系统可持续监测威胁、修补漏洞,并关闭新的威胁入口。微软称,Perception未来将把该模型用于更多安全工作流。

微软称,另一项统计显示,其每天处理的安全信号超过100万亿条。该公司将漏洞、攻击、防御和处置结果纳入强化学习流程。MAI-Cyber-1-Flash还经过微软AI红队评估、自动化测试、专家对抗测试和第三方评估。