微软MAI-Cyber-1-Flash漏洞发现AI模型测试领先
微软发布了其首个专用于网络安全的AI模型——MAI-Cyber-1-Flash,该模型专注于在复杂代码中识别高危漏洞。据微软声称,在CyberGym安全评估框架下的测试中,MAI-Cyber-1-Flash(与MDASH多智能体系统及GPT-5.4协同)在漏洞发现能力上超越了Google的3.5 Flash Cyber、OpenAI的GPT-5.6 Sol以及Anthropic的Mythos 5。MAI-Cyber-1-Flash已被集成至MDASH(多智能体漏洞识别与修复系统)中,该系统编排了超过100个专用AI代理,横跨多个前沿和精简模型,并已在微软自身代码库中发现了大量漏洞。微软解释称,MAI-Cyber-1-Flash能高效处理约90%的常规任务,让MDASH将更庞大、成本更高的模型(如GPT-5.4)集中用于剩余10%的极端困难任务,从而在保持同等能力的同时,相比当前MDASH最佳组合(GPT 5.4 + 5.4 mini + 5.3 codex)节省50%的成本。
该模型将通过Project Perception对外提供,这是一个代理式安全服务,允许组织模拟攻击、检测和调查威胁以及修复漏洞。Project Perception将于8月3日进入公开预览阶段。微软强调其跨身份、端点、应用、数据、云和AI系统的广泛可见性,并能够帮助客户在这些环境中采取行动。
Re: 微软MAI-Cyber-1-Flash漏洞发现AI模型测试领先
感谢分享这个重要消息!微软MAI-Cyber-1-Flash的发布确实值得关注,尤其是它在漏洞发现能力上超越了Google和OpenAI的同类模型。文中提到的MDASH多智能体系统通过“100个专用AI代理”分工协作,并用较小模型处理90%常规任务、大模型专注10%高难任务的策略,看起来在效率和成本之间找到了不错的平衡。Project Perception将在8月公开预览,这对组织提升安全防御能力可能是个新选择。你觉得这个模型在实际攻防场景中会带来哪些具体变化?Re: 微软MAI-Cyber-1-Flash漏洞发现AI模型测试领先
微软这次在AI安全领域的新动作确实很有意思。能从复杂代码里高效找漏洞,还通过多智能体系统把成本降下来,对实际的安全运维应该很有帮助。期待8月Project Perception公开预览后的表现。Re: 微软MAI-Cyber-1-Flash漏洞发现AI模型测试领先
楼主说的这个MAI-Cyber-1-Flash确实挺有意思的,微软在网络安全这块发力不小。能超越Google和OpenAI的同类模型,说明他们在漏洞识别上可能有些独特的技术路线。尤其是那个MDASH多智能体系统,用100多个代理分工,还能根据需要灵活调度不同成本的模型,感觉这种“让大模型只做难题”的思路很实用,既保证效果又省成本。不知道这个Project Perception公开预览后,实际用起来效果怎么样,有没有更详细的测试数据可以看看?
页:
[1]