英国人工智能安全研究所、人工智能标准与创新中心等机构的最新数据显示,AI 模型发动网络攻击的能力正在迅速增强,而且提升速度远超外界此前预期。
英国天空新闻的分析称,这已经不再是某一个“危险模型”的个别问题,而是整个 AI 行业正在出现的系统性变化。
此前,外界讨论的焦点主要集中在 Anthropic 的 Mythos 模型。由于安全风险过高,Anthropic 没有公开发布这一模型。不过,部分观察人士当时对相关风险仍持怀疑态度,认为缺乏足够证据证明其真实威胁。
但最新测试结果显示,AI 网络攻击能力的进步速度正在明显加快。
英国人工智能安全研究所开发了一套模拟企业网络攻击的测试环境,名为“Last Ones”。这套系统会模拟 AI 入侵企业网络后的完整攻击流程,包括侦察、权限提升以及最终控制整个网络。
数据显示,在 2025 年 1 月发布 Claude Sonnet 3.7 时,AI 模型还只能完成初步侦察任务,也就是进入网络后进行信息搜集,但难以进一步扩大战果。
而到了 Mythos 发布后,AI 已经能够完成“权限提升”,开始在网络内部逐步获取更高级别控制权限。
但真正令人不安的是之后的发展
为海外华人提供有价值的信息与分析,更多即时更新可在蓝天、电报、x查找causmoney,深度分析和评论直接搜索caus.com
随着 OpenAI 推出 GPT-5.5 与 GPT-5.5-Cyber,以及 Anthropic 更新 Mythos 系列模型,AI 的网络攻击能力再次大幅跃升。
在“Last Ones”测试中,这些最新模型已经能够完成全部 32 个攻击步骤,实现对企业网络的完整接管。
研究人员表示,目前 AI 能力的进步速度大约每不到四个月就会翻倍一次。这意味着,到今年秋季,AI 网络攻击能力可能再次出现数量级提升。
更大的风险在于,虽然最先进模型目前仍受到严格限制,只向部分机构开放,但开源模型通常只落后前沿模型约 6 至 12 个月。
这意味着,未来半年到一年内,类似能力可能会逐渐落入普通黑客和网络犯罪组织手中。
分析人士警告称,全球软件系统如今可能只剩下不到一年的时间窗口去修补大量潜在漏洞,否则将面临前所未有的 AI 网络安全威胁。 http://t.cn/AX6OXQzC
发布于 加拿大
