Mythos 发布,被囚禁的上帝之眼,正在翻出人类二十年前的错误
Anthropic 发布了新一代前沿模型的预览版本 Mythos
Anthropic 上个月搞了一个乌龙,他们有一份内部博客草稿,代号叫Capybara 水豚,被人不小心放到了一个公开可访问的数据池中。
然后被安全研究员发现了,然后扩散了。。。
草稿里写的什么?写的是他们正在开发的一个新模型,叫 Mythos,比上一代 Claude Opus 系列更大、更聪明,然后草稿里有一句话,我觉得是我近期看到过的最让人不寒而栗的表述。。。
如果该模型被恶意利用,其发现漏洞的速度将远超防御者的补丁更新速度。
这是一个质变
周二 Anthropic 正式承认了这个模型的存在,发布了预览版,并且启动了一个叫 Project Glasswing 玻璃翼计划 的安全项目,邀请了一批合作伙伴来试用。
参与的名单里有 Apple、Amazon、Microsoft、Cisco、CrowdStrike、Linux Foundation、Broadcom、Palo Alto Networks 这些名字。
不是随便拉来撑场子的,是真的在跑安全任务。
Anthropic 说,在过去几周的封闭测试里,Mythos 已经扫描出了数千个零日漏洞,其中大量是高危级别。
然后还有一个细节,那些漏洞里,有很多藏在一二十年前的老旧代码里。
有些代码是 2000 年代初写的,那时候 iPhone 还没出来,Facebook 刚刚成立,Web 2.0 才刚开始,这些代码在过去二十年里,被无数人类安全专家扫过、审过、测过,没有人发现问题。
然后 Mythos 来了,几周之内,找到了。。。
我在想一个画面,某一个角落里,有个工程师在 2003 年写了一段代码,当时赶着交付,注释都没写清楚,然后这段代码就这样活了下来,穿越了 iPhone 时代、云计算时代、AI 时代,一直活到了今天。
然后被一个 2026 年的 AI 模型,在几分钟之内,找到了。
这特么就是某种意义上的时间穿越。
回到玻璃翼计划
为什么叫这个名字?玻璃翼蝴蝶 Glasswing butterfly 的翅膀是透明的,没有鳞粉,所以看起来像玻璃一样,我猜这个命名想表达的是 透明、可见、无处遁形 ,漏洞在 Mythos 面前,就像在玻璃翼蝴蝶的翅膀里,藏不住。
这个项目的逻辑是,Mythos 太强了,强到不能随便放出去,所以先给一小圈信任的伙伴,专门做防御性的安全工作,找漏洞,修漏洞,然后把经验分享给整个行业。
一个只允许防御不允许进攻的 AI 武器。
听起来很放心
但我觉得这里有一个很根本的张力,是很难解决的,那就是,防御和进攻用的是同一套能力。
Mythos 找到一个漏洞,它可以告诉防御方这里有个洞,赶紧补,也可以告诉进攻方这里有个洞,可以钻。
模型本身不知道自己在进攻还是在防守。
这也是为什么 Anthropic 现在只把它给了那几十家签了合约的机构,而且明确表示不对公众开放。
但你有没有想过,那份水豚草稿已经泄露了。
Anthropic 的人知道 Mythos 能做什么,安全研究员知道,现在你也知道了。
那坏人呢?
顺着上面的再聊聊 Anthropic 现在的处境,因为这件事不只是发布了一个新模型这么简单。
前段时间美国国防部最近把 Anthropic 列为了供应链风险实体。
原因是,Anthropic 拒绝允许他们的技术被用于对人类的自主打击或监控。
你没看错,是因为拒绝了战争等某些攻击用法,所以被列入了风险名单。
国防部的意思大概是,你不配合,你就是风险,Anthropic 的意思是,有些事我们不做,不管谁要求的。
然后与此同时,Anthropic 还在跟美国联邦官员讨论,Mythos 在国家级关键系统里的防御性应用。
也就是说,一边在谈合作,一边在打官司。
这个公司现在的位置,很特殊
他们手里有一个可能是目前地球上最擅长找漏洞的 AI 模型,然后他们在说,我们只用它来修漏洞,不用它来打人。
你信吗?
我有时候觉得,Anthropic 是那种真的在认真想 AI 安全这件事的公司,不是嘴上说说,是真的在产品决策层面有边界,拒绝国防部的某些要求,这不是小事,这是要付出真实代价的。
但我同时也觉得,再认真的边界,也会在足够大的压力下被侵蚀。
历史上没有哪个只用于防御的技术,最后真的只用于了防御。
火药是这样,核技术也是这样,互联网更是这样。
Mythos 会不会也是这样?
说到这个,我想起了一个很老的思想实验,叫上帝之眼,如果有一个系统能看到一切,知道所有的秘密,那它到底是在保护人,还是在控制人?
区别只在于,谁在用它,用来对付谁。
Mythos 现在是一只被关在笼子里的上帝之眼,笼子的钥匙在 Anthropic 手里。
但钥匙这种东西,是会被复制或者盗取的,其他 AI 大模型公司后续也可能会研发出来。。。
我们正在经历一个很奇特的历史节点,AI 已经开始真正地理解人类过去犯的错误了,那些藏在二十年前代码里的漏洞,那些我们以为已经被遗忘的细节,正在被一个不会遗忘任何东西的系统,一条一条地翻出来。
机器比我们更了解我们自己的历史。
我们也许会见证 AI 时代的历史。。。
#人工智能[超话]##AI创造营##Anthropic##claude[超话]##Mythos##漏洞#
