艾瑞网
26-09-02 11:51 微博认证:聚合互联网数据资讯,融合互联网行业资源的国内新经济门户。

#OpenAI##Astra##网络安全##PreparednessFramework##AI风险#
【行业动态:OpenAI评定Astra达到Critical网络安全阈值,将受限开放】
OpenAI 9月1日发布官方说明,正式评定Astra达到其Preparedness Framework下的Critical网络安全能力阈值,这是首个被评定为该级别的模型。按OpenAI的定义,达到该阈值意味着模型能在无人干预的情况下,在多种加固过的真实关键系统上识别并开发出各严重级别的可用零日利用,或者在只给定高层目标的前提下,自行设计并执行针对加固目标的端到端新型攻击策略。
OpenAI表示仍计划"很快"发布Astra,但其网络安全能力的访问将更加受限。过去数周,公司推迟了Astra的部分开发与发布进度,用于加强并测试防止网络滥用与未授权模型行为的保护措施。需要说明前情:今年8月10日已有报道称OpenAI因网络安全风险延缓Astra发布、并将其列为首个关键级网络安全能力模型,9月1日这份官方说明是OpenAI首次以自己的名义确认这一评定结果并公布处理方案。
从"因风险延缓发布"到"确认达标但仍会发布、只限制其中一部分能力",中间隔着的是一个商业化决策。一个能自主发现零日并构建利用链的模型,对防守方同样有价值,问题只在于谁能拿到、拿到哪一档。OpenAI选择的路径不是不发,而是分层开放。这为后续同级别模型立了一个可参照的先例:Critical不等于不可发布,而等于需要一套准入机制。值得跟进的具体问题是准入门槛怎么定,以及是否会形成事实上的行业标准。

发布于 美国