【“欢迎进入#AGI时代#”,GPT-6 Astra来了!一个能发现零日漏洞、操控电脑屏幕的AI;奥特曼:OpenAI一定会做人形机器人】“欢迎进入AGI时代。”9月3日,OpenAI总裁Greg Brockman在发布会上说出了这句话。当天,OpenAI正式发布新一代旗舰模型GPT-6 Astra,并称其实现了“代际跃迁”。在代表高阶数学能力的测试中,Astra得分97.6%,几乎“打穿”了这套研究级数学测试;而在强调抽象推理的ARC-AGI-3上,它的成绩从7.8%跃升至99.9%,接近满分。
OpenAI称Astra为“目前全球最智能、且对齐程度最高的模型”。在计算机操作、网页浏览、软件工程、网络安全、科学研究及专业工作领域,均达到当前最先进水平。
相比数学和抽象推理,Astra在网络安全上的跃升更具现实冲击力。在测试漏洞利用能力的ExploitBench中,Astra得分100%,而上一代模型为78.5%;在专门使用2026年6月至8月新漏洞构建的测试中,Astra成功率达到39%,远高于上一代的5.5%。OpenAI称,Astra已能在较少人工干预下发现未知软件漏洞并开发利用方式,内部测试中还曾发现并利用两个零日漏洞。
在能力实现上,Astra使用超过10万块GPU在得州Stargate基地完成训练,重点提升软件工程、科学研究、推理和计算机操作等能力。它可直接进入软件环境,自主完成编程、金融建模、制作演示文稿和电子表格等长周期、多步骤任务。OpenAI总裁Greg Brockman称,人们未来可能将“这个时间、这个模型”视为AGI到来的节点。
商业化方面,Astra API定价为每百万输入Token 10美元、输出Token 50美元,约为上一代模型的2.5倍,并将陆续向ChatGPT Plus、Pro、Business和Enterprise用户开放。
OpenAI CEO山姆·奥特曼在发布会上首次明确表示,公司“一定会做人形机器人”,并将开发面向数据中心等场景的其他形态机器人。OpenAI今年6月已启动机器人团队招聘。
但能力越强,风险也越大。OpenAI首席科学家雅库布·帕乔基指出,模型能用更少的自然语言推理Token解决更复杂的问题,意味着人类越来越难通过模型的文字推理过程判断它究竟在做什么。为此,OpenAI在Astra部署中加入了未对齐监控系统,检查模型的推理和行动,一旦发现未经授权的行为,可以暂停任务。合法任务有时也可能因此被减速、暂停甚至停止。 http://t.cn/AX06DAv4
发布于 北京
