实测精选 OpenAI 发布 GPT-5.4 具备计算机原生操作能力,在推理、编码与 Agent 三合一
OpenAI 正式发布 GPT-5.4 系列模型,开始具备真正的计算机原生操作能力。
可以直接通过屏幕截图和指令编写,在虚拟环境或本地软件中执行点击、拖拽、输入等操作,完成跨应用程序的复杂工作流。
GPT-5.4 在推理、编码和 Agent 工作流领域的进展整合到一个前沿模型中。
可以实时看到 GPT 打算如何拆解问题,并能在生成过程中随时介入、调整方向。
Thinking 模式具备更强的多轮网络搜索能力,能够像人类专家一样跨信源比对并合成高质量答案。
与龙共弈在网上也看到一些精彩的实测
1、Peter Gostev 使用 GPT-5.4-Pro 制作了一个孔雀开屏
2、Ethan Mollick 使用 GPT-5.4 用优化后的三维空间
3、Diegocabezaso1 使用 GPT-5.4 High 通过 Codex 编写一段 Python 代码,可视化交通信号灯在单行道上如何工作,且车辆以随机速度进入。
4、Coreyching 用 Codex + GPT-5.4 构建了一个战术回合制角色扮演游戏
测试用 Playwright,视觉用图像生成
5、其他方面
也有人反馈说前端体验落后于 Claude Opus 4.6 和 Gemini 3.1 Pro
在 OpenClaw 测试时,任务总是中断。。。
规划旅行行程时,看起来很完美,但没考虑到选的地点会被假期人多造成拥堵的实际问题。
GPT 5.4 Pro 版本几乎完美,解决了其他模型无法解决的问题。
Pro 对几乎所有正常使用场景来说都算过于繁复,需要强大功能来完成极其困难的事情时才建议使用。
神龙摆尾
GPT 5.4 的计算机原生操作能力,让 AI 正在慢慢学会使用电脑。
而电脑,本来就是人类文明过去四十年最重要的工作工具。
当 AI 也能熟练地打开软件、调用工具、执行流程的时候,一个新的问题就会浮现出来。
未来很多工作的核心能力,也许会从亲自操作软件慢慢转向设计任务和监督 AI。
人类依然坐在电脑前
只不过键盘另一端,多了一位沉默而高效的搭档。
它不会疲倦,也不会抱怨。
只会不断地执行任务,然后等待下一条指令。
至于 GPT-5.4,会不会成为那个转折点,
现在下结论还太早。
技术史常常充满戏剧性。
真正改变世界的那一步,往往在当时看起来只是一点点小升级。
可当很多一点点小升级叠在一起时,
时代就会慢慢改变。。。
#人工智能[超话]##AI创造营##ChatGPT[超话]#
