德里克文
26-09-23 23:23 微博认证:AINEXT 联合创始人 AI博主

#今日AI有什么值得看# 9月23日晚报。

今天AI圈有几件事,我觉得值得单独记一下。

不是因为又刷了一堆Benchmark,而是几个方向开始越来越清楚:**Agent在降成本,AI图片开始做“可编辑工程”,AI视频则开始从生成一段片子,变成生成一个持续存在的世界。**

① **OpenAI发布GPT-6 Sol / Luna**

这次我反而没那么在意“又强了多少”,真正值得看的是价格。

Sol负责复杂Coding、Computer Use、Agent任务,Luna负责大量高频执行。

以后Agent很可能不是一个模型从头干到尾,而是:

**Luna跑大量任务 → Sol处理困难节点 → Astra解决最难的问题。**

模型路由会越来越重要。

② **Anthropic发布Claude Opus 5.5**

方向和OpenAI非常接近:

不是一味堆最强模型,而是把接近旗舰的能力,做得更快、更便宜。

今年模型竞争已经明显从:

“谁Benchmark最高”

变成:

**“谁完成一个真实任务花的钱更少。”**

这个变化对Coding Agent、办公Agent影响会非常大。

③ **PixVerse R2开始做“实时世界”**

这个我觉得对AI视频特别值得关注。

以前文生视频基本都是:

Prompt → 生成5秒/10秒 → 结束。

R2开始尝试:

**世界一直存在,你继续操作,它继续变化,而且记得之前发生过什么。**

这已经不完全是AI视频模型了。

如果这条路线跑通,互动电影、AI游戏、虚拟角色、实时短剧都会被重新定义。

④ **蚂蚁百灵开源Ming-Image-0.1-Design**

这里面我最感兴趣的其实是 **Design-Layer**。

因为AI设计一直有个很现实的问题:

图很好看,但交付出去就是一张“死图”。

现在它开始尝试直接把设计拆成多个RGBA透明图层:

背景一层、人物一层、装饰一层……

也就是说,AI图片正在从:

**生成最终效果图**

往:

**生成可编辑工程**

走。

这个方向对海报、电商、PPT、UI甚至出版设计都很重要。

⑤ **Kimi浏览器插件开始支持“我做一次,AI学成Skill”**

这个思路我很喜欢。

以后你甚至不用先写复杂SOP。

自己把网页流程操作一遍:

打开哪里、点什么、筛什么、最后检查什么。

AI看完以后,直接保存成Skill,下次自动执行。

这意味着人的很多日常操作,本身就可能慢慢变成一种**可复用的AI资产**。

——

所以如果只总结今天一个趋势,我会写:

**AI正在从“生成结果”,进入“接管工程”。**

图片不只是图片,要有图层。

视频不只是视频,要有持续世界。

Agent不只是会回答,要会路由模型、控制成本、记住流程、反复执行。

再往后看,真正拉开差距的可能已经不是:

**“谁能生成得最好。”**

而是:

**“谁能把一件事情,从想法一直做到可修改、可复用、可交付。”**

这可能才是2026下半年AI产品真正开始变化的地方。

发布于 福建