就在今天凌晨,OpenAI宣布全量推送GPT-6的同时,还捎带手发布了一项新能力Intelligent UI。
简单来说,这项能力让模型的输出不再只局限于文字,所有适合可视化的元素——包括文字、图表、按钮、表单等等——都可以被模型自主组合成一个可交互的图形界面,以便于用户更加直观的理解。
我记得去年还有很多人在嚷嚷着「模型即产品」,当时我就预感到,AI想要征服C端市场,产品化、UI化一定是绕不开的一条路。
结果Personal AI的爆火,直接加速了这个过程。
不过与OpenAI想法不谋而合的是,创业团队产品Eazo也在尝试图形界面这条路,从时间线上甚至早于OpenAI不少,以至于创始人谢扬曾提出了一个堪称暴论的观点:
「对话框是AI的Demo,不是终局。」
什么意思呢?
我们讨论AI的时候,很容易默认使用者是一个能打字、会提问、知道怎样补充上下文的成年人,围绕这个人,行业已经发明了大量提高提问效率的方法,教他怎么描述任务、怎么约束输出、怎么让模型少走弯路。
但对于那些与AI打交道不多的人而言,多轮交流+复杂提示词本身就成了一种负担,而非乐趣。
人类是天生的视觉动物,所以图形界面比我们想象中重要得多。
之所以把Eazo单拎出来说,是因为它的单轮输出结果就足以成为一款可用的产品,这重新赋予了我最初接触AI时「言出法随」的爽感。
比如我在国庆假期跟朋友们聚会时,发现曾经玩的桌游「行动代号」小程序突然开始收费了(图1)
虽然6块钱一套的词组不贵,但无法进行个性化定制带来的损失厌恶,绝对算不上什么好的体验,于是当时桌上就有人给我提议,能不能用AI做一个?
假期后我抱着试试看的心态,只喂给了Eazo一句提示词,过程相当出人意料:
Eazo先是问我想用哪种方式进行开发,如果只追求简单能用,它可以立即生成六版风格不同的demo任君选择,如果还想要进行精细化调整,也可以自己定制开发方案(图2)
由于这项任务我只想测试单轮对话的输出质量,所以用了最快捷的方式,从Eazo暴露的思维链来看,它不仅自行搜索补全了所有「行动代号」的规则,还把我说的「一台设备大家一起玩」的前提考虑到了(视频)
而最后的成品没有任何BUG,在单轮对话里,Eazo最终将225个词加入了词库,任务前后耗时20分钟左右,并且直接产出正式链接,不存在任何登录等前置条件。
感兴趣的可以用起来了:http://t.cn/AXlZ8ChD
了解过谢扬的人可能都知道,作为Authing、Fellou等多款产品的创始人,产品化思维一直以来都是他的强项,甚至能看到很多过去思考的沉淀,都能在如今Eazo身上一一找到对应。
尤其是放在AI应用在C端的爆发前夜,工程化决定下限,产品化决定上限,会成为行业里一个愈发牢固的共识。
我看了很多Eazo的用户反馈,他们都对Eazo每轮对话都会交付一个完整产品的做法感到新奇和惊喜,所谓完成比完美更重要,大概就是这个意思。
目前看来,Personal Agent这条赛道只会变得越来越拥挤,未来哪怕一个人的细碎需求,AI也可以照单全收,彻底实现「我想要,我创造」的美好画面。
我很想套用前几个月说过的一个比喻:
程序员曾经像数字世界的持证工匠,只有他们能进车间。
现在车间对所有人敞开,但大多数人走进去,没想着为了接班当工匠,只是为了自己造一把椅子,一把只符合自己臀型的椅子。
