9月8日,小米技术发了 MiMo Desktop 桌面客户端的开放邀测,同时放出两款新一代模型的 Preview 版:MiMo-X-Pro-Preview 和 MiMo-X-Flash-Preview。(图1)
那么,不废话了。
我已经用了两天了(图2),我稍微聊聊我的个人感受吧。
——————————————
首先,MiMo Desktop 是个啥?
官方给 MiMo Desktop 的定位是一款面向真实工作场景的桌面 AI 应用
大家可以理解成,这个东西就是把AI大模型包起来,加入一些工具,更容易让工作人群使用的应用。
针对使用AI的人群真实工作场景,接收多格式素材输入,理解目标,拆解任务,调用工具,交付高可用度成果,并支持实时预览与修改。
这句话值得拆开看。
因为真实的工作并不是我们和现在大模型的那种一问一答模式,不是问问题让他回答,也不是和大模型聊天,跟不上刁难AI玩。
真正的工作很少仅仅从一个提示词、一个问题开始,而是往往包含各种表格、图片、视频、PDF、录音,乃至没解压的压缩包,同时堆在那儿。
正常来讲,阅读和理解这些(堆)玩意,这个任务本来就是给你的,如果没有AI的话。
而 MiMo Desktop,它可以直接读这些,不用你先整理格式,扔给他就行了。
而且,兄弟,而且
它完成任务之后,提交给你的交付物,也不再只是一段可复制的文本,而是文档、表格、幻灯片、网页、图片、音频、视频,甚至 3D 模型、App 或软件工程项目……
来简单的解释一下 MiMo Desktop 的界面,大概就是这样
和你之前接触到的类似的应用都差不多(图3)
默认的大模型是 MiMo-X-Pro-Preview,和 MiMo-X-flash-Preview
由于众所周知的原因,我不知道他们是什么,你们可以自己猜(图4)
当然了,你也可以自己配置自己的大模型,你用的习惯顺手的,都可以直接配置
目前主流的大模型他都支持,什么MiMo、Deepseek、Kimi、千问等等等等等(图5)。
————————————————————
所以,他真的能做到吗?
我也不知道,我只能给你原原本本的讲讲我这两天用他都做了点啥,然后,他有没有用,好不好用,你自己判断。
而作为一个作者,文字创作者,我的第一个想法,当然是用他写东西试试看。
我喂给了他这篇我之前写过的文章,然后让他分析我的文风,加以总结,形成skill给我看
然后我改了一次这个skill,然后让他写一篇试试看。(图6)
结果非常鹅妹子嘤啊
虽然我还不太满意,但是我个人感觉他已经学了个七分像了。
尤其是这篇文章我并没有告诉他任何的东西,纯粹只给了他一个题目,让他自行发挥的情况下,他能写成这个样子已经很不错了。
我觉得未来我再调教调教这个skill,他完全可以承担帮我打草稿的任务了,然后我来通读并调整。
尤其是我发现他自己去主动寻找、对比、筛选数据和信息的能力是很不错的。
注意,
写文章其实是相对容易的,模仿我的文风也并不难,难的其实是他在这么短的时间内,在短暂训练之后就能做到这么好,是挺难的。
而且,他在完成任务的时候,顺便建立并完善了我的writing-style.skill,我未来想继续训练,直接在今天这个基础上做就行了,这种循序渐进变强的感觉,还是很好的。
当然,这篇实验性质的文章我并没有发出去
之后还让他继续写了一篇稿子,就是我昨天发的那个(图7)
写的怎么样大家可以自行判断。
————————————————
大家都知道,MiMo-V2.5是多模态大模型,除了逻辑思维能力,文字能力,也有声音、图像等等能力,那么,我就好奇了,这个MiMo-X 行不行呢?
于是我设计了一个任务,让MiMo-X 给我画了个N70的痛车车衣
这就是我昨天微博里发的(图8)
但是可能由于还比较稚嫩,大家其实也能看的出来很多地方有问题,
比如车的建模可能不太准,比如车的车模有一些图可能忽然就变了等等。
不过总的来讲,就我test他的生图能力来讲,还是有非常不错的水平的
毕竟我只扔给他几张官网图让他自己看,然后告诉他生成EVA的痛车车衣,完全让他自己理解理解感悟,自己拆解任务。
甚至我都没告诉他什么是EVA,他先得理解什么是EVA的车衣,所以我发现其实他做的很不错,尤其我翻他海报的中间产物的时候,发现有几张画的非常好的,但可能是因为建模有点问题,他最终并没有采用到最终的海报里去。(图9)
你可以看一下列表, 其实他自己画了好多好多张,然后可能是反复对比筛选了他觉得没问题的,放到海报里形成最终的方案了。
————————————————————
那么……
更难一点的任务OK不OK呢?
比如说:
从无到有,直接给我写个应用?
于是,我想让他给我写个远程用手机调用他的工具
他一步步引导我(图10),让我筛选我认为合适的方式,你可以看到,由于是test性质的,我的提示词相当的潦草(图11)
但是让我没想到的是……
就是如此潦草的提示词的情况下,他居然自己拆解任务,一步步的真的给实现了
他最终写了几个程序,完成了利用飞书桥接自己的任务(图12)
并且…… 写了个 readme给我(图13)……
用了非常详细的步骤,指导我应该怎么做(图14)
分了步骤1、2、3的教我……
甚至写了大概需要几分钟搞定……
其实我并不是真的想搞这么个远程桥接…… 我只是想test一下他系统完成工作的能力,所以其实我并没有试到底行不行。
但,我觉得大概率是行的。
————————————————————
当然不能到此为止
我还得继续试试之前没试过的东西,比如
3D建模能力
这个其实是有点过分的
大家都知道之前MiMo 2.5是完全没有3D建模的能力的,所以我知道大概率搞不太好。
我甚至破罐子破摔的思路下,懒得截图了,直接甩给了他一个小米官网的链接,让他自己去找模型,搞定一个N90的32:1的车模建模……
看到他去我给他的网站查资料,模型的前端渲染拿不到尺寸,他直接自己去搜资料去了,作为一个不负责任的“老甲方”我老脸不由得微微一红(图15)……
这个任务对于他而已确实非常艰难
由于甲方,也就是我,没有给他什么参考的情况下,他直接自己找了各种资料,把任务分解,然后逐步执行(图16)。
当然了,最终的结果肯定是惨不忍睹的……
但是!我就问你建模没建模吧(图17)!
所以,我想说,虽然没做的太好,但是他最起码真的有3D建模的能力,也实实在在的完成了任务,提供给我两份模型的.stl文件。
这也是他第一次搞类似的东西,我个人认为,如果我多点提示,提供给他完整的N90的尺寸比例等等信息,他应该会更好的完成任务吧。
就在我写这篇文章的时候,MiMo Desktop又进行了一次更新(图18)。
我觉得,这个东西,正在变得越来越强。
