微软又在AI圈里扔了个王炸!DeepSeek-R2还没出山呢,微软这边直接掏出了个“小钢炮”——Phi-4推理模型系列!这玩意儿,简直了!
别看它参数不大,最大的也就14B,但那推理能力,简直是“小母牛坐飞机——牛上天了”!有Phi-4-reasoning,还有升级版的Phi-4-reasoning-plus,甚至还有个更迷你的Phi-4-mini-reasoning!关键是啥?在笔记本上就能跑得飞起!
你敢信?那个Phi-4-mini-reasoning,参数比DeepSeek-R1的蒸馏版还小,但在数学推理上,性能直接反超!有个大佬,威斯康星大学麦迪逊分校的教授,拿他研究生线性代数的期末考试去测Phi-4-reasoning,你猜怎么着?直接满分!教授都惊了,说这超出了他对AI发展的预期!以前觉得PC上跑不了啥有用的AI,现在脸都被打肿了!
这还不算完!这个Phi-4系列,在各种数学竞赛题(什么AIME、HMMT、OmniMath)上,表现都相当炸裂,干翻或者打平了不少比它大得多的模型!简直就是个“小怪兽”!解谜题、做规划,样样都行!
为啥这么牛?微软的技术报告说了,他们用了精挑细选的“教学案例”(监督微调SFT)来教它,还让它在实践中学习(强化学习RL),哪怕只用了6000个数学题做强化学习,性能都能飙升10%!而且,训练数据都是精挑细选,去掉了那些可能“作弊”的。
最神奇的是,研究人员发现,推理能力好像是一种可以迁移的“元技能”!就是说,在一个地方学会了推理,换个地方照样好使!甚至,这些模型还能“青出于蓝而胜于蓝”,比教它们的“老师模型”还厉害!
当然啦,也不是完美无缺。比如上下文长度有限,编程能力和工具集成还有待加强,有时候简单问题它可能会“想太多”,有点啰嗦。
但是!家人们!这波操作,是不是意味着以后咱们在自己电脑上就能用上超强AI了?微软这次是想告诉大家,小模型也能有大智慧!
想不想试试这个“小怪兽”?微软把模型和技术报告都放出来了(Hugging Face上就有)!赶紧去瞅瞅,看看这个“小诸葛”到底有多神!评论区告诉我,你觉得它能干翻那些“大块头”吗?#你会和AI学外语吗##科技风向标##ai创造营# http://t.cn/A6dsmm5c
发布于 浙江
