Meta 新出的那个模型 MobileLLM-R1-950M 有MLX版本了。
说实话这个模型宣称超过了 Qwen3 我就激起了兴趣,一个是 Meta 团队大换血之后,能搞出来什么模型值得研究一波,另一个是,他怎么厚脸皮说超过了 Qwen3-0.6B 的.... 你 0.95B 比 0.6B 猛不是理所应当吗? (当然官方的点是,Qwen3-0.6B 是在 36T 数据上训练出来的,我们只用了不到5T)。
总之是骡子是马我正在溜了,不过因为模型实在太小,我的测试题目它会经常给出最终答案正确但是中间步骤完全不正确或者中间步骤就得到了正确答案但是最终答案又搞砸了的情况..... 详细测试我看这周能不能也一起放出来.
模型地址:huggingface.co/facebook/MobileLLM-R1-950M
#ai生活指南# #ai创造营#
发布于 日本
