岳东晓博士
25-01-24 02:45 微博认证:美国加州律师,明尼苏达大学物理学博士

DeepSeek-R1 压制 OpenAI: 美国财经频道 CNBC 采访了 Scale AI CEO,后者称,他们使用美国物理、数学、化学、生物教授们在他们研究相关的问题上编写最难的问题,虽然所有AI得分都不高,但是来自中国的 DeepSeek-R1 超过了 OpenAI 最强的AI 模型,而且还开源了其先进的算法、方法与模型参数。在中国公司算力资源严重受限情况下,原本以为美国能保持至少一年的优势,结果中国人已经追上来了,中美人工智能的“军备”竞赛进入你追我赶的白热化。Scale AI 这位建议美国加大投入。

怎么说呢。竞争压力才是进化、进步的动力。满清自以为是天朝上国,自欺欺人,一旦被打懵,又自卑自贱。面对差距,独立自主,奋发图强,可上九天揽月,可下五洋捉鳖。有人说,DeepSeek 之前可能用了 ChatGPT 的对话数据作为训练资料。这算什么?ChatGPT 对话数据还不是靠人类共享的知识库?从法律角度,没有任何知识产权可言 -- 虽然节省了一些后来者编写对话的人力,但汗水无知识产权。其他AI公司都用这些对话数据,甚至有公开下载的网站,也没做出来什么。给猴子一本物理书,没这个脑子还是放不了卫星。关键是得有脑子。具体到 AI 就是相关神经网络的设计与训练算法 -- 这才是不外传的秘籍。所以,扎克伯格们、马斯克们拿了 ChatGPT 对话,用几十万张N卡也没弄出个名堂。而如今 DeepSeek 把他们的算法都公开发表了, 还顺手发了几个思考型小模型,完全碾压 META 开源的、被人称颂的 LLama。接下来,扎克伯格、马斯克的员工们应该会认真学习 DeepSeek 的创新,估计会在很短时间内打造出相当的模型。

有人质疑 DeepSeek 的能力。AI 的表现的水平其实取决于对话者的水平。一个小学生去考名校数学教授的数学水平怎么考?你只能问加减乘除,也看不出教授多厉害。搞个幼儿脑筋急转弯,教授可能还答非所问。如果再问当下幼儿动画情节,数学教授更是一脸茫然。你没有博士水平,AI给你博士水平的回答,你可能还不懂其奥妙。另外,AI不是数据库,你问水浒108将,它不见得知道---人工智能,顾名思义,关键是智力,而不是记忆。我建议有兴趣的看看 这个视频,DeepSeek R1 32b参数的小模型在 PC 上本地运行,解决一个有相当难度的物理问题,http://t.cn/A63yEKUG 。它真是具备了人一样的反思能力,没有画图,仅靠文字就基本正确的解决。

当然了,这一切都始于那篇《Attention is All You Need》开创性论文。。。

#人工智能#

发布于 美国