摘要
新华社伦敦7月21日电 英国《自然》杂志网站21日刊文说,中国公司最新打造的大语言模型凭借其规模和能力给科学家留下了深刻印象。北京月之暗面科技有限公司新发布的大语言模型Kimi K3能处理大篇幅文本。该公司自身测试显示,K3在编程和电子表格操作等任务上的表现可与美国竞争对手的模型相媲美,甚至更胜一筹...
新华社伦敦7月21日电 英国《自然》杂志网站21日刊文说,中国公司最新打造的大语言模型凭借其规模和能力给科学家留下了深刻印象。北京月之暗面科技有限公司新发布的大语言模型Kimi K3能处理大篇幅文本。该公司自身测试显示,K3在编程和电子表格操作等任务上的表现可与美国竞争对手的模型相媲美,甚至更胜一筹。文章摘要如下:
自DeepSeek以来,还没有哪款中国人工智能模型引发如此广泛的关注。澳大利亚新南威尔士大学认知神经科学家乔尔·皮尔逊说:“这是一个转折点……人们将其称为‘斯普特尼克时刻’。”
K3模型于7月16日发布,恰逢2026世界人工智能大会在上海召开前夕。与其上一代K2以及深度求索公司开发的DeepSeek系列模型一样,K3也是一款开放权重模型。这意味着模型的核心组成部分可以公开获取,研究人员能够免费下载和修改,但有关模型训练的信息仍不公开。其使用成本低于美国开放人工智能研究中心(OpenAI)、谷歌等拥有的专有大模型,后者属于闭源模型,无法下载和修改。
澳大利亚国立大学机器人与人工智能研究员拉胡尔·绍梅说,消费者、开发者和研究人员一直在推动人工智能模型开放权重。K3尤其令人兴奋,它的参数规模达2.8万亿并具备100万词元上下文窗口。
过去,开放权重模型在性能和能力方面一直落后于美国的专有模型。澳大利亚昆士兰理工大学生成式人工智能实验室研究员阿伦·斯诺斯韦尔说,两者之间的差距似乎已缩小至前所未有的程度。
皮尔逊说,中国开放权重模型正在改变投资者和用户对美国前沿模型价值的看法。
澳大利亚新南威尔士大学计算机科学家托比·沃尔什说,K3表明,未来研究人员将拥有丰富多样的开放权重和专有模型可供选择,“这证明人工智能不会成为一个赢家通吃的市场”。