姬永锋
25-01-27 11:49 微博认证:财经博主

Chamath 做空了英伟达

他说:“借助 R1,DeepSeek 基本上破解了人工智能的圣杯之一:让模型逐步推理,而无需依赖大量监督数据集。他们的 DeepSeek-R1-0实验展示了一些非凡的东西:使用纯强化学习和精心设计的奖励函数,他们设法让模型完全自主地开发复杂的推理能力。这不仅仅是解决问题——模型有机地学会了生成长链思维、自我验证其工作,并为更难的问题分配更多的计算时间。”

发布于 福建