犀小莉
26-07-23 16:15 微博认证:科技科幻博主

硅谷最近把大量精力花在指责中国大模型上,美国媒体也花样百出,甚至搬出“时空故事”来喊冤,核心论调只有一个:中国大模型在“蒸馏”美国模型。

那么,搞大模型到底需不需要蒸馏?蒸馏是道德问题还是技术问题?在舆论场上,这些确实成了吵架的筹码。但剥开这些情绪化的外衣,真正的问题只有一条:谁的大模型能胜出。

首先,中美AI竞争本质上是两套独立体系的全面较量,各凭本事生存与发展。生存和发展才是第一要务,而不是某一方单方面制定的规则,更不必理会对方强加的道德枷锁。

其次,美国大模型同样在蒸馏中国模型,只是受限于各种软硬件条件,无法像中国这样进行大规模的“DDoS式”蒸馏。硅谷的指责,更多是一种“谁先喊冤谁有理”的舆论策略。

再者,从技术逻辑来看,大模型本身就是对现实世界结构化数据蒸馏后的精髓。对大模型进行再次蒸馏,相当于把葡萄酒变成白兰地、小麦酒变成威士忌,提纯出更浓烈的精华。因此,蒸馏操作本身就是提升大模型能力的重要手段,这也是全球AI领域通用的正常操作。

最后,不得不提的是中文的天然优势。中文的信息密度远高于英文,加上中国社会的数字化规模首屈一指,中国大模型被投喂的数据在数量和质量上都极高。同样是“炼丹”,中国喂的是汉语,美国投的是英语。同样的信息量,美国需要更大的炉子和更多的燃料。

所以,尽管目前美国的“炉子”比中国更大,但中国的“炼材”更好,且有“三昧真火”加持。再偶尔从美国的炉子里拿几颗丹药进行二次熔炼,最终炼成的大模型,不仅综合成本远低于美国,效用甚至更胜一筹。

回到开头,中美AI竞争是各自体系下的全面比拼,本领大小才是第一位的,这决定了谁能拿到AI时代的第一张门票。华山论剑,只争第一,你有你的吸星大法,我用我的北冥神功。

#OpenAI闯祸中国大模型救场#

发布于 河北