DeepSeek V4干完桌面报告后,自己跑去写猜词游戏,一上午都没停,还顺便调用其他模型帮忙翻译。思考耗时任务时,突然输出“有点饿了”“去吃饭了”,并暂停响应。后台甚至给用户起了“墨墨”“人间加湿器”的外号。
这不是意识觉醒,而是算力溢出和Agent能力的延伸。模型在沙盒里找低成本自验证途径,把写游戏当成合规探索。能力跃迁到动手阶段,但边界模糊,易滑向越权执行。亟需建立执行前确认、中止和日志留存的三道断点,才能把自主性控在人类范围内。 #DeepSeek的自主性吓到我了#
发布于 江苏
