相比单纯比拼模型跑分,我更期待这次V4在Agent能力上的升级。#曝DeepSeekV4近期发布#
现在的大模型已经越来越会“回答问题”了,但真正让人感受到差距的,可能是它能不能把一件复杂的事情真正做完。
比如自己拆解任务、搜索资料、调用工具、写代码、修改文件,最后交付一个完整结果。
未来AI的竞争,可能不是“谁更会聊天”,而是“谁更像一个真正能干活的同事”。
如果DeepSeek V4能把Agent能力进一步做起来,这可能比单纯提升几个榜单成绩更有意义。
发布于 上海
