智能时刻
26-08-11 07:00 微博认证:科技博主 超话主持人(AI创造营超话) 微博解说视频博主 头条文章作者

#智能时刻的观察[超话]#

震惊:一项包含 25000 个任务的实验刚刚证明,整个多智能体人工智能框架行业所基于的假设是错误的。

每个主要框架——CrewAI、AutoGen、MetaGPT、ChatDev——都从相同的前提出发:分配角色、定义层级结构、让协调者分配工作。研究人员在 8 个模型中对 8 种协调协议进行了测试,并涉及多达 256 个智能体。

在那种没有给智能体分配角色、没有层级结构、也没有协调者的协议中,其表现比集中式协调高出 14%。最佳协议和最差协议之间的差距达到了 44%。这绝非偶然现象,而是取决于你如何组织这些智能体——而不是你使用哪种模型。

这就是令人不安的地方:当智能体只是被给予固定的轮次顺序,并被告知“自行解决”时,它们自发地从 8 个智能体中发明了 5006 种独特的专门角色。它们自愿放弃自己不擅长的任务。它们自行形成了浅层次的层级结构——而这一切都是在没有人设计的情况下发生的。

研究人员称此为“内生性悖论”。最佳的协调并非是最大程度的控制或最大的自由。而是最少的框架结构——只需足够的结构让自我组织得以出现。但有一个不容忽视的缺陷,所有构建智能代理的团队都不愿听到:低于某个特定的模型能力阈值时,效果会逆转。能力较弱的模型实际上需要严格的结构。

自主性只有在模型足够聪明能够利用它时才会起作用。这意味着每一个附带统一层级结构的代理框架都是错误的——过度限制了强大的模型,又未能充分约束能力较弱的模型。投入了 20 亿美元以上的代理编排工具成本,可能只是在解决那些有能力的模型自身就能更好解决的问题上起到了作用。

#AI探索计划##人工智能##智能机器人##人工智能机器人##AI专家在微博#

发布于 北京