董川
25-10-12 22:13 微博认证:互联网分析师 资深摄影师 科技博主

这篇调查论文认为小型语言模型可以处理大多数代理任务,而大型模型仅在需要时介入。

此设置可将常见工具任务的成本降低 10 倍至 30 倍。

代理的工作主要是调用工具并产生结构化输出,而不是回忆大量事实。

因此,路由器默认运行小模型,只有当置信度较低时才会升级到大模型。

输出遵循验证器检查的严格 JSON 样式模式,这提高了正确性并减少了重试次数。

这使得小型模型在函数调用和结构化数据方面可靠,同时响应更快、能耗更低。

大型模型仍然处理长上下文合成、复杂的多跳推理、深度代码修复和更高风险的决策。

对于常规步骤使用小模型,根据不确定性进行路由,并将大模型留给困难的情况。

论文 – arxiv.org/abs/2510.03847

论文标题:“代理系统的小型语言模型:架构、功能和部署权衡的调查”[并不简单]

发布于 中国香港