【也看RAG中的Skill检索问题:Skills检索评测数据合成、专用Embedding模型训练策略】来看看Skills结合RAG的进展。讲的故事是现有技能基准多关注端到端执行效果,未单独测评检索能力,所以搞个SkillRet,面向LLM智能体技能检索测试集,发现结通用检索模型在长文本技能检索上表现不佳,基于SkillRet微调了个专用的embedding模型,可使测试指标提升,还是蛮有趣的,可以看看它在数据上的工作、工作在《SkillRet: A Large-Scale Benchmark for Skill Retrieval in LLM Agents》,http://t.cn/AXi21VhC,http://t.cn/AXi21VhN,http://t.cn/AXi21Vhp,对应的微调模型在http://t.cn/AXi21VhO,感兴趣的可以看下,都是数据工程范畴:http://t.cn/AXi21Vh9
发布于 北京
