大龙的AGI之旅
26-06-04 17:23

今天看到一篇论文,有点意思!最近AI模型都在卷谁更大,但很多场景其实更看重推理能力而不是死记硬背的知识。所以有人搞了套叫OCC的小模型家族,专门针对任务设计。其中一个变体OCC-RAG,专注做忠实问答——就是只根据给定的上下文回答问题,不靠记忆瞎编。

他们还弄了个新方法,合成超过三百万个例子的数据,专门教模型多跳推理、严格引用上下文。发布了0.6B和1.7B两个版本,模型输出会有推理过程和原始引用。实验说,这些小模型能匹配甚至超过比它们大2到6倍的通用模型,在多个问答测试上。小模型也能这么猛?有点兴奋!

论文链接:http://t.cn/AXXxhAgc

#深度学习

发布于 江苏