老刘说NLP_刘焕勇
26-01-11 13:11 微博认证:AI博主

【大模型数据合成策略之Agent做DocQA文档问答–DocDancer】来看文档问答Agent-DocDancer的数据合成思路,同样也是数据合成的范畴,很工程化,但对于实际应用有借鉴意义。讲的是端到端训练的开源文档问答智能体,《DocDancer: Towards Agentic Document-Grounded Information Seeking》,http://t.cn/AXbdiBZQ,核心思路是将文档问答(DocQA)转化为Agent的信息检索问题,并构建了含搜索(全局信息获取)和读取(局部精细理解)双工具框架,为了训练这个Agent框架,在数据方面,通过Exploration-then-Synthesis流水线数据合成了一堆数据,然后基于Qwen3-4B-Thinking-2507和Qwen3-30B-A3B-Thinking-2507进行微调,最终在MMLongBenchDoc和DocBench两大长文本基准测试中表现不错。http://t.cn/AXbdiBZR

发布于 北京