张岱樾
26-09-20 09:04 微博认证:AI博主

📄 每次想把手里的 PDF、扫描件、截图喂给 AI,都得先手动整理一遍格式,确实麻烦。doc7 这个开源工具可以解决这个问题。

它能把 PDF、Office 文件、扫描件、截图、图表、公式等统一转成 Markdown 格式。AI 拿到这种格式,就能直接检索、引用和推理。

原理上,doc7 会把文档的每一页渲染成图片,再交给支持视觉理解的多模态 AI 模型去解读。所以它不需要依赖 OCR 文字识别,对复杂排版和特殊符号的理解更准。

你可以用 LM Studio、Ollama 等工具在本地部署模型,也可以连接兼容 OpenAI 接口的云端模型。按机器性能计费,没有按页收费,跑多少文档看你自己的硬件。

支持的格式很全:PDF、Word、Excel、邮件、电子书、Jupyter 笔记本、网页截图都能处理。适合经常需要把各种文档喂给 AI 分析的朋友。

GitHub 地址:github.com/magicrew/doc7

发布于 广东