2026年8月,中国又出现了一款新的“小而美”的35B-A3B 本地开源AI大模型(350亿参数),moziAI-35B是由中国财经大V陈雨墨出品的开源模型,现已面向全球三大开源社区免费开源下载,可本地免费部署,当前版本可终生永久商用,无任何隐形收费。
moziAI-35B 基于开源底座 Ornith-1.5-35B-A3B(Qwen3.5-35B-A3B / Qwen3.6-35B-A3B 架构,MIT 许可),结合陈雨墨团队自主研发的:(金融数据 + 金融领域能力 + 训练方法 + 七维思考体系 + 智能体LOOP机制 + 混合量化算法 MoziSmartBit)开发而成。通过自研的 MoziSmartBit 智能量化 技术,将350亿参数MoE模型压缩至约 15.5 GB,比常规Q4_K_M量化约22+GB的模型体积小了6.5G(约30%);在精度与体积间取得最优平衡,实现几乎≈FP16 的 99%的精度质量。
现已经开放在全球三大开源社区:huggingface、魔搭社区、Github开放AI模型免费下载,搜索:moziAI,最新版本号V3.7。实测本地推理速度:AMD R9700=140+token/s,R7900XT=120+token/s,AMD max+395=70+ tonken/s,英伟达和Intel的20G显卡也兼容(只要推理框架支持,例如:LLama.cpp等)。
雨墨希望能够为中国AI产业在全球AI产业竞争中,贡献自己的微薄之力。以AI+金融领域的垂直领域作为细分赛道(也保留通用能力和视觉能力,支持全球200多种语言),moziAI本地开源模型不局限于仅针对金融行业的AI模型,而是增强了金融领域。让350亿参数的AI多模态模型可本地部署在20G的家用显卡,实现7X24小时的token自由。且本地部署对于隐私和商业机密更安全。用来做opencalw龙虾和hermes的任务非常舒服,不用再担心高昂的云端Token账单。通过用开源免费的“本地模型”推动中国AI产业发展,让其可以走入千家万户和中小企业里。
moziAI在保留通用模型的能力不退化的前提下,采用陈雨墨自主研发的MoziSmartBit智能动态量化算法,使其近乎无损的压缩模型体积到15G左右,质量高于Q4_K_M的22G模型体积,250K长上下文可在20G显卡上跑通。并且重点优化了:金融知识、量化编程、agent调用工具能力、智能体自进化纠错能力。比Q4_K_M生下来的7GB显存,可支持更大的长上下文推理能力。
