Mistral 出新的文本生成模型了,Mistral Large, Mistral 的旗舰模型,在可通过 API 使用的模型中性能排名第二,模型能力仅次于 GPT-4,支持 32K tokens 的上下文窗口。
图 1为 GPT-4、Mistral Large(预训练)、Claude 2、Gemini Pro 1.0、GPT 3.5 和 LLaMA 2 70B 在 MMLU(衡量大规模多任务语言理解能力)上的比较。
- 在英语、法语、西班牙语、德语和意大利语方面具有母语级流利程度,并对语法和文化背景有细致的理解。
- 32K tokens 上下文窗口可以从大型文档中精确调用信息。
- 精确的指令遵循能让开发者设计他们的管理策略。
- 具备函数调用的能力。
推理和知识能力见图2;多语言能力见图3;数学和编程能力见图4。
Mistral Large 可通过 la Plateforme 购买, Mistral 还将通过其第一个分销合作伙伴 Azure 提供该产品,另外,用户还可自行部署该模型。
除了 Mistral Large 之外,Mistral 还发布了一个新的优化模型Mistral Small,该模型针对延迟和成本进行了优化。Mistral Small 的性能超过了 Mixtral 8x7B,并且具有更低的延迟,是介于开源权重产品和旗舰模型之间的精细中间解决方案。
链接:http://t.cn/A6Yl6EKL
发布于 北京
