i陆三金
24-02-26 23:15 微博认证:AI博主

Mistral 出新的文本生成模型了,Mistral Large, Mistral 的旗舰模型,在可通过 API 使用的模型中性能排名第二,模型能力仅次于 GPT-4,支持 32K tokens 的上下文窗口。

图 1为 GPT-4、Mistral Large(预训练)、Claude 2、Gemini Pro 1.0、GPT 3.5 和 LLaMA 2 70B 在 MMLU(衡量大规模多任务语言理解能力)上的比较。

- 在英语、法语、西班牙语、德语和意大利语方面具有母语级流利程度,并对语法和文化背景有细致的理解。

- 32K tokens 上下文窗口可以从大型文档中精确调用信息。

- 精确的指令遵循能让开发者设计他们的管理策略。

- 具备函数调用的能力。

推理和知识能力见图2;多语言能力见图3;数学和编程能力见图4。

Mistral Large 可通过 la Plateforme 购买, Mistral 还将通过其第一个分销合作伙伴 Azure 提供该产品,另外,用户还可自行部署该模型。

除了 Mistral Large 之外,Mistral 还发布了一个新的优化模型Mistral Small,该模型针对延迟和成本进行了优化。Mistral Small 的性能超过了 Mixtral 8x7B,并且具有更低的延迟,是介于开源权重产品和旗舰模型之间的精细中间解决方案。

链接:http://t.cn/A6Yl6EKL

发布于 北京