← 模型目录Mistral Large 2 (123B)
Mistral AI · 2024-07-24 · 通用模型
官方发布来源 · 按需求选型 · 查看覆盖缺口
Mistral Large 2 (123B)
Mistral 123B 参数旗舰模型,支持 128K 超长上下文与 80+ 种编程语言,MMLU 达 84.0%,HumanEval 达 92.0%,GSM8K 达 91.2%,MATH 达 63.3%,代码能力跻身全球最强阵营。
- 输入模态
- 文本 / 代码
- 上下文
- 128K tokens
- 参数
- 123B
- 价格(每百万 tokens)
- 无此口径报价;不等于免费
本变体的评测证据
mmlu 84.0%
模型 mistral-large-2 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方博客公布 MMLU 5-shot 得分
打开官方来源
humaneval 92.0%
模型 mistral-large-2 · 版本 未说明 · 指标 pass@1 · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方博客公布 HumanEval 得分
打开官方来源
gsm8k 91.2%
模型 mistral-large-2 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方博客公布 GSM8K 8-shot 得分
打开官方来源
math 63.3%
模型 mistral-large-2 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方博客公布 MATH 得分
打开官方来源