← 模型目录DeepSeek-V2
DeepSeek · 2024-05-06 · 类别未确认
官方发布来源 · 按需求选型 · 查看覆盖缺口
DeepSeek-V2
深度求索开创性自研 MLA(多头潜在注意力)与 DeepSeekMoE 架构的首秀之作,236B 总参数仅激活 21B,KV Cache 显存节省 93.3%,以极致低价与高智力引爆国内大模型价格战。MMLU 78.5%,GSM8K 79.2%,HumanEval 81.1%,C-Eval 81.4%。
- 输入模态
- 文本 / 代码
- 上下文
- 128K tokens
- 参数
- 236B-A21B
- 价格(每百万 tokens)
- 无此口径报价;不等于免费
本变体的评测证据
mmlu 78.5%
模型 deepseek-v2 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 4 DeepSeek-V2 Chat 得分
打开官方来源
gsm8k 79.2%
模型 deepseek-v2 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 4 DeepSeek-V2 Chat 得分
打开官方来源
humaneval 81.1%
模型 deepseek-v2 · 版本 未说明 · 指标 pass@1 · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 4 DeepSeek-V2 Chat 得分
打开官方来源
math 43.6%
模型 deepseek-v2 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 4 DeepSeek-V2 Chat 得分
打开官方来源
ceval 81.4%
模型 deepseek-v2 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 4 DeepSeek-V2 Chat 得分
打开官方来源