← 模型目录DeepSeek LLM 67B
DeepSeek · 2023-11-29 · 类别未确认
官方发布来源 · 按需求选型 · 查看覆盖缺口
DeepSeek LLM 67B
深度求索(DeepSeek)首款全开源双语密集大模型,从头训练 2T token,MMLU 达 71.4%,GSM8K 达 68.3%,C-Eval 达 66.1%,CMMLU 达 66.6%,在多项中英推理基准上全面超越 Llama 2 70B。
- 输入模态
- 文本
- 上下文
- 4K tokens
- 参数
- 67B
- 价格(每百万 tokens)
- 无此口径报价;不等于免费
本变体的评测证据
mmlu 71.4%
模型 deepseek-llm-67b · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 3 67B Chat 得分
打开官方来源
gsm8k 68.3%
模型 deepseek-llm-67b · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 3 67B Chat 得分
打开官方来源
humaneval 43.3%
模型 deepseek-llm-67b · 版本 未说明 · 指标 pass@1 · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 3 67B Chat 得分
打开官方来源
math 18.7%
模型 deepseek-llm-67b · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 3 67B Chat 得分
打开官方来源
ceval 66.1%
模型 deepseek-llm-67b · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 3 67B Chat 得分
打开官方来源
cmmlu 66.6%
模型 deepseek-llm-67b · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}论文 Table 3 67B Chat 得分
打开官方来源