← 模型目录

Llama 2 70B

Meta / Llama · 2023-07-18 · 类别未确认

官方发布来源 · 按需求选型 · 查看覆盖缺口

Llama 2 70B

Meta 首个允许免费商业化使用的开源大模型家族,预训练 token 达 2T,深度融合 RLHF(PPO + 拒绝采样)对齐策略,70B 版本的 MMLU 达 68.9%,GSM8K 56.8%,成为工业界落地应用最广泛的开源标杆。

输入模态
文本
上下文
4K tokens
参数
70B
价格(每百万 tokens)
无此口径报价;不等于免费

本变体的评测证据

mmlu 68.9% 模型 llama-2-70b · 版本 未说明 · 指标 accuracy · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{
  "harness": "5-shot"
}

论文 Table 3 70B 模型得分

打开官方来源

gsm8k 56.8% 模型 llama-2-70b · 版本 未说明 · 指标 accuracy · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{
  "harness": "8-shot"
}

论文 Table 3 70B 模型得分

打开官方来源

humaneval 29.9% 模型 llama-2-70b · 版本 未说明 · 指标 pass@1 · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{
  "harness": "0-shot"
}

论文 Table 3 70B 模型得分

打开官方来源

math 13.5% 模型 llama-2-70b · 版本 未说明 · 指标 accuracy · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{
  "harness": "4-shot"
}

论文 Table 3 70B 模型得分

打开官方来源

arc-challenge 85.3% 模型 llama-2-70b · 版本 未说明 · 指标 accuracy · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{
  "harness": "25-shot"
}

论文 Table 3 70B 模型得分

打开官方来源