← 模型目录Claude 3 Opus
Anthropic · 2024-03-04 · 类别未确认
官方发布来源 · 按需求选型 · 查看覆盖缺口
Claude 3 Opus
Anthropic 第三代大模型家族旗舰 Claude 3 Opus,具备行业顶尖的复杂分析与编程能力,在 MMLU 达到 86.8%,GPQA 50.4%,MATH 60.1%,HumanEval 84.9%,GSM8K 95.0%,多项指标首次全面超越 GPT-4。
- 输入模态
- 文本 / 多模态
- 上下文
- 200K tokens
- 参数
- 旗舰
- 价格(每百万 tokens)
- 无此口径报价;不等于免费
本变体的评测证据
mmlu 86.8%
模型 claude-3-opus · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布卡公布 Opus 5-shot 得分
打开官方来源
gpqa 50.4%
模型 claude-3-opus · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布卡公布 Opus 0-shot 得分
打开官方来源
math 60.1%
模型 claude-3-opus · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布卡公布 Opus 0-shot 得分
打开官方来源
humaneval 84.9%
模型 claude-3-opus · 版本 未说明 · 指标 pass@1 · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布卡公布 Opus 0-shot 得分
打开官方来源
gsm8k 95.0%
模型 claude-3-opus · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布卡公布 Opus 0-shot 得分
打开官方来源