← 模型目录GPT-4o mini
OpenAI · 2024-07-18 · 类别未确认
官方发布来源 · 按需求选型 · 查看覆盖缺口
GPT-4o mini
OpenAI 推出的小尺寸高性价比多模态主力,全面替代 GPT-3.5 Turbo,在 MMLU 达到 82.0%,MGSM 87.0%,HumanEval 87.2%,MATH 70.2%,GPQA 40.2%。
- 输入模态
- 文本 / 多模态
- 上下文
- 128K tokens
- 参数
- 轻量化(未公开规模)
- 价格(每百万 tokens)
- USD 输入 0.15 / 输出 0.6
本变体的评测证据
mmlu 82.0%
模型 gpt-4o-mini · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布博客公布 MMLU 得分
打开官方来源
mgsm 87.0%
模型 gpt-4o-mini · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布博客公布 MGSM 得分
打开官方来源
humaneval 87.2%
模型 gpt-4o-mini · 版本 未说明 · 指标 pass@1 · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布博客公布 HumanEval 得分
打开官方来源
math 70.2%
模型 gpt-4o-mini · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布博客公布 MATH 得分
打开官方来源
gpqa 40.2%
模型 gpt-4o-mini · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布博客公布 GPQA 得分
打开官方来源