← 模型目录Phi-4 (14B)
Microsoft AI / MAI · 2024-12-12 · 类别未确认
官方发布来源 · 按需求选型 · 查看覆盖缺口
Phi-4 (14B)
微软 14B 参数专攻复杂推理的开源大模型,采用合成数据增强与多阶段对齐,在 MATH 达 80.4%,GPQA 达 56.1%,MMLU 达 84.8%,HumanEval 达 82.3%,推理能力媲美大尺寸前沿闭源模型。
- 输入模态
- 文本 / 代码 / 数学
- 上下文
- 16K tokens
- 参数
- 14B
- 价格(每百万 tokens)
- 无此口径报价;不等于免费
本变体的评测证据
mmlu 84.8%
模型 phi-4 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}技术报告 Table 1 Phi-4 得分
打开官方来源
math 80.4%
模型 phi-4 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}技术报告 Table 1 Phi-4 得分
打开官方来源
gpqa 56.1%
模型 phi-4 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}技术报告 Table 1 Phi-4 得分
打开官方来源
humaneval 82.3%
模型 phi-4 · 版本 未说明 · 指标 pass@1 · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}技术报告 Table 1 Phi-4 得分
打开官方来源