← 模型目录

Phi-3-mini

Microsoft AI / MAI · 2024-04-23 · 类别未确认

官方发布来源 · 按需求选型 · 查看覆盖缺口

Phi-3-mini

微软端侧小模型巅峰之作,3.8B Mini 模型能在 iPhone 上流畅离线运行,在 MMLU 达 68.8%、GSM8K 达 82.5%、HumanEval 达 58.5%、MATH 达 43.4%,性能逼近 Mixtral 8x7B。

输入模态
文本
上下文
128K tokens
参数
3.8B
价格(每百万 tokens)
无此口径报价;不等于免费

本变体的评测证据

mmlu 68.8% 模型 phi-3-mini · 版本 未说明 · 指标 accuracy · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{}

技术报告 Table 1 3.8B Mini 得分

打开官方来源

gsm8k 82.5% 模型 phi-3-mini · 版本 未说明 · 指标 accuracy · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{}

技术报告 Table 1 3.8B Mini 得分

打开官方来源

humaneval 58.5% 模型 phi-3-mini · 版本 未说明 · 指标 pass@1 · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{}

技术报告 Table 1 3.8B Mini 得分

打开官方来源

math 43.4% 模型 phi-3-mini · 版本 未说明 · 指标 accuracy · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{}

技术报告 Table 1 3.8B Mini 得分

打开官方来源