← 模型目录GLM-4
Z.ai / 智谱 GLM · 2024-01-16 · 类别未确认
官方发布来源 · 按需求选型 · 查看覆盖缺口
GLM-4
智谱 AI 在 2024 开发者大会发布的新一代基座旗舰,全面逼近 GPT-4。支持 128K 上下文、自主 Agent 工具调用、代码解释器及多模态,MMLU 达 81.4%,GSM8K 达 87.6%,HumanEval 达 72.0%,MATH 达 46.2%,C-Eval 达 85.8%。
- 输入模态
- 文本 / 代码 / 多模态
- 上下文
- 128K tokens
- 参数
- 未公开
- 价格(每百万 tokens)
- 无此口径报价;不等于免费
本变体的评测证据
mmlu 图表尚无可读数值
模型 glm-4 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-20 · 距快照 14 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布会公布 MMLU 得分
打开官方来源
gsm8k 图表尚无可读数值
模型 glm-4 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-20 · 距快照 14 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布会公布 GSM8K 得分
打开官方来源
humaneval 图表尚无可读数值
模型 glm-4 · 版本 未说明 · 指标 pass@1 · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-20 · 距快照 14 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布会公布 HumanEval 得分
打开官方来源
math 图表尚无可读数值
模型 glm-4 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-20 · 距快照 14 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布会公布 MATH 得分
打开官方来源
ceval 图表尚无可读数值
模型 glm-4 · 版本 未说明 · 指标 accuracy · 单位 %
来源等级 A · vendor_reported · 核对日期 2026-09-20 · 距快照 14 天
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
未提供原文定位
{}官方发布会公布 C-Eval 得分
打开官方来源