← 模型目录

Grok-1

xAI / Grok · 2023-11-04 · 类别未确认

官方发布来源 · 按需求选型 · 查看覆盖缺口

Grok-1

马斯克旗下 xAI 创立后的首款大语言模型,采用 314B 总参数稀疏混合专家架构,以幽默叛逆风格和 X 平台实时知识接入为特色。在 MMLU 达 73.0%,GSM8K 达 62.9%,HumanEval 达 63.2%,MATH 达 23.9%。

输入模态
文本
上下文
8K tokens
参数
314B-A86B MoE
价格(每百万 tokens)
无此口径报价;不等于免费

本变体的评测证据

mmlu 73.0% 模型 grok-1 · 版本 未说明 · 指标 accuracy · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{}

xAI 官方博客公布 Grok-1 MMLU 得分

打开官方来源

gsm8k 62.9% 模型 grok-1 · 版本 未说明 · 指标 accuracy · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{}

xAI 官方博客公布 Grok-1 GSM8K 得分

打开官方来源

humaneval 63.2% 模型 grok-1 · 版本 未说明 · 指标 pass@1 · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{}

xAI 官方博客公布 Grok-1 HumanEval 得分

打开官方来源

math 23.9% 模型 grok-1 · 版本 未说明 · 指标 accuracy · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-12 · 距快照 22 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

未提供原文定位

{}

xAI 官方博客公布 Grok-1 MATH 得分

打开官方来源