← 模型目录

GPT-4

OpenAI · 2023-03-14 · 类别未确认

官方发布来源 · 按需求选型 · 查看覆盖缺口

GPT-4

OpenAI 划时代多模态旗舰大语言模型,首次在大规模复杂推理、代码生成与人类专业考试(如统一律师资格考试、GRE、生物奥赛等)中达到人类顶尖水平,为现代大语言模型评估奠定了黄金标准。

输入模态
文本 / 图像
上下文
8K / 32K tokens
参数
MoE ~1.8T (行业估计)
价格(每百万 tokens)
输入 30 / 输出 60

本变体的评测证据

尚无对应评测记录。缺少证据不代表能力为零。

未关联到本页变体的记录

这些记录不会分配给任意模型参与选型。

drop 80.9% 模型 未标明 · 版本 未说明 · 指标 F1 (3-shot) · 单位 % 来源等级 A · vendor_reported · 核对日期 2026-09-01 · 距快照 33 天

归一化读数:不计算;样本及方差不完整,无法计算置信区间。

原文位置与完整协议

heading: Table 2 · table: Table 2 · row: DROP · page: 4 · quote_snippet: DROP 80.9 (3-shot F1)

{}

原文 note:2023 报告常引。迁移自 adoption[],定位与协议未核验。 2026-09-01 audit: page re-fetched (HTTP 200). The release page prints exam-percentile stat cards (Uniform Bar Exam 90th, etc.) but NO DROP number anywhere in page or payload - the DROP figure must be sourced from the GPT-4 Technical Report (arXiv 2303.08774), not this page. Row stays pending.

打开官方来源