GPT-4
OpenAI · 2023-03-14 · 类别未确认
GPT-4
OpenAI 划时代多模态旗舰大语言模型,首次在大规模复杂推理、代码生成与人类专业考试(如统一律师资格考试、GRE、生物奥赛等)中达到人类顶尖水平,为现代大语言模型评估奠定了黄金标准。
- 输入模态
- 文本 / 图像
- 上下文
- 8K / 32K tokens
- 参数
- MoE ~1.8T (行业估计)
- 价格(每百万 tokens)
- 输入 30 / 输出 60
本变体的评测证据
尚无对应评测记录。缺少证据不代表能力为零。
未关联到本页变体的记录
这些记录不会分配给任意模型参与选型。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
heading: Table 2 · table: Table 2 · row: DROP · page: 4 · quote_snippet: DROP 80.9 (3-shot F1)
{}原文 note:2023 报告常引。迁移自 adoption[],定位与协议未核验。 2026-09-01 audit: page re-fetched (HTTP 200). The release page prints exam-percentile stat cards (Uniform Bar Exam 90th, etc.) but NO DROP number anywhere in page or payload - the DROP figure must be sourced from the GPT-4 Technical Report (arXiv 2303.08774), not this page. Row stays pending.