DeepSeek-R1
DeepSeek · 2025-01-20 · 类别未确认
DeepSeek-R1
深度求索开源的纯强化学习驱动推理大模型,开创性采用大规模强化学习与多阶段冷启动蒸馏技术,在数学竞赛、代码工程与复杂推理任务上达到与 OpenAI o1 相当的前沿水准。
- 输入模态
- 文本
- 上下文
- 128K tokens
- 参数
- 671B (37B active)
- 价格(每百万 tokens)
- 输入 0.55 / 输出 2.19
本变体的评测证据
尚无对应评测记录。缺少证据不代表能力为零。
未关联到本页变体的记录
这些记录不会分配给任意模型参与选型。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
heading: Table 2 · table: Table 2 · row: mmlu · page: 5 · quote_snippet: DeepSeek-R1 90.8%
{}迁移自 adoption[],定位与协议未核验。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
heading: Table 2 · table: Table 2 · row: mmlu-pro · page: 5 · quote_snippet: DeepSeek-R1 84.0%
{}原文 note:R1 报告引用。迁移自 adoption[],定位与协议未核验。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
heading: Table 2 · table: Table 2 · row: gpqa · page: 5 · quote_snippet: DeepSeek-R1 71.5%
{}迁移自 adoption[],定位与协议未核验。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
heading: Table 2 · table: Table 2 · row: aime24 · page: 5 · quote_snippet: DeepSeek-R1 79.8%
{}迁移自 adoption[],定位与协议未核验。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
heading: Table 2 · table: Table 2 · row: math500 · page: 5 · quote_snippet: DeepSeek-R1 97.3%
{}迁移自 adoption[],定位与协议未核验。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
heading: Table 2 · table: Table 2 · row: lcb · page: 5 · quote_snippet: DeepSeek-R1 65.9%
{}迁移自 adoption[],定位与协议未核验。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
原文位置与完整协议
heading: Table 2 · table: Table 2 · row: swebench · page: 5 · quote_snippet: DeepSeek-R1 49.2%
{}迁移自 adoption[],定位与协议未核验。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。