LLaMA-65B
Meta / Llama · 2023-02-24 · 类别未确认
LLaMA-65B
Meta 开源大模型奠基之作,证明了在海量 token(1.4T)上充分预训练的 65B 模型可以在 MMLU(63.4%)、GSM8K(50.9%)等诸多任务上媲美甚至战胜 175B 的 GPT-3,开启了全球开源大模型繁荣时代。
- 输入模态
- 文本
- 上下文
- 2K tokens
- 参数
- 65B
- 价格(每百万 tokens)
- 无此口径报价;不等于免费
本变体的评测证据
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。
归一化读数:不计算;样本及方差不完整,无法计算置信区间。