text2webapp

由发布引用自动生成

这个评测在官方模型发布中被引用了 1 场发布(来自Microsoft AI / MAI)。本页由这些发布引用自动生成:逐条列出每次引用的分数、协议与原文链接;完整的评测定义、数据集与指标介绍仍在补全,缺失的信息不会编造。

下面每张「发布」卡片记录了主流模型在该基准上的官方实测得分、评测协议与模型核心能力介绍。

模型发布引用时间轴

共收录 1 场模型发布 · 按发布时间倒序排列 · 数据更新于 2026-09-20

2026
2026-08-11 Microsoft AI / MAI·国际

MAI-Code-1.1-Flash

参数138B 总参(5B 激活),稀疏 MoE上下文256K价格$0.2/$1.2 每百万 tokens · 缓存输入 $0.02/M;GitHub Copilot 列表价(model card 定价栏标 "To be finalized",以 GitHub 列表价为准);annual Copilot 订阅 0.25× premium request multiplier;较 MAI-Code-1-Flash($0.75/$0.075/$4.50)降价约 73%模态文本·图像

发布文自述定位是内置在 GitHub Copilot 与 VS Code 里的 "small, efficient, coding workhorse"(小而高效的编码工作马)。卡上收录的 5 项评测覆盖真实 Issue 修复、终端操作与视觉建站:SWE-bench Verified 72.6%、Terminal Bench 2.1 62.9%(与前代同在 GitHub Copilot 生产 VS Code harness 下自报,1.0 为 71.6%/51.7%),价格约为 1.0 的四分之一。

轻量小模型档(GitHub Lightweight 类目)原生视觉输入Copilot 生产 harness 训练稀疏 MoE(5B 激活)

查看模型变体与证据

text2webapp 74.1

来源

发现本页数据问题?欢迎在 GitHub 提 Issue。