wildclawbench-mm

由发布引用自动生成

这个评测在官方模型发布中被引用了 1 场发布(来自Alibaba / Qwen)。本页由这些发布引用自动生成:逐条列出每次引用的分数、协议与原文链接;完整的评测定义、数据集与指标介绍仍在补全,缺失的信息不会编造。

下面每张「发布」卡片记录了主流模型在该基准上的官方实测得分、评测协议与模型核心能力介绍。

模型发布引用时间轴

共收录 1 场模型发布 · 按发布时间倒序排列 · 数据更新于 2026-09-20

2026
2026-09-18 Alibaba / Qwen·国内

Qwen3.8-Omni-Flash

上下文1M模态文本·图像·音频·视频

Qwen 团队发布的新一代原生全模态大模型,支持 1M 上下文,具备从多模态内容理解到主动规划、工具调用与长程音视频创作的 Agentic 交付能力;在 29 项基准中平均较前代提升 25%,并大幅降低音视频 API 成本。

原生全模态1M 上下文音视频 Agent端到端交互

查看模型变体与证据

wildclawbench-mm +36.5

来源

发现本页数据问题?欢迎在 GitHub 提 Issue。