omnilingua-mspeaker

由发布引用自动生成

这个评测在官方模型发布中被引用了 1 场发布(来自Alibaba / Qwen)。本页由这些发布引用自动生成:逐条列出每次引用的分数、协议与原文链接;完整的评测定义、数据集与指标介绍仍在补全,缺失的信息不会编造。

下面每张「发布」卡片记录了主流模型在该基准上的官方实测得分、评测协议与模型核心能力介绍。

模型发布引用时间轴

共收录 1 场模型发布 · 按发布时间倒序排列 · 数据更新于 2026-09-20

2026
2026-09-18 Alibaba / Qwen·国内

Qwen3.8-LiveTranslate

模态音频·文本·视频

通义千问基于 Hybrid MoE Thinker-Talker 架构重构的端到端实时同传模型,支持 60 种语言输入与 29 种语音输出,字均延迟(LAAL)降至 2.3 秒,具备实时说话人分离、双语同帧同出与长上下文消歧能力,在 Omnilingua-MSpeaker 与 FLEURS 上取得领先。

Interleave 架构字均延迟 2.3s实时说话人分离双语同帧同出长上下文消歧

查看模型变体与证据

Omnilingua-MSpeaker (14 language directions) 图表尚无可读数值

来源

发现本页数据问题?欢迎在 GitHub 提 Issue。