阿里语音大模型登顶全球第五,国产第一
源自35位全网作者
05-28 14:16
精选参考来源
1
阿里发布新一代全模态大模型Qwen3.5-Omni。
采用混合注意力MoE架构,通过1亿小时音视频+文本跨模态预训练 。
原生支持113种语言识别(含毛利语等濒危语种)和36种语音生成。
创新ARIA语音技术实现音色稳定,对话响应延迟降低至人类感知无差别水平。
核心突破:
视听理解:在DailyOmni等215项基准测试中全面超越Gemini 3.1 Pro ,嘈杂环境语音识别错误率下降42%(WenetSpeech基准)视频内容结构化描述准确率达98.1%(RealWorldQA测试) 。
Vibe Coding进化:非预设能力,在百万级多模态指令微调中自然涌现 。
普通用户可前往Qwen Chat免费体验,开发者和企业可通过阿里云百炼平台调用Qwen3.5-Omni模型Plus、Flash、Light三种API。
2
【#阿里HappyHorse登顶榜单#】权威AI模型评测平台LM Arena公布最新Video Edit(视频编辑)方向排行榜,阿里巴巴ATH事业群旗下模型happyhorse-1.0以1299分的Elo评分位列榜首,超越Grok等国际主流模型。这是LM Arena该方向榜单首次由中国团队获得第一。LM Arena是全球AI社区公认的权威盲测评估平台,采用匿名对比投票机制,由用户在不知道模型归属的前提下进行偏好投票,并通过Elo评分体系生成排名。此次上榜的happyhorse-1.0隶属阿里巴巴ATH(Alibaba Token Hub)事业群,组织代号为Alibaba-ATH。此前,HappyHorse系列模型已在Artificial Analysis的Video Arena榜单中以匿名身份登顶文生视频和图生视频双赛道,超越字节跳动Seedance 2.0、快手可灵3.0、Google Veo 3 Fast等国内外头部模型。(新浪科技)
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
最新文章
热门文章
-
又学到了,暑期旅行的15个隐藏妙招,学会可太省心了!330 93 -
不听劝自己在卫生间砌了个浴缸!夏天泡着真舒服~成本仅需400218 382 -
40岁再就业,年薪20万有社保还能干到65:房地产估价师(下)108 136
已收藏
去我的收藏夹