阿里语音大模型登顶全球第五,国产第一

源自35位全网作者

05-28 14:16

精选参考来源

1
阿里发布新一代全模态大模型Qwen3.5-Omni。 采用混合注意力MoE架构,通过1亿小时音视频+文本跨模态预训练 。 原生支持113种语言识别(含毛利语等濒危语种)和36种语音生成。 创新ARIA语音技术实现音色稳定,对话响应延迟降低至人类感知无差别水平。 核心突破: 视听理解:在DailyOmni等215项基准测试中全面超越Gemini 3.1 Pro ,嘈杂环境语音识别错误率下降42%(WenetSpeech基准)视频内容结构化描述准确率达98.1%(RealWorldQA测试) 。 Vibe Coding进化:非预设能力,在百万级多模态指令微调中自然涌现 。 普通用户可前往Qwen Chat免费体验,开发者和企业可通过阿里云百炼平台调用Qwen3.5-Omni模型Plus、Flash、Light三种API。
2
【#阿里HappyHorse登顶榜单#】权威AI模型评测平台LM Arena公布最新Video Edit(视频编辑)方向排行榜,阿里巴巴ATH事业群旗下模型happyhorse-1.0以1299分的Elo评分位列榜首,超越Grok等国际主流模型。这是LM Arena该方向榜单首次由中国团队获得第一。LM Arena是全球AI社区公认的权威盲测评估平台,采用匿名对比投票机制,由用户在不知道模型归属的前提下进行偏好投票,并通过Elo评分体系生成排名。此次上榜的happyhorse-1.0隶属阿里巴巴ATH(Alibaba Token Hub)事业群,组织代号为Alibaba-ATH。此前,HappyHorse系列模型已在Artificial Analysis的Video Arena榜单中以匿名身份登顶文生视频和图生视频双赛道,超越字节跳动Seedance 2.0、快手可灵3.0、Google Veo 3 Fast等国内外头部模型。(新浪科技)
全部
来源
内容由AI生成

精选参考来源

1. 阿里发布新一代全模态大模型Qwen3.5-Omni。 采用混合注意力MoE架构,通过1亿小时音视频+文本跨模态预训练 。 原生支持113种语言识别(含毛利语等濒危语种)和36种语音生成。 创新ARIA语音技术实现音色稳定,对话响应延迟降低至人类感知无差别水平。 核心突破: 视听理解:在DailyOmni等215项基准测试中全面超越Gemini 3.1 Pro ,嘈杂环境语音识别错误率下降42%(WenetSpeech基准)视频内容结构化描述准确率达98.1%(RealWorldQA测试) 。 Vibe Coding进化:非预设能力,在百万级多模态指令微调中自然涌现 。 普通用户可前往Qwen Chat免费体验,开发者和企业可通过阿里云百炼平台调用Qwen3.5-Omni模型Plus、Flash、Light三种API。

2. 【#阿里HappyHorse登顶榜单#】权威AI模型评测平台LM Arena公布最新Video Edit(视频编辑)方向排行榜,阿里巴巴ATH事业群旗下模型happyhorse-1.0以1299分的Elo评分位列榜首,超越Grok等国际主流模型。这是LM Arena该方向榜单首次由中国团队获得第一。LM Arena是全球AI社区公认的权威盲测评估平台,采用匿名对比投票机制,由用户在不知道模型归属的前提下进行偏好投票,并通过Elo评分体系生成排名。此次上榜的happyhorse-1.0隶属阿里巴巴ATH(Alibaba Token Hub)事业群,组织代号为Alibaba-ATH。此前,HappyHorse系列模型已在Artificial Analysis的Video Arena榜单中以匿名身份登顶文生视频和图生视频双赛道,超越字节跳动Seedance 2.0、快手可灵3.0、Google Veo 3 Fast等国内外头部模型。(新浪科技)

3. #阿里全员信#【#阿里重大组织架构调整#:通义实验室升级为事业部 李飞飞出任阿里云CTO】此次任命体现了阿里AI战略从分散走向集中的关键转变。资深数据库与云基础设施专家李飞飞出任阿里云CTO,旨在夯实AI发展的云底座,加速推动云与AI深度融合发展。此次调整标志着阿里已全面进入AI加速期,通过将通义大模型从实验室产品化并升级为事业部,精准补齐了“芯片—云计算—大模型—产业应用”的全栈AI能力链条,以应对激烈的市场竞争并实现技术驱动下的全面商业变现。钛媒体影像的微博视频

4. 上个月,OpenRouter出现了一个神秘模型,没有名字、没有介绍,只有一个代号:Hunter Alpha。凭借万亿参数和能力表现,悄然登顶OpenRouter第一和Agent开源大模型第一。现在答案揭晓了,居然是小米的MiMo-V2.5-Pro。所以,不管你喜欢小米还是不喜欢小米,小米确实又给国产大模型长脸了。希望未来,传说很牛的盘古大模型,也登上榜单和MiMo一起为国产大模型扬光。#小米首次登顶全球开源大模型第一#

5. AI战升级了!阿里这个简短的内部信新闻背后真的是杀气腾腾,看新闻得看背后的潜台词。首先是通义大模型实验室升级成通义大模型事业部。这个绝对不是一个简单的名称变化,从实验室到事业部,说白了就是全面落地,AI大模型的意义不止是争取一个跑分数据,榜单名次,发个论文,搞点新闻。必须全方位落地,也就是商业化,争用户搞服务,AI不能只是一个飘在天上的概念。其次就是这个资源的战略调配升级,我的妈耶,吴泳铭亲自担任阿里巴巴集团技术委员会的组长。老大牵头,成员包括阿里所有相关环节的重要负责人(周靖人是通义技术负责人,吴泽明是技术委员会原主席,李飞飞是阿里云智能数据库负责人)。也就是说,阿里为了这次升级,直接成立了一个高度精简的部门进行资源调配。目的是什么呢?看这一句话“最新模型Qwen 3.6 Plus问鼎OpenRouter全球大模型周调用量冠军”,也就是说,阿里要把Qwen 3.6这个成绩不止是一周那么简单,要大规模继续死磕下去。OpenRouter是一个大模型API聚合平台,开发者通过一个通义的接口调用不同厂商的模型,并且根据实际用量付费。调用量冠军意味着在这一周时间里,全球开发者通过这个平台调用阿里的Qwen 3.6次数超过了其他知名模型。这就证明了阿里在战略上对大模型定位的准确,以及表明了后续为了继续开发的决心。同时内部信强调2026年是关口年,也就是说在这一年里AI的具体应用,能拿下多少用户,讲决定未来数年内的市场分配。结合整篇内部信来看,阿里是准备要打一场AI大模型的攻坚战了。不简单,拭目以待今年的通义大模型事业部成绩!

6. 如何评价阿里千问大模型负责人林俊旸自宣卸任?会对通义千问造成什么影响?

7. 新设集团技术委员会,升级通义大模型事业部,阿里加速AI建设4月8日,阿里巴巴集团CEO吴泳铭发布内部信,宣布AI相关组织调整,包括新设立集团技术委员会,升级通义大模型事业部,加速AI建设。根据内部信,最重要的两个调整包括:第一,成立阿里巴巴集团技术委员会,由吴泳铭担任组长,成员包括周靖人、吴泽明、李飞飞;第二,将通义实验室升级为通义大模型事业部。2026年是阿里AI加速发展的关键一年。从成立ATH事业群,到最新模型Qwen 3.6 Plus问鼎OpenRouter全球大模型周调用量冠军,近期阿里在AI领域的新动作不断。本次调整意味着聚合优势力量和资源,投入最关键战场,表明阿里已进入AI全面加速期。

8. 阿里语音大模型“悄悄”登顶全球:听准、听懂、会聊,全面超越GPT

9. 词错误率仅1.8%领跑,阿里语音大模型国际评测登顶,全面超越GPT构建生态闭环

10. 阿里语音大模型全球登顶!方言、外语全拿下,人机交互新纪元来了

11. 阿里语音大模型揽三项全球第一!碾压GPT-4,中国AI再次扬威世界

12. 阿里语音AI三项登顶,中国AI在听懂人话上把OpenAI甩在了身后

13. 阿里语音大模型获三项第一;智谱发布新成果:不加一块GPU,算力多出15%|数智早参

14. 阿里语音大模型登顶 三项指标超越GPT 行业格局改写?

15. 阿里语音大模型登顶全球评测

16. 阿里巴巴考察参访预约 | 阿里语音大模型登顶全球榜单,Fun-Realtime拿下三项第一

17. 超越GPT-Realtime-2 阿里语音大模型获三项第一

18. 告别尴尬停顿,阿里发布最懂情绪的AI语音模型,比闺蜜哥们还贴心

19. 阿里语音大模型登顶全球评测,三项核心指标超越GPT-Realtime-2

20. 超越GPT-Realtime-2,阿里语音大模型获三项第一

21. 阿里通义实验室开源Fun-Audio-Chat:端到端语音交互模型,流畅的AI语音聊天

22. 阿里语音大模型登顶 三项指标超越GPT 行业格局改写?

23. 腾讯推出操作系统层级AI助手“马维斯”;超越GPT-Realtime-2,阿里语音大模型获三项第一丨AIGC日报

24. 阿里通义推出 Fun-Audio-Chat:端到端语音大模型可感知情绪、执行复杂任务

25. 阿里通义开源 Fun-Audio-Chat-8B,在多权威语音评测中同尺寸模型排名第一,综合性能超越 GLM4-Voice竞品

26. 阿里语音模型三冠王背后:AI真的要取代同传了吗?

27. 阿里开源Fun-Audio-Chat-8B 支持语音对话

28. 阿里Fun系列语音大模型全球夺冠,落地千问高德钉钉等多场景

29. 【音频前沿分享】Qwen发布了新一代端到端语音交互模型 Fun-Audio-Chat!

30. 阿里通义开源端到端语音交互模型 Fun-Audio-Chat,能猜出你的心情

31. 又开源!能干活的高情商语音搭子

32. 阿里通义实验室发布FunASR1.5语音识别大模型

33. 阿里通义推出语音识别大模型Fun-ASR1.5:覆盖30种语言 支持汉语七大方言体系

34. 阿里通义实验室推出语音识别大模型Fun-ASR1.5

35. 阿里最新语音大模型Fun-ASR1.5,精通30国语言及方言

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章