当前位置:
AIGC文章详情

安静房间识别率98%,咖啡馆却暴跌至67%:语音助手的真实能力陷阱

源自139位全网作者

04-19 15:04

内容由AI生成

精选参考来源

1. AI智能体如何改变自媒体创作者的工作环境?HarmonyOS 6工作场景体验

2. 华为全场景进入全链生态时代,对普通人生活有何价值?

3. AI 语音输入法爆火:豆包输入法全面上线,Typeless 日榜第一,Wispr 融资 8100 万美金

4. AI时代,最不值钱的,就是重复劳动; 最值钱的,是你得熟练指挥智能体。#大咖观察 #红衣聊AI #硅谷 #智能体 #AI应用

5. 未来的人和智能体应该是相互融合协作的关系。 #大咖观察 #红衣聊AI #智能体 #人机协作

6. #领克致歉语音误关大灯#从视频看,这车语音交互是有很大问题。第一句就识别错误,把阅读灯听成了灯。同时系统逻辑也有问题,行车的时候居然能允许语音关大灯。后面司机语气慌了,语音就干脆不识别了。多个bug叠加导致事故。当然,司机是真的慌了,这个时候拉住灯光拨杆手动远光,是可以强制开远光的。现在用车的语音交互有一个感受:聪明的语音用上了就离不开,不聪明的压根不想跟它说第二句话。 -_-二师兄的微博视频

7. #DeepSeek何时支持语音聊天#随着DeepSeek新模型MODEL1的架构细节曝光,语音聊天功能的呼声愈发高涨。从技术储备来看,DeepSeek早已在语音识别、语义理解等领域实现突破,67B模型在嘈杂环境下识别准确率提升23%,还能解析模糊语音指令,情感识别准确率达89%,技术底座已然扎实。此次新架构的KV缓存优化和FP8解码支持,让推理速度翻番、显存占用大减,恰好能解决语音交互的实时性痛点。不过从更新重点来看,MODEL1当前更侧重编程能力与长文本处理,语音功能可能不是首要目标。但语音早已是AI对话的标配,尤其在车载、医疗等场景需求迫切。现在推出不算晚,关键是结合自身优势打造差异化体验。除了语音聊天,更期待DeepSeek将Engram记忆模块与语音结合,实现跨场景对话连贯性,同时开放语音接口让开发者二次创新。 deepseek何时支持语音聊天

8. #极氪8X首发舱驾融合超级智能体#极氪 8X 搭载的超级 Eva,依托端到端语音大模型直接处理音频 token,实现从命令式操控到对话式意图理解的升级。系统可精准捕捉语气、情绪与上下文,带来连续自然的交互体验,让座舱具备情感化理解能力,彻底告别机械指令式交互。 伊妹耳的微博视频

9. 很多人让我比较AI和互联网谁的机会更大, 别急,看完这条视频,咱们一起聊聊。#大咖观察 #红衣聊AI #智能体 #互联网

10. #何小鹏直播第二代VLA推送#小鹏汽车相关负责人何小鹏与刘先明围绕汽车智能化发展进行的讨论,解读“跨域融合”对“超级汽车智能体”进化的核心作用。何小鹏表示,跨域融合绝非简单技术整合,而是覆盖底盘、动力、EEA架构与控制系统的全领域融合,既是技术领先,也是差异化优势,能让智能体实现自主行驶与交互。刘先明补充,依托先进EEA架构,跨域融合可实现整车统一控制,让汽车更像智能体,精准理解用户意图,安全舒适地完成出行需求。 铭科技的微博视频

11. 作为 HarmonySpace 5 起采用的核心架构,MoLA 通过融合多模态感知、通用大模型与垂域智能体,打通用户意图到硬件执行链路;支持全域免唤醒、导航三模式纠错,实现口语化自然控车(比如:“车里有点暗”开启阅读灯)。鸿蒙座舱率先迈入L3专业助理阶段,具备长期记忆、模糊意图理解等六大类人能力,可主动提供服务;能记住通勤习惯、图文视频解答用车疑问,联动外部工具完成跨场景任务。生态构建上,新增HUAWEI SOUND空间音专区、云游戏(腾讯云游戏即点即玩);实现智能香氛与氛围灯联动,打通人车家无缝协同;构建出行、音乐、影视等个性化“第三生活空间”。你们觉得如何呢?#华为乾崑生态共赴热爱##鸿蒙座舱全新定义智能化分级# 繁繁_leon的微博视频

12. 终端厂商战略布局 AI agent,华为小艺为何拔得头筹?

13. 当AI从工具进化为队友,个人超级智能体硬件来了

14. #科技先锋官# 当科技巨头还在争夺屏幕视觉空间时,OpenAI已将目光投向无屏交互的新蓝海。OpenAI近期公布的语音AI新战略,计划2026年推出全新语音模型与无屏语音设备,重塑人机沟通的底层逻辑。OpenAI的核心突破在于自然交互与效率升级。基于GPT-4o多模态能力迭代的语音模型,不仅能精准解析模糊指令,还支持用自然语言调控音色、语调,0.3秒内即可生成拟真音频。更关键的是端侧AI技术的融入,让语音处理可在本地完成,既降低了延迟,也提升了隐私安全性,为无屏设备奠定技术基础。家庭场景中,无屏设备可联动智能家电,实现语音控温、播放内容等基础功能;办公与公共空间里,能化身会议助手自动记录要点,或在医院、厨房等双手忙碌场景提供免接触服务。未来更有望嵌入智能眼镜、车载系统,让交互融入生活细节。亚马逊Alexa、谷歌Assistant等早已布局,全球智能语音市场前五大厂商将占据75%份额。但OpenAI的优势在于强大的语言理解能力,有望打破现有语音助手“机械响应”的瓶颈。不过用户习惯转变仍是关键,当前语音功能使用率不足15%,如何让说话办事成为常态,将是其市场突破的核心课题。#AI创造营##AI创作热点##一条vlog回顾2025# 种斌Marco的微博视频

15. 国内首个手机端AI智能体,小米MicLaw龙虾正式开启封测,直接把手机AI带到了全新阶段。 这款被大家叫做龙虾的AI,可不是普通的语音助手,而是小米自研的系统级智能体,深度整合在手机底层,能真正理解你的意图、自主完成复杂任务,还能联动小米人车家全生态。 不管是帮你处理日常操作、串联多个应用,还是自动规划、执行指令,都比传统AI更省心、更智能。 这次封测属于小范围邀请制,主要面向部分机型先行体验。不少米粉都在蹲公测资格,毕竟这是国内第一个真正落地的手机端AI智能体。#小米发布国内第一个手机版龙虾##小米miclaw开启封测#

16. 今晚智己发布了AI超级智能体,并宣布智己LS8将于3月26日开启预售。所谓AI超级智能体,它是基于“舱驾一体、全域融合”的智能架构,将线控底盘、智驾AI、智舱AI三大核心系统打通,通过对车辆动作的全域掌控,以及AI对用户意图的理解,带来更为智能的用车体验。同时,这次智己还发布了全线控灵蜥数字底,并与Momenta联合推出了IM AD ZETA,其具备L4级智驾模型能力。在智己LS8方面,其还将搭载千问大模型,专属司机助理1.0也将在LS8上落地。这些功能具体体验如何,肯定要等到实际体验到才能下结论,可以期待一波。

17. AI汽车正式进入车载具身智能时代

18. 10月23号荣耀开发者大会上,CEO李健直接放了大招!MagicOS 10这次玩真的,直接进化成能自学习的AI智能体系统,从“你叫我做”变成“我主动帮你做”的智慧大脑!它从五个维度全面升级:✨ 模型升级:端云协同,更懂你的个人大模型✨ 内核升级:AI智能体能力调度,效率翻倍✨ 协同升级:跨智能体无缝互联✨ 服务升级:能理解意图、自主决策✨ 交互升级:多模态自然交互,动口动手都行这波操作不仅让用户体验飞起,还给开发者搭建了超棒的开放生态!据说荣耀已经和阿里、比亚迪等大佬合作,接入4000+生态智能体,落地3000+场景,还砸了20亿激励开发者!#荣耀全球开发者大会2025##hgdc2025#

19. 在极氪8X的交互实测中,超级Eva最直观的改变在于从命令式语音走向对话式理解。端到端语音大模型直接处理音频token,使极氪8X能精准捕捉语气、情绪与上下文。这种交互体验的升维,让极氪8X的座舱首次具备了一种“被理解”的温度,而非冰冷的指令回响。#极氪8X首发舱驾融合超级智能体#

20. 2025过去了!这一年你是不是也在为AI焦虑? 老周用360一整年的实践,告诉你答案:不用怕,抓住Agent就赢了! 从我自己敲代码做100多个智能体,到带领团队All in,这条AI布道之路,全是实战干货。 2026,你想和智能体一起搞定啥?评论区留言,老周帮你研究!#大咖观察#2026 #年度总结 #红衣聊AI #agent

21. 【华为鸿蒙智家】小艺管家,更懂家的AI语音

22. 领克语音助手夜间误关大灯引发撞车,这是怎么回事?车企该怎样解决语音控制系统的安全问题?

23. Mate80 + 鸿蒙 6.0深度体验:小艺才是 AI Agent全新时代的超强智能小助手,用过就再不能离开它

24. 未来汽车的中控系统会发展成什么样,语音交互能完全取代触摸吗?

25. 【华为发布全新小艺管家】 华为发布全新小艺管家。新的小艺管家在语音交互能力上全方位升级,通过深度语义理解与语音场景创建能力,让交互体验进一步提升。 华为官方表示全新的小艺管家,实现了将复杂的操控简化为“大事小事,都是小艺管家一句话的事”。 具体来说,全新小艺管家在大模型的加持下显著提升了自然语言理解能力,它不再局限于字面指令的匹配,而是能够深度理解用户的真实意图和语境。用户无需记忆固定指令格式,使用日常口语即可轻松操控全屋设备。比如说出“打开这个屋的灯”或“打开宝贝房间的灯”这样的指令也能准确理解空间泛化的语义。 此外,全新小艺管家能够基于住宅的 3D 户型模型与设备布局信息,实现基于真实三维空间的方位识别与控制能力,准确理解家中灯具、家电等设备的实际空间位置。用户无需记忆繁琐的设备名称,直接通过日常位置表述即可实现精准控制。 同时,华为鸿蒙智家推出了基于小艺管家的“场景大师”功能。用户只需一句话,即可完成包含十余个动作的复杂场景创建。对于已有场景,用户也能通过语音直接修改,无需寻找和打开复杂的设置菜单。 目前,该功能支持流畅的多轮对话与场景摘要确认,用户不用一次性说清所有需求,可以与小艺管家进行多轮交互,逐步交代意图。而用户下达指令后,小艺会简要复述执行摘要,帮助用户确认已下达的指令信息。 此外,升级后的小艺管家聆听能力也更强。小艺管家引入了定向降噪技术,通过先进的噪声方位检测算法,能够精准锁定并定向拾取使用者的人声,抑制拾取其他方向来源的噪声。小艺还带来了“悄悄话”交互模式,用户可以在 5 米距离内,使用仅有气声的悄悄话与小艺完成全流程对话。 在执行能力方面,全新小艺管家执行能力也得到升级,基于智能主机 X2 Pro 的算力,小艺管家唤醒速度快,协同唤醒时延小于 500 毫秒,本地处理能力得到加强,语音指令无需上云#华为发布会#

26. 重磅发布!国家队出手解决企业跨省通信「老大难」,语音识别错误率暴降20%

27. 击败GPT、Gemini,复旦×创智孵化创业团队「模思智能」,语音模型上新了

28. 2026年AI全景预测:迈向百亿智能体时代的20个发展趋势。 #大咖观察 #人工智能 #红衣聊AI #智能体 #AI时代

29. 华尔街被一篇神文吓傻!如果到2028年,AI智能体全面普及, 会发生什么?#大有学问 #红衣聊AI #华尔街 #人工智能

30. 今晚卿卿跟小爱同学的对话不是很顺利一开始定闹钟可以,但是后面播放音乐,一直识别不出来,因为“小爱同学,单曲循环大张伟我怎么这么好看。”这句话整整十八个字!对他来说太长了,好长好长,他说清楚的句子,十个字以内基本就是极限,这个句子实在太长了,所以中间他会吞字,比如“这么”快进成“真”,而且语速太赶,不赶的会忘记,赶了小爱同学听不出来了。还好,一遍又一遍,试了几分钟,最后他选择换歌,换阳光彩虹小白马,成功播放出来。现在已经听着音乐呼噜呼噜睡着了~#大卿哥的搬砖日记# 小卷毛王炸炸的微博视频

31. #科技先锋官# 语音驱动执行之所以能重塑工业生产力,核心优势体现在三大维度。首先是解放双手,聚焦核心任务,工业维护场景中,技术人员常需携带工具、攀爬设备,双手被完全占用,语音交互无需手动操作终端,一句完成此工单、创建泵体维修申请即可触发流程自动化,让专业人员将时间集中在设备检修而非系统操作上。适配复杂环境,提升操作效率。工厂车间的机械噪音、金属撞击声等复杂环境,对交互方式提出极高要求。mobiMentor AI 依托成熟的语音识别技术,在嘈杂场景中仍能精准捕捉指令,配合实时自适应能力,可根据设备历史数据动态调整响应,避免重复沟通,使工单处理效率提升数倍。降低使用门槛,加速经验复用。传统工业系统操作复杂,而语音是最自然的交互方式,技术人员无需学习专业操作流程,即可快速上手。该智能体基于真实 EAM 数据训练,能将资深工程师的经验转化为语音指令下的标准化操作,助力规模化复制专业能力,减少人为失误。#AI创造营##AI生活指南##微博超有用视频大赛# 种斌Marco的微博视频

32. 关于吉利超级智能体,体验完了。枯燥的技术和复杂的参数就不说了,说点大家听得懂的。 这套智能体多厉害? 拿极氪8X来说,作为行业首款发布即上车的舱驾融合超级智能体车型,在这套智能体的搭载下,极氪8X在智能交互上,不再是一个只会执行指令的工具,而是一个会思考,能预判,能共情,甚至是用户一句话就能联动舱驾,帮你开车,帮你办事的智能出行伙伴。 怎么办到的?除了WAM世界行为模型在核心架构上把舱驾打通,千里浩瀚G-ASD 4.0不管是高速人工收费站,还是没有地图的陌生园区,全场景无断点。超级Eva则负责理解用户的意图,学习用户的习惯,并通过联动各域进行任务规划和决策。 如果说超级Eva负责“想”,G-ASD 4.0就是负责“动”,这种分工带来的直接体验就是: 用户一句话,超级Eva就能迅速和G-ASD 4.0进行联动,进而完成从“听懂意图”到“控制车辆执行”的全流程。 有了这套智能体的加持,极氪8X在整个智能化上的体验可以说是非常领先的,再加上强劲的性能,稳健的操控,新越野“公路之王”极氪8X非常值得你去体验一下…… #类人的辅助驾驶是什么体验#

33. 智能体设计模式总结

34. 哇噻!下赛季水晶爆炸后强制闭麦,喜欢开麦贴脸的召唤师估计要爆炸难受了!而且,红开再也不会出现“重开”啦,语音识别优化后,在峡谷里大家语音识别转文字时普通话都在同一个水平线上啦!#王者新赛季水晶爆炸后强制闭麦##王者语音识别即将优化##王者荣耀#

35. 最新无线领夹麦克风推荐深度保姆级测评:买前必看!双十一无线领夹麦克风推荐2025性价比怎么买不踩雷?西圣、大疆、罗德、浩瀚、猛玛等热门无线领夹麦克风值得入手?

36. 通勤降噪横评,3款卷王耳机选对不踩雷

37. 阿里发布新一代全模态大模型Qwen3.5-Omni。 采用混合注意力MoE架构,通过1亿小时音视频+文本跨模态预训练 。 原生支持113种语言识别(含毛利语等濒危语种)和36种语音生成。 创新ARIA语音技术实现音色稳定,对话响应延迟降低至人类感知无差别水平。 核心突破: 视听理解:在DailyOmni等215项基准测试中全面超越Gemini 3.1 Pro ,嘈杂环境语音识别错误率下降42%(WenetSpeech基准)视频内容结构化描述准确率达98.1%(RealWorldQA测试) 。 Vibe Coding进化:非预设能力,在百万级多模态指令微调中自然涌现 。 普通用户可前往Qwen Chat免费体验,开发者和企业可通过阿里云百炼平台调用Qwen3.5-Omni模型Plus、Flash、Light三种API。

38. AI效率革命!一本手册,让你的智能体助手覆盖五大场景

39. 全域 全场景——范围变大是好事,但并非“哪里都能用”

40. AI圈罕见一幕!模型强到不敢公开发? #大有学问 #红衣聊AI #AI工具 #智能体

41. 最近有人用一台电脑,再加一群AI智能体。 用公开数据和AI智能体集群,在24小时内重新还原了这次军事冲突的全过程。#大有学问 #红衣聊AI

42. 我喜欢用实体按钮//@霜叶:这并非领克独有的问题,而是车载语音系统的行业通病。语音助手普遍存在识别精度低、场景适配差、交互逻辑缺安全考量的问题,对行车中的噪音、车主的语速变化适配性比较差。我今早喊了好几遍:你好宝马,导航到某处…愣是在显示地址后,就停滞不动了,无法继续使用语音完成导航任务其次行业陷入“智能化内卷”,很多时候忽视了汽车作为交通工具的核心安全属性。

43. 实时响应!已经分不出是AI还是真人说话了

44. 极氪8X这次带来的变化,在于让座舱与智驾共用一套统一的智能体系。基于WAM框架,理解、规划、预演到执行被打通成完整链路,整车更像一个可以自主协同的智能体。在实际体验中,这种能力转化为很直接的使用感受:只需表达需求,系统就能把接送、绕路、泊车等多步骤任务自动拆解并完成,减少人为干预。超级Eva作为交互入口,不只是语音工具,而是能调动整车能力的“执行中枢”,从对话中理解意图并推动落地。随着端到端语音模型的引入,沟通方式也更自然,能够感知语气与上下文,让人车关系更接近真实交流。#极氪8X首发舱驾融合超级智能体#

45. 无问芯穹首曝智能体服务平台,以基础设施加速企业级「智能体自由」

46. 小龙虾上理想汽车具身视频!StreamingClaw 是理想汽车 MindGPT-ov 团队提出的、兼容 OpenClaw的实时流式视频理解与具身智能统一智能体框架,能做到离线推理,长时记忆,实时交互主智能体管流式推理调度,两个子智能体分别扛长时记忆和主动交互,动态滑窗+KV缓存剪枝,低延迟跑长视频也不在话下。多模态层级记忆、时间/事件双主动提醒,直接落地感知-决策-行动闭环,车载疲劳监测、家庭机器人看护、AI眼镜辅导全都能用。目前看下来音频支持还有待提升,以后的大趋势肯定是全模态统一智能体,感觉离想哥说的“汽车将从工业时代的交通工具,进化成为人工智能时代的空间机器人”又更进了一步#理想汽车##OpenClaw##具身智能#

47. 边境小城试驾有AI智能体的魏牌V9X 看如何应用在辅助驾驶和日常用车的

48. 《扣子开发 AI Agent 智能体应用》001-智能体概述

49. 领夹麦克风哪款好?大疆麦克风怎么样?西圣和大疆麦克风对决!

50. 《人工智能70年》020-语音识别的历史性突破(深度学习带来历史性突破)

51. 语音智能体商业落地的教训、经验与实践|李沐硅谷101年度线下大会演讲(全英)

52. #极氪8X首发舱驾融合超级智能体#极氪8X首发的超级Eva在经历了非常深度的思考之后,依然认为撒贝宁要比尼格买提帅,感觉小尼已经很想下车了除了这些以外,这个驾舱融合能够理解司机意图,司机一句话,车子去执行,你可以把汽车当成一个具身智能的的智器,可以持续进化,规划行程,理解意图,做到比真正的人类司机更懂你 梦想家陈轶亮的微博视频

53. 如果说人形机器人还停留在春晚舞台和测评人手里,那智能汽车就是AI与机器结合的现实落地。小鹏第二代VLA与VLM的跨域融合,正是这一趋势的关键一步:• VLA(视觉-动作大模型):让车看懂世界,像老司机一样精准决策、平稳驾驶。• VLM(视觉-语言大模型):让车听懂意图,理解模糊指令,主动提供服务。两者结合,汽车不再是冰冷的交通工具,而是能感知、理解、服务的超级智能体。这不是遥远的科幻,而是正在发生的出行革命,也是人工智能从“能说会道”走向“能行能干”的最佳证明。

54. 索尼WF-1000XM6真无线降噪耳塞:降噪跃升25%,新一代真无线降噪旗舰

55. 真·AI新物种诞生 智能体超级影音机器人颠覆式登场 传统视听设备要过时了?!#BUTTONS##智能奢品##BUTTONSSOLEMATE##TERMINUS特斯联##超级影音机器人##AI智能体##ai##INTELLIGENTLUXURY##HALI# 科技最前线的微博视频

56. 《人工智能70年》017-语音识别的历史性突破(统计语言学打破沉寂)

57. 字节又放大招!最强语音输入法来了,实测遥遥领先

58. #杨幂语音包上车##杨幂怼人 反而给了一些古力##杨幂坐上了我的副驾#谁还没体验过被杨幂宠着开车的快乐!享界杨幂专属语音包上线,情绪价值拉满了!不管是日常通勤还是周末出游,一句指令就能唤醒全场景陪伴。享界OTA升级持续放大招,华为乾崑智驾ADS 4.1,智慧出行更从容!方言指令也能秒识别,鸿蒙生态无缝衔接,直接让出行方便加倍~

59. 领克语音助手夜间误关大灯引发撞车,这是怎么回事?车企该怎样解决语音控制系统的安全问题?

60. 现在来到的是智能座舱声学实验室,可测量小爱语音交互。车周围涵盖了一系列喇叭播放的白噪音,涵盖车辆真实场景中会遇到的各种场景白噪音,如停车场、城市道路、高速道路等场景下的背景噪声。这里可以测试车外小爱的准确度,用“人工嘴”模拟不同年龄、性别和口音的人声发出指令,综合测试小爱同学的语音识别率和响应质量。只有录入声纹的用户才能使用车外小爱。

61. 华为加持,尚界H5语音交互能力杠杠的#尚界H5# 天马行空QYY的微博视频

62. 智己汽车发布行业首个超级智能体IM Ultra Agent,全球首搭千问大模型,实现“全域代劳的专属司机助理”。其核心是“舱驾一体、全域融合”的智能架构IM Fusion Nova,打通线控底盘与AI系统。基于全线控底盘和L4级智驾模型IM AD ZETA,车辆能精准理解模糊意图并自动执行复杂任务;首款搭载该技术的智己LS8车型将于3月26日开启预售。#千问大模型首发搭载智己LS8# #智己LS8预售发布定档3月26日# #保罗车闻#

63. 腾讯云大数据 TC Data Agent 智能体发布与应用实战

64. 镁合金焊接缺陷的产生及防止

65. #微博声浪计划##听见微博# 汽车圈伪AI智能体争议升温,多数智能座舱仅为高级语音助手,存无身份感知等缺陷。行业共识认人识人是AI智能体的照妖镜,真智能体需精准识别乘员、记忆习惯。魏牌V9X等方案通过分层记忆等技术实现主动服务,带来千人千面体验,同时引发生物信息安全争议。 http://t.cn/AXMnSuT7

66. 《人工智能70年》016-语音识别的历史性突破(人类的美好梦想与历史探索)

67. 豆包发布语音识别模型 2.0,支持多模态视觉和 13 种海外语言,有哪些技术亮点?

68. 语音拣选在嘈杂环境下的识别率如何保证?——基于现场实测的技术实践

69. 帝国理工学院首次为语音识别AI做"体检" - 哔哩哔哩

70. 嘈杂环境下 | 人声语音 | 清晰的秘密

71. 不同环境下,AI识别语音的准确率如何做到统一

72. 【交我学-18】让机器 “看懂” 声音

73. 智能体如何赢得人类的信任与使用意愿

74. 智能语音识别关键技术

75. AI 如何在喧嚣世界中“听清”真相?抗噪语音识别的奥秘

76. 被低估的前置语音技术——为什么你的语音 AI 总「听不清」? - 哔哩哔哩

77. 人工智能之语音领域 语音处理 第六章 语音处理技术发展趋势与未来展望

78. 听音室

79. 全双工畅聊无界,A09 语音处理模块重塑多场景通话体验

80. 突破噪音壁垒!NR2047 语音处理芯片,让全场景交互更清晰

81. 工业级 AI 语音处理新标杆 ——A-59 降噪消回音模块

82. A-59F 多功能语音处理模组的功能性能解析与场景化应用研究

83. EN46双麦模组

84. 突破噪音!AI智能耳机无创分离对话 开源代码可复用

85. 歌尔语音算法杂音抑制率超90%

86. 语音转写如何精准区分不同发言人

87. 小米+DeepSeek首晚反馈

88. 阿里Qwen3-ASR横空出世,52种语言通吃,语音转写彻底告别踩坑

89. 吴宜函|看得见、听得清

90. 谷歌干掉「请再说一次」!Gemini 3.1毫秒级接话,实时Agent时代来了

91. Qwen3-ASR 深度解读

92. AI智能降噪处理器

93. 阵列麦克风

94. 小智阵列麦克风使用体验

95. 字节甩出全双工语音大模型Seeduplex,语音交互要被颠覆了?

96. 王者荣耀携手腾讯游戏语音GVoice团队开创性实现ASR端侧模型上线应用,大模型端云协同迎来关键突破

97. 适合智能家居的AI语音交互芯片推荐

98. 毫秒级响应的AI语音交互芯片支持多国语音和200+方言

99. 实时多模态语音视觉交互

100. 第5代帝豪语音交互毫秒响应+双语识别更贴心

101. 鸿蒙智行车载小艺学会实时思考,引领车载智能体新方向

102. 跨时代智驾新章 智己超级智能体定义AI车载新范式

103. 语音识别芯片介绍,语音识别芯片工作原理解析

104. WeNet语音识别实战(高清完结)

105. 智能体的测试指标与评价方法

106. 智读未来|语音识别

107. 通勤党狂喜!览邦 Watch Ultra 独立通信+AI+语音+视界,刷公交/支付/通话一表全包

108. Airi

109. 端侧大模型语音交互,适用于毕业、课程设计、大模型C++嵌入式面试项目

110. 智读未来|语音识别

111. A-59U:消回音降噪 + 高准音频识别,工业级语音交互标杆

112. 开源项目 Omni-AVSR 太牛了!一个模型搞定听、看、音视频语音识别,嘈杂环境也能精准识别。

113. 一篇文章讲透小米SU7车外语音交互方案

114. Fun-ASR - 多语种、多方言的高精度语音识别软件 支持50系显卡 一键整合包下载

115. 革新语音交互体验:A-59P 升级版 AI 降噪语音处理模组重磅来袭

116. 详解麦克风阵列的基本原理、结构组成及声学效果

117. 抗噪语音交互如何革新嘈杂车间的HMI操作体验

118. 降解语音:通过输入操控实现鲁棒性语音转换的全面综述

119. Gemini 2.5 Native Audio:语音助手,终于“像个人”了。。。

120. 语音产品噪声环境识别优化完全指南:从指向性麦克风到降噪算法

121. 从零到一,搞定 FunASR 多人语音识别 (Speaker Diarization) 的踩坑实录

122. 《信号处理》| 跨模态双向注意力的视听双主导语音增强方法

123. TASLP论文分享:鲁棒语音识别

124. 说话人音频分离,本地开源:一个音频里混着几个人说话?AI帮你"挑"出每个人的声音,从混音到分离,零基础"拆解"多人对话

125. 语音识别中有用的前端算法

126. GLM-ASR - 最强中文及方言语音识别利器 语音识别 语音转文字 支持50系显卡 一键整合包下载

127. AI智能分割一切音频,1分钟时长无缝分离,语音界瑞士军刀

128. Paper Daily!语音检索抗噪新标杆,SQuTR 37K口语查询终结“安静室”评估时代

129. 【解决方案】具身智能语音交互

130. 17.3K Star!微软开源VibeVoice,AI语音合成新突破,支持90分钟多人对话和实时流式TTS

131. 非接触式远场语音检测

132. 一个视频有2个人声怎么分离?分离重叠的人声,2026年首发教程

133. 音频有两种人声怎么分离?分离两个人声,这6个工具超干净

134. Fun-ASR - 多语言多方言的高精度语音识别软件 支持50系显卡 一键整合包下载

135. 微型麦克风阵列声源定位追踪模组

136. 行业实测语音识别技术发展98准确率效率提升300

137. 打破空间限制!DCA901数字阵列麦克风解锁多元场景音频体验

138. AI电脑麦克风功率链路优化:基于信号切换、供电管理与静电防护的MOSFET精准选型方案

139. 面向AI麦克风阵列的功率MOSFET选型分析——以高保真、低噪声电源与信号链管理系统为例

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章