从随身听到AI智能体:耳机这20年,到底经历了什么?
在上周落幕的WAIC展会,是我近两年参加的同类展会中,感受变化最明显的一个展会。

过去的几届WAIC主要的话题都是AI,只要聊到AI基本上就能听到参数规模、推理速度、算力竞争这些话术。
所有人的注意力和好奇心都聚焦在一个问题上,那就是大模型还能做什么?
但今年我在现场转了几天,我发现整个风向都已经变了,虽然大家依旧在不断的推进大模型,
但还有一个声音同时出现在展会上,那就是AI要如何真正走进普通人的生活。
而我觉得要拆解这个问题,其实分两步走。
首先第一条路就是让AI去执行任务代替我们去做事情,而代表的产品就是智能汽车、智能家居,这些本质上都是AI数字世界走向物理世界,所以我把它理解为是AI的出口。


第二条路是让用户更自然的能够调用AI,我把它称为AI入口,而代表的就是AI手机、AI眼镜、AI耳机。


而AI入口这条路径需要走通就必须要解决一个问题:AI需要一个离用户足够近的设备。
如果AI真的需要长期陪伴用户的入口,你觉得什么设备才是最合适的呢?
手机离用户足够的近,并且已经是最重要的AI入口,但它依然需要依赖屏幕交互、用户还是需要频繁的主动拿起、点亮和操作才能触发一次交互。
眼镜离感官更近,但摄像头的存在意味着更高的社会接受门槛、续航和佩戴负担现阶段国内还没跨过量产的坎。
相较之下,耳机几乎是这几年唯一一个已经被大众大规模验证过“可以随身携带一整天,不需要被特意拿出来”的设备,
所以我的答案是耳机。
而且这个答案并不是在今年AI火爆的时候才冒出来的。

过去的很多年,我体验过不少的耳机产品,也采访过不少工程师。
今天我想把这些年积累下来的观察和这放在一起,聊聊耳机这门生意,接下来可能会往哪儿走。
耳机早已不是一个“听音乐”的设备
过去我总跟别人吹牛说耳机品类的进化史,其实就是人与世界关系的进化史。

现在想想,这牛还被我蒙对了。
最早的耳机,就是为了解决个人音乐独享的问题,将剧院里的音效变成个人空间里独享的音乐。

最具有代表性的就是Walkman时代,索尼靠一台随身听重新定义了“听音乐”这件事。

智能手机时代,耳机的角色同样发生了变化,并不只是单纯的播放音乐的工具,
而是成为手机移动数字娱乐的延伸,音乐、视频、通话、游戏,
耳机从一个声音输出设备变成了移动数字娱乐的重要组成部分。
接着是真无线时代,AirPods改变了整个行业,然而我始终认为AirPods改变的并非是“真无线“这种形态,而是让用户开始养成耳机不离身的习惯,
随身携带、随时使用,像个”手把件“一样,天天伴随我们左右。

2022年我在体验LinkBuds的时候提过一个思路:
耳机已经不应该只用”音乐耳机“这个身份来定义它了。耳机正在成为连接独立空间和现实世界的一座桥梁。
现在回过头来看,依然是我理解整个耳机行业的一个基本出发点。
开放式与降噪:两种完全不同的哲学
聊到这里,就不得不说我和开放式聆听的代表厂牌韶音的一段渊源了。
2012年我第一次接触的骨传导耳机,就是韶音的SPORTX M1,
2020年是我第一次参观韶音的公司,回程的路上我一直在思考一个问题:
骨传导耳机未来的路要怎么走?

坦白讲,骨传导很难在音质这件事情上挑战传统HiFi耳机,只是单纯拼声音素质,骨传导耳机没有任何优势。
在被不断延误的机场候机楼,我突然意识到开放式耳机真正的价值从来不是音质,而是佩戴方式。

传统耳机的目标是让声音进入耳朵、把用户和外部世界隔绝开来;
开放式耳机的目的恰好相反,是让用户在听声音的同时依然保持和现实世界的连接。
甚至我认为传统耳机和开放式耳机代表着两种完全不同的哲学概念。
主动降噪耳机讲究沉浸感、隔绝噪音、私人空间,让你进入自己的世界;
开放式耳机强调连接、感知、与现实世界共存,让你保持在现实世界里。
这两种哲学概念本质上是解决的问题不同,这也是我这几年一直觉得开放式耳机和主动降噪耳机会长期共存的原因。

开放式耳机满足的是降噪耳机满足不了的那部分需求。
为什么AI可能成为开放式耳机的新机会
如果我们把现在AI的技术放进这条耳机的时间线里一起看,就会发现一件挺有趣的事情。
智能耳机这个概念其实我们很多年前就听到过。

比如拥有自己OS系统的Bragi Dash、尝试开放式交互的索尼的Xperia Ear Duo还有探索睡眠场景的Bose Sleepbuds,以及最终流产的BOSE AR。
这几款产品我都印象深刻,当年也体验过部分功能,但最后这些智能化的技术都没有延续下来。
我一直认为他们失败的原因并非是硬件或者技术不成熟,而是缺了一样很重要的东西—AI能力。
只能说这些产品生不逢时,在AI真正成熟之前,耳机能听见、能连接、能被控制,但它无法理解。
你跟它说话,他顶多是“执行终端”的“传话筒”,甚至连真正的对话都谈不上。
AI出现之后,耳机第一次有了理解能力,这才是这轮智能耳机浪潮和上一轮最本质的区别。

那应该如何来定义AI耳机和智能耳机之间的区别呢?需要满足什么条件?我自己总结下来大概是四点:

首先必须要实现长期佩戴,因为AI真正产生价值,需要持续理解用户所处的环境、需求和上下文,
一天只戴半小时的设备,很难成为AI入口;
其次是拥有持续感知能力,AI需要声音输入、环境信息、上下文、这些都得靠持续在线得耳机来采集;
第三是直觉式交互方式,不需要像手机需要拿出来、点亮、打开app,AI入口的理想状态应该是以自然的方式,一句话、一个动作就能完成交互;
第四是自然反馈,AI不该只是被动的回答问题,在检测环境和对话时应该主动提醒、主动介入。
这四点其实不只是AI耳机的“护城河”,智能戒指、AI眼镜同样可以参考。
真正决定耳机能不能成为AI入口的关键,我认为是耳机的物理形态,尤其是开放式耳挂耳机这个分支。
为什么耳挂式可能成为关键形态
前面提到过,开放式耳机和降噪耳机走的是两种哲学思路:一个要保持连接、一个要隔绝噪音。

要满足AI入口持续感知和长期佩戴的需求,显然连接比隔绝更贴近,这种结构上的先天优势也是让开放式耳机可能成为更适合AI时代的一种形态。

在具体一点来说,开放式耳机中的耳挂式耳机,较大的腔体给了硬件充足的物理空间,未来可以容纳更多的麦克风、传感器和连接能力,提供更多硬件扩展的可能性。
其次长期佩戴不会带来耳道闷胀、潮湿这类传统耳机常见的负担,耳挂式耳机能满足运动、通勤等高频场景使用,长时间佩戴也不会觉得难受。

有人肯定要问了,如果真的AI耳机出现了,传统TWS耳机会不会被取代呢?
我的判断是不会,原因是整个“蛋糕”变得更大了,用户的需求更多元化了,喜欢音乐、喜欢降噪、喜欢沉浸感的用户依旧可以选择TWS,这也是开放式耳机短期内很难替代的特性。
当然开放式耳机也会承担另一类需求,比如陪伴、感知、交互。
未来AI耳机和TWS耳机甚至都不是一个赛道的,何来代替之说。
中国厂商正在重新定位
在这轮变化里,我觉得除了产品还有一点变化也是非常重要的,就是玩家的结构也在发生变化。
韶音、科大讯飞、字节跳动,甚至还有一大批我过去没怎么归类的AI硬件厂商,都在往这个方向靠。

韶音中国区CEO杨云此前也提到过,开放式耳机依然是韶音接下来最主要的战场,而在智能眼镜这类新业务上,如何把自己在音频领域多年积累的技术优势发挥出来,才是他们要额外花心思的方向。

科大讯飞这家靠语音AI起家的公司,翻译机这类硬件也做了不少年了,在不同的品类上都做过尝试,现在往耳机这类可穿戴设备延伸,从场景逻辑上反而比很多传统耳机厂商显得更顺其自然。
因为科大讯飞从来不缺AI能力,只是一直在探索如何离用户更近。

所以耳机这门生意正在发生变化,过去这是传统耳机公司之间得竞争,
现在AI公司也开始进场,这也恰恰证明了,耳机正在从一个纯粹得声学产品,变成一个新的入口,值得AI公司专门为它下场竞争。
未来耳机到底是什么样?
我一直在遐想未来耳机的形态。
可能是一台翻译设备,双向音频输入输出,这个组合是眼镜和手表都给不了的直觉式体验方式;
可能是一个个人助理,负责提醒我、帮我总结会议、满足我的好奇心,因为离耳朵足够近,它可以直接和你对话,不需要你再低头看一块屏幕;
可能是一台环境感知设备,靠耳机内置的麦克风阵列,去理解周围正在发生什么;
也可能是一台健康设备,骨传导或气传导耳机贴合耳周骨骼和血管的位置,天然适合采集心率这类生理信号,这种贴合度反而是很多手环、手表做不到的。

过去的很长一段时间,耳机帮助我们听见声音。
未来,耳机可能会帮助我们理解世界。
而当耳机开始理解世界,我们和现实的关系,会不会也被重新定义?
几年前,我在参观完韶音之后的飞机上,一直在想开放式耳机的未来到底应该走向哪里。
后来在体验索尼LinkBuds的时候,我又一次看到耳机开始尝试重新定义人与现实世界的关系。

而今天AI的发展,让我当年那些没有想明白的问题,终于有了一个更清晰的方向。
AI正在推动整个行业重新回答一个问题:耳机除了播放音乐,还能为人提供什么价值?
如果要用一句话来总结我对这件事的理解:AI从来不是耳机行业的终点,更像是耳机走向感知入口的催化剂。
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
