为什么耳机越“准确”,反而越容易被说成“白开水”?
如果一副耳机真的更准,味道为什么不该更多由音乐决定?
先听一副低频很厚、高频很亮、人声靠前的耳机。听半小时,再换上一副更克制、更平衡的。
诶?怎么没劲了?
如果后一副耳机真的更准确,为什么“准确”会听起来像一种
寡淡?
“白开水”真的是准确的声音吗?
如果一副耳机的目标,是尽量少替录音加自己的味道。那十张唱片放进去,结果应该是什么?
录得肥的,低频就该肥。人声本来贴脸的,就该贴脸。高频本来刺激的,也不该被耳机自动磨平。

动态压得很死的录音,听起来就应该有那种被挤住的感觉。反过来,一张录得宽松、自然、层次漂亮的唱片,也应该明显舒服得多。
耳机自己的性格越弱,录音之间的差异反而应该越明显。
准确的结果,就是应该让不同音乐越来越不像。
可问题是,刚才那句“没劲”,明明是真的。
为什么?
水未必淡,上一杯可能是可乐
人的听觉判断很少发生在真空里。如果长期习惯了一副低频更多、高频更亮、人声更近的耳机,这些强化很快会变成新的参照。换到一副更克制的耳机,往往感受到的是这些刺激突然减少了:
低频怎么少了?高频怎么暗了?人声怎么退了?
少了刺激,就寡淡了。

就,“白开水”了。
水未必淡,上一杯可能是可乐。
以及,一个容易忽略的变量:音量。
两副耳机只要其中一副稍微更响一点,人就更容易觉得它低频更饱满、高频更清楚、动态更大,甚至“细节更多”。有时候以为在比较音色,但已经把响度的差异一起听了进去。

以及,更玄学的:为什么这么容易把“感觉更明显”,理解成“能力更强”?
为什么强烈总那么像高级?
高频再多一点,很容易被说成解析高。低频再多一点,很容易被说成氛围好。人声推近一点,也很容易被听成结像更清晰。
换成汽车,大差不差。
方向盘更沉一点,很容易被理解成高速更稳。悬架更硬一点,很容易被理解成操控更强。路感更多一点,也很容易被叫作转向更高级。

感觉本身都是真的:沉就是沉,硬就是硬。但,常常被偷偷完成了一次替换:把最容易感知的特征,拿去代替真正想评价的能力。
强烈只说明感觉强,并不能单独证明能力更强。
高频亮,是一个特征。解析力真正想描述的,是不同信息能不能被分辨出来。
方向盘沉,也是一个特征。高速稳定真正涉及的,却是车辆受到扰动之后的响应、横摆、车身运动和转向建立是不是自然、可预测。
其实没有绝对的等比关系。
那么,问题继续既然没味道不等于准,感觉强也不等于准,那什么才叫“准”?
真正的“准”,可能是一种关系
这里的准,可能已经脱离的传统监听的定义。是机器测量值与人体体感之间的准。

耳机,发声单元几乎贴着耳朵工作。声音真正到达耳膜之前,还会经过头部、耳廓、耳道。不同频率会被这些结构以不同方式改变,不同人的耳朵也并不完全一样。
这也是为什么耳机领域会讨论目标响应。“机器测得水平”不能直接等同于“人听起来中性”。
人耳本来就和测量麦克风有完全不同的感知路径。:
准确更像一种关系:
输入经过系统,再进入人的感知以后,重要的信息还能不能被可靠地保留下来。
和车子上也很像。
好的转向,也不会把所有东西都塞进方向盘。它不可能把轮胎受到的所有高频抖动、摩擦和冲击原封不动塞回方向盘,那既不现实,也未必有价值。
一套好的转向当然需要调校。轮胎和路面正在发生什么。悬架、转向、车身会对这些输入进行加工。驾驶员最后通过方向盘、车身运动、视觉和身体形成判断。

需要“准”的是:车辆希望表达什么状态,系统最后交给人的感觉,能不能稳定、连续、可预测地对应那个状态。
工程真正困难的地方,在于系统必须主动处理输入,同时控制自己的存在感:
该留下的信息要留下,该过滤的东西要过滤,系统自己的调味不能盖过真正需要被理解的内容。
真正高级的能力,反而经常没有那么抢眼。
高级的准确,不替内容抢戏
再回头看开头那杯“白开水”。如果一副耳机所谓的准确,只是让所有音乐都变得淡、薄、克制,它依然在表达自己。音乐肥,就让肥被听见;音乐亮,就让亮被听见;录音糟糕,也没义务替它遮丑。

真正漂亮的录音出现时,耳机自己的存在感反而慢慢退下去。车子,是车在发生什么,驾驶员很自然地就知道了。
高级的准确,可以有性格,但不会替内容抢戏。
作者提示含AI生成内容。作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
