深度学习常被包裹在复杂和神秘的光环中,但它的数学根基是什么?是全新的理论革命,还是现有学科的巧妙应用?这篇探讨从历史视角切入,揭示了深度学习与数学之间一种更务实、更具争议性的关系,为理解当前AI热潮提供了新的思考维度。
智能速览
深度学习的兴起被视为一种从精致数学模型到“粗暴”但有效的统计方法的范式转移。
当前AI领域招聘更侧重于对成熟算法的记忆与应用,而非理论创新。
其核心数学工具主要是概率论、线性代数和图论,而非深奥的数学理论。
一个核心观点是:深度学习本质上是统计学在计算机上的大规模实践。
未来AI的理论突破,可能需要等待量子计算等新计算范式的成熟。
精华内容
从曾被算法博士调侃的“粗暴”架构,到如今AI招聘侧重算法记忆,深度学习与数学的真实关系究竟该如何界定?它究竟在多大程度上脱离了传统数学理论的束缚?
算法的“粗暴”革命
回顾十年前CNN等深度神经网络问世之初,它在许多资深算法研究者眼中显得异常“粗暴”。过去,OCR文字识别等项目依赖博士们精心设计的模式识别算法,工程师负责细枝末节的优化,流程缓慢但可控。深度学习的出现颠覆了这一切,模型本身显得粗暴,项目节奏也随之加快。研究者们常常面对模型无法解释的行为,最终只能回归到“再去读读论文”的循环,这标志着一种新的、更依赖实验而非理论推导的工程范式开始占据主导。
数学工具而非理论
深度学习是否脱离了数学?答案是否定的,但它与数学的关系更像是工具使用者而非理论创造者。其依赖的数学知识主要集中在概率论、线性代数以及近年热门的图论。概率论用于处理结果的不确定性,线性代数则将数据转化为模型可处理的向量形式。这就好比去菜市场买菜依赖九九乘法表,它确实是数学,但与数学家研究的数论深度不可同日而语。当前的AI人才招聘也反映了这一点,考核重点在于对现有算法的记忆和实现,而非颠覆性的数学创新。
统计学的计算机实践
归根结底,当前的深度学习可以被理解为统计学的计算机大规模实践。它的核心思想是用精确的数学工具去丈量和拟合充满不确定性的现实世界。统计学的突破恰恰在于为“用精确处理模糊”提供了理论框架。相比之下,曾经的模糊数学等理论显得过于肤浅。深度学习的成功,是统计学思想在算力支撑下的胜利。然而,这种基于统计逼近的方法可能已接近其理论天花板。未来的根本性突破,或许要等待量子计算等全新的计算范式成熟,才可能带来理论上的革新。
深度学习的本质,并非脱离数学,而是将数学工具的应用推向了极致,它在很大程度上是统计学思想与强大算力的结合体。理解这一点,有助于我们更清醒地看待当前AI的成就与局限。当下一次计算革命来临时,AI的理论基础又将迎来怎样的重构?
关键评论
有评论指出,深度学习时代,传统算法大佬被薪资更高的本科生替代去做数据标注,效果显著,反映了行业重心的转移。
另一观点认为,现实并非模糊,而是过于复杂,模型只是用模糊的方式去近似拟合这种复杂性。
还有评论补充,深度学习作为复杂动力系统,其背后有相应的数学描述,只是当前多数从业者不甚了解。
技术评论提及,其数学核心是高等统计学的渐近理论和参数估计,比基础的概率和线性代数更深层。