谷歌嵌套学习:挑战AI“金鱼记忆”,开启终身学习新范式

源自29位全网作者

25-12-19

近年来,以大语言模型(LLM)为代表的深度学习技术取得了巨大成功,但一个根本性的挑战始终存在,那就是“灾难性遗忘”(Catastrophic Forgetting)。简单来说,当前的模型一旦完成预训练,其知识体系便很大程度上被固化。当尝试学习新知识时,它们往往会忘记旧的技能,这种现象被形象地比作“顺行性遗忘症”或“金鱼记忆”。为了适应新数据,企业通常需要进行成本高昂的重新训练或微调,这极大地限制了AI系统的持续进化能力。

针对这一难题,谷歌的研究人员提出了一个名为“嵌套学习”(Nested Learning, NL)的全新机器学习范式,试图从根本上重构我们对深度学习的理解。其核心观点颇具颠覆性:我们习以为常的、由一层层网络堆叠而成的深度学习架构,或许只是一种“幻象”。嵌套学习认为,一个复杂的AI模型,本质上并非一个单一、扁平的巨大函数,而应被看作是一系列相互嵌套、并行运行的优化问题集合,如同一个“俄罗斯套娃”系统。

谷歌嵌套学习:挑战AI“金鱼记忆”,开启终身学习新范式

这一思想深受人脑工作机制的启发。人类大脑通过不同区域的协同工作实现记忆的形成与巩固,例如海马体负责快速编码短期记忆,而大脑皮层则负责缓慢地固化长期知识。不同神经元和脑区的活动频率也各不相同,形成了多时间尺度的处理机制。嵌套学习正是借鉴了这一点,提出模型中的不同组件也应该以不同的频率进行更新。更新快的部分负责处理即时信息和短期记忆,而更新慢的部分则负责存储稳定、抽象的长期知识,中间还存在着各种速率的中期记忆层级。

基于此,嵌套学习提出了一个统一的视角,认为模型“架构”与“优化算法”这两个在传统观念中被割裂的概念,本质上是同一回事,只是在不同“层级”上运作的学习系统。该范式引入“关联记忆”(Associative Memory)作为统一的模块来解构模型。无论是Transformer中的注意力机制(学习如何将查询映射到相关信息),还是反向传播过程本身(学习如何将数据映射到其误差值),甚至是优化器(如Adam)中的动量项(学习如何压缩和记忆历史梯度信息),都可以被看作是学习“键-值”映射的记忆模块。

在这一统一框架下,研究人员设计了一系列具体的创新

首先是深度优化器(Deep Optimizer)。传统优化器被重构为简单的关联记忆模块,而嵌套学习则通过引入更复杂的目标函数(如用L2回归替代简单的点积相似度),或用小型神经网络来预测梯度走向,使其对不完美数据的容忍度更高,性能更鲁棒。

其次是连续记忆系统(Continuum Memory System, CMS)。它打破了传统模型中短期记忆(如序列层)与长期记忆(如前馈网络层)的二元划分,将其扩展为一个由不同更新频率模块组成的连续谱系,为实现更高效的长上下文处理和持续学习提供了基础。

谷歌嵌套学习:挑战AI“金鱼记忆”,开启终身学习新范式

为了验证这套理论,团队构建了一个名为HOPE(Self-Referential Learning Module with Continuum Memory)的新型序列模型架构。HOPE是一个可以自我修改的递归架构,它融合了连续记忆系统,能够实现多层级的上下文学习。一个有趣的特性是,HOPE甚至可以“更新自己的更新方式”,形成一个递归学习循环,使其在与环境的交互中不断进化。

实验结果显示,HOPE架构在语言建模、常识推理和长上下文处理等任务上表现出色。在部分基准测试中,尤其是在模型规模扩大后,其性能超越了如Transformer++、Titans等现有先进模型,展现了在管理长上下文记忆方面的卓越能力。

然而,嵌套学习这一新范式也引发了一些讨论和审视。有观点认为,该研究中的部分核心思想是对已有研究的重新包装和阐述,并且其实验设置主要集中在语言建模和推理任务上,可能未能充分验证其在解决“灾难性遗忘”这一持续学习核心问题上的有效性。此外,相关研究代码尚未开源,也为社区的进一步验证和发展带来了不确定性。

无论最终的争议如何,谷歌提出的嵌套学习范式为AI领域提供了一个极具启发性的新思路。它挑战了单纯依靠“堆叠层数”提升模型能力的传统思维,将“更新频率”作为一个新的设计维度引入架构设计中,优雅地统一了模型结构与优化算法。其长远意义可能不在于HOPE这一个具体模型,而在于它为解决灾难性遗忘、实现AI的终身学习和自我进化,提供了一个全新的、值得深入探索的理论框架。

内容由AI生成

精选参考来源

1. 如何评价谷歌发布的全新机器学习范式嵌套学习 (Nested Learning)?

如何评价谷歌发布的全新机器学习范式嵌套学习 (Nested Learning)? 谷歌的这个研究Nested Learning,要解决深的是度学习里的"灾难性遗忘"问题。这个问题对于微调来说是非常重要

2. 浅聊下Google最新成果「Nested Learning」

浅聊下Google最新成果「Nested Learning」 浅聊下Google Research近期一项最新成果「Nested Learning」:重构深度学习架构的理论范式 近年来,深度学习(

3. 谷歌新论文Attention is all you need二代

谷歌新论文Attention is all you need二代 Attention机制当年横空出世,直接颠覆了整个AI圈。 现在,谷歌又抛出一篇被称为“Attention is all you

4. 谷歌大脑新作!人工智能迎来第二春!嵌套学习彻底摆脱遗忘困境! 今天分享Google一篇超有用的论文《Nested Learning: The Illusion of Deep Learning Arc

大家好今天分享Google一篇超有用的论文NASA LearningThe Illusion of Deep Learning Architectures咱用大白话翻译一下就是嵌套学习深度学习架构的幻

5. 重大突破!谷歌攻克AI“健忘”!嵌套学习让机器像人类过目不忘

重大突破!谷歌攻克AI“健忘”!嵌套学习让机器像人类过目不忘重大突破!谷歌攻克AI“健忘”!嵌套学习让机器像人类过目不忘turgun20221762794654 概念模型HOPE性能碾压Trans

6. 如何评价谷歌发布的全新机器学习范式嵌套学习 (Nested Learning)?

如何评价谷歌发布的全新机器学习范式嵌套学习 (Nested Learning)? 鉴定为大部分是包装Kazuki Irie et al的各种idea这篇文章基本是就是用优化的视角来把fast weig

7. 谷歌提出嵌套学习:让AI学会像人脑一样进化

谷歌提出嵌套学习:让AI学会像人脑一样进化 持续学习一直是AI最难攻克的瓶颈之一。谷歌研究团队提出全新范式——Nested Learning(嵌套学习),以统一架构与优化过程为核心理念,让模型能像人脑

8. Google提出机器学习新范式Nested Learning,有望突破“持续学习”难题

Google提出机器学习新范式Nested Learning,有望突破“持续学习”难题 尽管以大语言模型(LLM)为代表的机器学习模型取得了巨大成功,但它们在持续学习(Continual Learni

9. 谷歌发布全新机器学习范式:嵌套学习 (Nested Learning)

谷歌发布全新机器学习范式:嵌套学习 (Nested Learning) 谷歌的研究人员推出了一个名为“嵌套学习”(Nested Learning, NL)的全新机器学习范式,旨在解决现代人工智能模型的

10. Jeff Dean盛赞姚班校友AI新研究,目前人已到Meta

Jeff Dean盛赞姚班校友AI新研究,目前人已到Meta 一种令人兴奋的全新的范式。谷歌AI掌舵人Jeff Dean点赞了一项新研究,还是出自清华姚班校友钟沛林团队之手。Nested Learni

11. 突破LLM遗忘瓶颈,谷歌「嵌套学习」让AI像人脑一样持续进化

突破LLM遗忘瓶颈,谷歌「嵌套学习」让AI像人脑一样持续进化 LLM在持续学习方面有了新突破。近日,谷歌推出了一种全新的用于持续学习的机器学习范式 —— 嵌套学习,模型不再采用静态的训练周期,而是以不

12. Jeff Dean盛赞姚班校友AI新研究,目前人已到Meta

Jeff Dean盛赞姚班校友AI新研究,目前人已到Meta Jeff Dean盛赞姚班校友AI新研究,目前人已到Meta量子位1763183455 闻乐 发自 凹非寺量子位 | 公众号 QbitAI

13. 如何评价谷歌发布的全新机器学习范式嵌套学习 (Nested Learning)?

如何评价谷歌发布的全新机器学习范式嵌套学习 (Nested Learning)? 导读:我们习以为常的「深度神经网络」,究竟是一层层堆叠的积木,还是一场数学上的「视觉错觉」?来自谷歌研究院(Goog

14. 谷歌又一项重大突破,发布机器学习新范式:Nested Learning嵌套学习 解决LLM在持续学习中的灾难性遗忘问...

谷歌又一项重大突破,发布机器学习新范式:Nested Learning嵌套学习 解决LLM在持续学习中的灾难性遗忘问... 谷歌又一项重大突破,发布机器学习新范式:Nested Learning嵌

15. 谷歌推出一种全新的机器学习范式 🚀

谷歌推出一种全新的机器学习范式 🚀 谷歌推出嵌套学习:一种全新的机器学习范式,它将模型视为嵌套优化问题,从而增强对长上下文的处理能力,实现持续学习。我们的概念验证模型 Hope 在语言建模方面展现出更

16. 嵌套学习:深度学习架构的全新范式🌟

嵌套学习:深度学习架构的全新范式🌟 Google Research 团队新作(NeurIPS 2025)!提出嵌套学习(NL)范式,打破传统深度学习局限~ 📌背景:现有 LLM 静态化、难持续学习,像

17. NestedLearning:深度学习架构的幻象

NestedLearning:深度学习架构的幻象 论文《Nested Learning: The Illusion of Deep Learning Architectures》提出了一种新的学习范式

18. Google最新AI论文深度解析:Nested Learning嵌套学习,革命性变革

Google最新AI论文深度解析:Nested Learning嵌套学习,革命性变革 Google最新AI论文深度解析:Nested Learning嵌套学习,革命性变革中国标准20089120041

19. Google提出“嵌套学习”,AI迎来新范式!

Google提出“嵌套学习”,AI迎来新范式! 今天分享一篇来自Google Research的超级硬核的论文,直接对我们熟悉的“深度学习”提出了一个颠覆性的诘问:我们过去几十年来堆叠网络层的方法,可

20. 你以为的深度学习架构,其实是一场"幻觉"!

你以为的深度学习架构,其实是一场"幻觉"! 今天给大家分享一个超级颠覆认知的AI前沿研究 🤯 来自 Google Research 的论文《嵌套学习》直接把深度学习的底层逻辑给掀翻了! 🔥 核心观

21. 下一个Transformer可能又被Google做出来了

下一个Transformer可能又被Google做出来了 下一个Transformer可能又被Google做出来了新浪财经1764990232 来源:市场资讯(来源:硅星人)作者 | 周一笑邮箱 |

22. 治好了失忆症,这次AI有了灵魂???

治好了失忆症,这次AI有了灵魂??? 前两天,Google发了一个非常有趣的论文,它直接冲着一个非常重要的缺陷,那就是现在的大模型会失忆,也叫顺行性遗忘症。这篇《Nested Learning》(嵌套

23. 漫谈持续学习(Continual Learning)

漫谈持续学习(Continual Learning) [学生党R] 最近读了一下 Google新出的论文:Nested Learning [举手R] 大致的背景是现在的LLM虽然强大,但是有个明显

24. 谷歌又一个Transformer级别的研究?AI学习就像做梦一样层层嵌套

谷歌又一个Transformer级别的研究?AI学习就像做梦一样层层嵌套 谷歌又一个Transformer级别的研究?AI学习就像做梦一样层层嵌套至顶AI实验室1764145156 谷歌最近集中发布了

25. 颠覆AI底层逻辑!Google放出大招:让大模型像人一样“边活边学”

颠覆AI底层逻辑!Google放出大招:让大模型像人一样“边活边学” 颠覆AI底层逻辑!Google放出大招:让大模型像人一样“边活边学”势鉴老周1765445417 前言长久以来,大模型虽能对答如流

26. 谷歌的下一个Transformer?大模型永久记忆难题的破解尝试

谷歌的下一个Transformer?大模型永久记忆难题的破解尝试 谷歌的下一个Transformer?大模型永久记忆难题的破解尝试人工智能学家1765015501 当ChatGPT在对话窗口关闭后立即

27. 借鉴人脑「海马体-皮层」机制,红熊AI重做了一个「记忆系统」

借鉴人脑「海马体-皮层」机制,红熊AI重做了一个「记忆系统」 借鉴人脑「海马体-皮层」机制,红熊AI重做了一个「记忆系统」机器之心Pro1764734955 机器之心报道编辑:Youli记忆,或是 A

28. 终结Transformer统治!清华姚班校友出手,剑指AI「灾难性遗忘」

终结Transformer统治!清华姚班校友出手,剑指AI「灾难性遗忘」 终结Transformer统治!清华姚班校友出手,剑指AI「灾难性遗忘」新智元1762610992 编辑:元宇【新智元导读】大

29. AI跟大雄一样健忘?哆啦A梦6图讲透硬核论文

AI跟大雄一样健忘?哆啦A梦6图讲透硬核论文 为什么你教给AI的新知识,它转头就忘?🤖💦 难道最先进的大模型,竟然和野比大雄一样是“学渣”体质? 这其实是现有深度学习架构的通病——类似于人类的“顺
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章