「注意力的进化」系列 · 板块二 · 第3篇
AI 学会了主动遗忘。人类反而把记忆外包了出去。
开篇:上一次你真正”记住”了什么?
不是”收藏了”,不是”截图了”,不是”搜到了”——
而是深刻地记住,成为思维的一部分,需要时自然浮现。
是不是想不起来?you are not alone.
我们活在一个记忆外包最彻底的时代:任何信息都能搜索,任何对话都有记录,任何灵感都发备忘录,任何重要的事都设日历提醒。
手机里的记忆越来越满,但大脑里的记忆,却越来越空。一、AI 的记忆进化回顾:从”全记”到”选择性遗忘”1.1 Transformer 的负担:什么都记得
标准 Transformer 有一个特点——它对每个新词,都要回溯所有旧词,重新计算一遍关系。文本有 N 个词,计算量就是 N²。代价是惊人的算力和内存。1.2 RNN 的困境:被动遗忘
Transformer 之前的 RNN,记忆方式更像人——维护一个隐藏状态,新信息进,旧信息出。越久远的信息,信号越弱。不是模型决定忘掉,而是结构性无法保留。就像你努力回忆三年前某次会议的细节——不是你不重视,是信号已经消失了。1.3 Mamba 的突破:主动决定该记住什么
2023 年,Mamba 模型发布,带来了根本性改变:
Mamba 为每一段输入动态生成控制参数,主动判断:
这段信息值得保留多少?
旧状态该丢掉多少?
新信息如何融合?
这是一种元认知能力——不只是”记住了什么”,而是”主动判断什么值得记住”。
计算量?O(N),线性增长,不管多长都不怕。
这不是技术细节,是思维方式的转变:**从”尽量全记”到”有策略地管理记忆”。**二、人类的记忆正在经历什么
AI 花了近三十年,从全记忆负担走向主动管理。
人类呢?正在走相反的路。2.1 谷歌效应:大脑主动放弃编码
2011 年,心理学家 Betsy Sparrow 发现了一个令人不安的现象:
当人们知道信息可以随时搜索时,大脑对它的记忆编码会主动减弱。
这被称为谷歌效应(Google Effect)。
不是”懒得记”,而是大脑的适应性策略——记忆资源有限,如果某样东西随时可获取,就降低它的存储优先级。
智能手机让几乎所有信息都变成了”随时可获取”。于是大脑越来越不擅长主动编码。2.2 外包记忆的真实代价
“信息都能查到”表面上解放了我们。但问题在于:省下的认知资源没有用在更重要的地方,而是继续刷手机。
三个深层代价:
① 知识连接能力退化
有创造力的思维,不是”查到正确答案”,而是把不同领域的知识在大脑里连接起来,产生新洞见。这种连接的前提是:两端的知识都在你的脑子里。
你无法把没存进大脑的信息”连接”起来。
② 工作记忆更拥挤了
工作记忆容量极其有限——大约 4±1 个信息块。当你从手机里”调取”信息时,需要打开、寻找、读取、加载进工作记忆——这个过程比从长期记忆直接调用更慢,还要切换注意力,还要冒被其他推送打断的风险。
③ 情景记忆在消退
有一个反直觉的发现:当我们拼命拍照记录重要体验时,对这次体验的情景记忆反而更弱。心理学家称之为”照片失忆效应”。
相机承担了”记住”的工作,大脑就放松了编码。我们以为自己记录了更多,实际记住了更少。三、镜子:两种记忆策略的对比
AI(Mamba)
人类(当代)问题
信息过载,全记代价太高
信息过载,记忆系统超负荷策略
主动筛选:动态决定记什么
被动外包:委托给设备机制
学习”什么值得记”的判断力
依赖搜索引擎随时补充代价
需要大量训练
大脑主动编码能力退化结果
用极少状态保留关键信息
记录了很多,记住的很少
AI 选择了主动筛选。人类选择了被动外包——连”判断值不值得记”这件事,也外包了出去。四、记忆,是思维的土壤
记忆是思维的土壤。知识是种子。洞见是长出来的东西。土壤太薄,种子落下来也扎不了根。
外包给手机的记忆,是存在别处的仓库。你可以随时查,但种子不会自己发芽——除非你把它种进脑子里。
这就是为什么:
读了很多文章,却感觉没什么积累。
收藏了很多内容,需要时从不会想起来。
知道很多信息,真正思考时脑中一片空白。
记忆外包制造了一种认知幻觉:感觉自己懂很多,实际能调动的少得可怜。五、记忆是可以被主动管理的
就像 Mamba 用选择性状态空间重新掌控记忆,人类也可以重建主动编码的能力。
不是放弃手机,而是**学会判断什么值得进入大脑,并为此花一点力气。**5.1 用自己的话重述
让信息从短期记忆进入长期记忆,最有效的方式不是反复看,而是主动提取。
认知科学家称之为精化编码:
读完一篇文章,合上,写三句话:它说了什么?最有价值的是什么?让我想起了什么?
听完一个播客,问自己:我会怎么向朋友讲这件事?
学了一个新概念,造一个类比:这让我想起了什么?
这个过程会让你感觉更费力——这正是学习在发生的信号。认知科学里有个概念叫”理想的困难”:越费力的提取,记忆巩固越深。5.2 间隔重复
艾宾浩斯在 19 世纪发现了遗忘曲线:信息不在 20 分钟内遗忘 40%,一天后遗忘 70%,一个月后遗忘 90%。
对抗方法很简单——在遗忘发生之前,用最小代价复习一次。间隔越来越长:1 天 → 3 天 → 7 天 → 14 天 → 1 个月……
但前提是:你需要先决定什么值得记。 这恰恰是 Mamba 给我们的启发——不是什么都记,而是筛选。5.3 减少记录,增加消化
最反直觉的一条:不要记太多。
每次阅读、每次会议,你是不是在拼命记录,结果什么都”记了下来”,什么都没真正消化?
试试:
只记三条。不是最重要的三条,而是让你自己最感兴趣的三条。
兴趣是记忆的最强助推剂。你真正想理解的东西,大脑会自动编码得更深。六、信息时代的记忆重建
AI 从 Transformer 的全量记忆进化到 Mamba 的主动筛选,靠的是一次工程架构革命。
你的记忆重建不需要革命,只需要一点刻意练习:
读完即复述(主动提取)
学完就连接(精化编码)
不截图,先试着想(延迟外包)
定期复习真正重要的(间隔重复)
Mamba 的核心逻辑:**不是记得越多越好,而是记得越准确越好。**七、尾声
Mamba 的设计者在 2023 年论文里写道:
“我们设计了一种机制,让模型能够根据内容选择性地传播或遗忘信息。”
这句话放在人类身上同样成立。
问题不是”记不住”。问题是:你花时间判断过什么值得记住吗?
在刷到下一条短视频之前,能不能先停一下,问自己:
今天读到的东西里,有没有一件事值得我真正记住?
遗忘不是失败。遗忘是大脑在告诉你:这件事还没得到足够的关注。
遗忘的对立面不是记录,是理解。下一篇
《AI 的”读书方法”:从 KV Cache 到你的第二大脑》
AI 推理时会把已理解的内容存入 KV Cache,不需要每次重新处理。这是一种分层管理”已知”和”未知”的认知架构。
而人类如何构建自己的”第二大脑”?下一篇,我们来聊 AI 和人类在知识组织上的平行进化。
参考资料:
Gu, A. & Dao, T., “Mamba: Linear-Time Sequence Modeling with Selective State Spaces,” 2023
Sparrow, B. et al., “Google Effects on Memory,” Science, 2011
Ebbinghaus, H., “Über das Gedächtnis,” 1885
Henkel, L.A., “Point-and-Shoot Memories,” Psychological Science, 2014
Baddeley, A., “Working Memory,” 1974
字数统计:约 2600 字
🧭 认知导航
你刚刚读的是注意力的进化第3篇。AI 记忆在进化,人类记忆在退化。但这不是悲观的理由——意识到这个问题,就已经开始解决了。