《Make It Stick / 认知天性》深度解析:让知识真正留下来

《Make It Stick》由 Peter C. Brown、Henry L. Roediger III 和 Mark A. McDaniel 合著,英文版于 2014 年出版。它没有兜售某一种神奇技巧,而是把几十年来认知心理学关于记忆、遗忘、练习、测试和迁移的研究,整理成普通学习者可以执行的方法体系。

这本书关心的不是怎样在当下获得轻松、流畅的学习体验,而是怎样让知识在几年以后仍能被提取和使用。沿着这个问题读下去,许多习以为常的学习方式都需要重新审视。

一、学习时的感觉,不等于学习的效果

理解全书的钥匙,是区分学习时的主观感受与学习后的真实结果。看懂一段文字、觉得单词眼熟、听懂老师的讲解,或者连续做同一类题越来越顺,都可能带来强烈的掌握感,却不能证明知识已经进入长期记忆。

熟悉感(familiarity)、流畅感(fluency)和独立提取、运用知识,是三件不同的事。

连续看十遍 abandon = 放弃,最后一次几乎不费力,完成的主要是识别。第二天只看到 abandon,需要自己说出含义时,任务才变成提取。考试、写作和真实工作更依赖后者。

核心标准:判断是否学会,不看此刻感觉懂不懂,而看以后没有提示时,能否把知识重新拿出来。

二、反复阅读为什么诱人,却经常效率不高

反复阅读很容易制造进步感。第一遍觉得难,第二遍开始理解,第三遍变得熟悉,第四遍便会误以为已经掌握。实际变化有时只是材料越来越眼熟,并非知识已经达到可以独立调用的状态。

划线、高亮和重读并非毫无作用。第一次接触材料当然需要输入,问题在于阅读无法独自承担整个学习过程。只有输入,没有提取和反馈,往往只能积累大量曾经看懂过的内容。

更完整的学习结构应当是:

输入 → 尝试提取 → 暴露错误 → 针对性再学习 → 拉开间隔 → 再次提取

低效结构则常常是:

输入 → 输入 → 输入 → 输入 → 考试

三、第一大核心:Retrieval Practice——提取练习

如果只保留一种方法,主动回忆最值得留下。Retrieval practice 不是再看一次答案,而是暂时藏起答案,要求大脑自己重新生成知识。测试在这里不只是测量记忆,也参与塑造记忆,这就是测试效应。

提取练习不必等到正式考试。它可以很简单:

  • 读完一页书后合上书,写出最重要的三个观点。
  • 学完一个概念后,不看资料,用自己的话解释一遍。
  • 学习历史时,独立说明一场事件发生的原因和后果。
  • 学习心理学时,辨别操作性条件作用与经典条件作用。
  • 背英语单词时,看到 inevitable 后先回忆含义,再尝试造句。

每一次费力的回忆,都在训练未来找到这条知识的路径。

四、知识不只通过输入获得,也通过提取变牢

常见的学习直觉是先把内容完全记住,再开始测试。学习科学给出的顺序不同:测试本身就在帮助记忆,因此不必等到完全会了才回忆,在还不熟练时开始提取更有价值。

两个人学习同一篇文章,一个连续读四遍,另一个读完后合上材料、回忆、检查,再回忆。前者通常感觉更顺,后者却会频繁遇到想不起来和回答不完整。这些不舒服的时刻恰好暴露了记忆的薄弱处。几天后再测,经过主动提取的人往往保留得更好。

训练时舒服,并不等于长期效果更好;训练时不断发现缺口,也不等于学得差。

五、有益的困难:Performance 不等于 Learning

想不起来通常被当作学习失败,但适度困难可能正是学习发生的地方。间隔后复习、遮住答案回忆、混合题型、先尝试再检查,都会降低当下的流畅度,却可能改善长期保持,这类现象常被称为 Desirable Difficulties,也就是有益的困难。

需要区分两个概念:

  • Performance:此刻完成任务的表现。
  • Learning:知识经过时间后还剩多少,换到新环境后还能否使用。

连续做 20 道相同的一元二次方程,最后几道几乎可以立刻完成,只说明当前表现很好。一个月后把它混入 30 种题型中,如果连该用什么方法都判断不出,长期学习就没有当初感觉的那么牢固。

六、第二个核心:Spacing——间隔学习

同样是十小时学习,把时间分散到多个日期,通常比一天内集中完成更利于长期保持。间隔带来的关键变化正是遗忘。

刚学完 A → B 就立刻重复,答案还停留在工作记忆里,大脑几乎不需要寻找。隔一段时间再看到 A → ?,需要搜索、重构和尝试,成功想起 B 的过程会比无脑重复更有训练价值。

复习时机:不是趁答案还清清楚楚时机械重复,也不是等到彻底忘光,而是在回忆开始有些费力、仍有较高成功概率时再次提取。

不存在适用于所有人和所有内容的绝对时间表。一天、三天、七天、十四天、三十天可以作为起点,但真正应观察的是提取难度、正确率和希望保持的时间长度。

七、临时抱佛脚的危险,在于短期效果太好

突击学习并非完全无效。今晚集中学习六小时,明天考试,短期成绩可能不错。危险之处在于这种结果容易让人相信集中学习最有效,而实际测量的只是 24 小时后的表现。

如果考试结束后便不再使用这部分知识,集中训练有时具有现实意义。但托福词汇、后续课程需要的数学基础、研究生阶段要用的专业知识和职业技能,都应优化几个月甚至几年后的可用程度。

真正需要比较的不是今天学得有多快,而是一年以后还有多少知识可以调用。

八、第三个核心:Interleaving——交错练习

假设需要学习 A、B、C 三类数学题。集中分块练习会先连续做 A,再连续做 B,最后做 C;交错练习则把 A、B、C 穿插出现。

交错练习的价值,在于它要求学习者先判断问题属于哪一种类型,再选择方法。教材按章节安排 20 道勾股定理题时,章节标题已经悄悄提供了提示,学习者只需执行算法。真实考试不会说明该使用哪条公式,工作中的问题更不会自动标注类别。

完整的问题解决能力包含两层:

  • 识别问题:看出它属于什么结构。
  • 选择并执行方法:调用合适的知识完成任务。

集中分块练习经常只训练第二层,交错练习则同时训练分类、辨别和策略选择。

九、从学生到专家,差别常在于先识别问题

初学者看到题目时往往先问怎么算,专家更早判断这是什么类型的问题。医生面对病人时,不会得到一张写着疾病名称的提示卡;研究者面对复杂现象,也需要判断哪种理论能够解释。

交错练习并不是把所有内容随机打乱。英语、微积分、游泳和中国历史之间频繁切换,未必有特殊价值。它更适合混合相近、容易混淆、需要比较的类别,例如经典条件作用、操作性条件作用与观察学习,或者三角形面积、勾股定理与余弦定理。

交错的目的不是制造混乱,而是练习何时使用哪一个概念。

十、第四个核心:Generation——先尝试,再学习

Generation 指先生成一个答案,再接触正式解释。学习 hindsight bias 时,与其一开始就看定义,不如先根据生活现象猜测它可能描述什么心理偏差,然后再核对。

先尝试会启动已有知识、形成预测并暴露缺口。后续信息不再是孤立输入,而是在修正刚才的推断。学习因此从被动接收信息,转成主动解决问题。

执行起来很简单:先做、先猜、先解释,再检查答案。

十一、有益困难不等于错误越多越好

困难必须能够促进正确学习才有价值。让没有基础的初学者独立推导量子力学,或者让提取难到每一次都只能回答不知道,并不会自动改善记忆。

理想状态是答案暂时不在眼前,需要十几秒认真搜索,最后能够想起或接近正确答案。这样的挣扎能强化提取路径。若长期完全无法作答,就应降低难度、补充线索、重新理解材料,再逐步撤掉提示。

十二、第五个核心:Elaboration——让新知识连接旧知识

记忆更像网络,而不是分门别类的仓库。一个概念与既有知识、因果关系、具体例子和相似概念建立的连接越多,未来能找到它的路径通常也越多。

学习间隔效应时,不要只记住 spacing effect 这个名称,可以继续追问:

  • 为什么间隔通常有帮助?因为它允许一定程度的遗忘发生。
  • 为什么遗忘有时反而有帮助?因为再次学习时需要重新提取。
  • 为什么重新提取有价值?因为成功提取本身就是一次学习事件。

于是 spacing、forgetting、effortful retrieval 与 memory strengthening 形成了因果结构,不再是一句孤立口号。

十三、自我解释比看懂答案更重要

如果不能用自己的语言解释一个概念,通常还没有真正理解。看到 classical conditioning 时觉得熟悉,不代表能用小学生也能听懂的例子讲清楚。

学完一个概念后,可以固定回答三个问题:

  • 它是什么?训练定义和核心特征。
  • 为什么会这样?训练因果结构。
  • 它和相似概念有什么区别?训练辨别能力。

这三类任务远比再看三遍定义更接近真实使用。

十四、第六个核心:Reflection——把经验变成知识

学习之后花几分钟回想发生了什么,能让一次经历沉淀成可复用的知识。一天结束时可以回顾:今天真正学会了什么,哪些地方最困难,犯了什么错误,错误为什么发生,下次遇到相似问题应该注意什么线索。

缺少反思,一个人可能有十年工作经历,却只是在重复同一年的经验。加入复盘,经验才会逐渐形成原则、判断和策略。

十五、第七个核心:Calibration——准确判断自己会不会

学习能力不仅取决于知道多少,也取决于能否准确判断自己知道多少。这种对自身认知状态的判断属于元认知。

最危险的状态不是不会,而是不会却以为已经会了。前者知道需要继续学习,后者会因为错误的掌握感提前停止。真正可靠的判断应来自无提示测试、延迟测试和变式应用,而不是熟悉感。

十六、知识幻觉:输入能力不等于输出能力

看答案时觉得会做,遮住答案却无法开始;听别人解释时觉得简单,轮到自己却说不清;阅读英语文章时单词大多认识,写作时却不会使用。这些现象都说明输入能力与输出能力并不相同。

提取练习的另一项价值,是帮助测量学习并形成反馈循环:

学习 → 自测 → 发现缺口 → 针对性再学习 → 再次自测 → 修正判断

这个循环不仅积累知识,也训练如何管理自己的学习。

十七、错误不是失败,而是信息

在有效学习框架中,测试不是用来证明聪明与否,而是寻找知识漏洞。做 30 道题错了 8 道,真正有价值的不是把正确答案抄一遍,而是判断每一个错误属于哪一类。

  • 知识点从未理解。
  • 公式或事实没有提取出来。
  • 误读了题目条件。
  • 混淆了两个相近概念。
  • 计算或操作失误。
  • 题型判断错误,选错了策略。

不同错误需要不同修正方法,所以错误分类通常比单纯整理错题更重要。

十八、掌握知识的五个层级

看过并不等于会用。按照学习深度,可以把掌握分成五层:

层级 状态 具体表现
1 熟悉 看见概念时觉得曾经见过
2 识别 给出几个答案时能够选中正确项
3 提取 没有提示时能够说出或写出
4 应用 能够使用知识解决熟悉问题
5 迁移 换到陌生环境后仍知道何时以及如何使用

高级学习目标是第五层。现实问题不会按照教材章节出现,真正的能力是看见陌生问题、识别结构、从长期记忆中找到相关知识、选择方法并解决。

十九、为什么大量相似题会制造虚假高手

连续做同一种概率题时,章节名称、前一道题和刚用过的公式都在提供环境提示。做到后面速度越来越快,未必代表独立判断能力同步提高。

真实考试里,概率题可能夹在微积分和统计题之间,也不会提醒使用贝叶斯定理。因此学习后期应逐步撤掉辅助轮:

  • 先借助完整例题理解方法。
  • 减少步骤提示,独立完成。
  • 混合相近题型,判断该用什么方法。
  • 最后处理表面陌生、结构相似的问题。

这种渐进式撤提示,比机械刷一百道同类题更接近真实能力。

二十、理解很快的人也容易高估学习效果

理解速度快的人常在看一遍后就产生强烈的掌握感,然后迅速进入下一部分。可是理解速度与长期记忆是两个问题。此刻能够跟上作者的论证,只说明工作记忆处理得过来,并不意味着三个月后还能独立重建。

材料越容易理解,越需要用延迟提取检查是否真正留下。成熟的学习者关注的不是自己显得多聪明,而是学习系统能否稳定地产生长期可用的知识。

二十一、八组反直觉的学习对照

感觉更舒服的做法 长期学习可能更好的做法
再读一次合上书回忆
连续学习拉开复习间隔
同一种题刷到底混合相近题型
先看答案先尝试,再核对
避免犯错尽早暴露错误并纠正
凭感觉判断会了用无提示测试判断
追求训练时流畅接受适度、有价值的困难
考完就结束隔一段时间再次提取

这些对照共同训练一种新的学习直觉:现在困难一点,有时能换来以后更容易,但前提始终是困难对提取、辨别或迁移有帮助。

二十二、把全书变成可执行的七步循环

第一步:理解

正常阅读教材、观看课程或听取解释,先建立对内容的初步模型,不要求立刻背住全部细节。

第二步:关闭材料

合上书、暂停视频、遮住答案。没有这个动作,后续很容易退回识别而不是提取。

第三步:主动重建

回忆刚才讲了什么、核心观点是什么、原因是什么,并尝试举出自己的例子。

第四步:检查

重新打开材料,比较哪些正确、哪些遗漏、哪些理解有偏差。

第五步:修正

针对刚才失败的地方补学,不必无差别地把整章重读一遍。

第六步:间隔

暂时离开这部分内容,学习其他东西,或者让睡眠参与记忆巩固。

第七步:重新提取

第二天、几天后和几周后再次无提示回忆,并逐渐加入变化后的任务。

完整循环:Encoding → Retrieval → Feedback → Spacing → Retrieval

二十三、具体例子:学习心理学

学习 Classical Conditioning 时,低效做法可能是读教材二十分钟、划重点、抄定义、再读一遍,产生看懂了的感觉后结束。

按照提取学习的方式,可以先阅读十五分钟,然后合书,凭记忆写出经典条件作用的含义,并画出:

US → UR

CS + US

CS → CR

接着解释 Pavlov 实验为什么能说明这个过程,比较它与操作性条件作用的区别,再举出一个不同于狗分泌唾液的生活案例,并判断广告是否可能利用这种机制。

第二天不看笔记重画一次;三天后把 Classical Conditioning 和 Operant Conditioning 混合做判断;两周后面对陌生案例辨别理论。训练内容由记定义逐步升级为提取、解释、辨别、应用和迁移,知识才开始转化为能力。

二十四、具体例子:背英语单词

以 mitigate 为例,连续看二十遍 mitigate = 减轻,只能带来较强的熟悉感。更好的起点是使用正反面卡片,正面写 mitigate,背面写减轻、缓和,看到正面时先主动回忆。

进一步训练时,可以增加四类任务:

  • 说出含义并自己造句。
  • 比较 mitigate、reduce、alleviate、relieve 的区别。
  • 完成句子:The new policy may ______ the impact of inflation.
  • 隔几天重新出现,在新语境中判断是否适合使用。

这样建立的不只是英语单词与中文词义的对应,还包括语境、搭配、辨别和多条提取路径,更接近真正的语言能力。

二十五、具体例子:怎样真正读完一本书

从第一页一路读到第三百页,只能说明完成了阅读动作。一个月后若无法说出全书最重要的观点,知识并没有因为翻完最后一页自动留下。

更有效的做法,是读完一个有意义的小节后暂停并合上书,回答以下问题:

  • 这一节在解决什么问题?
  • 作者的结论是什么?
  • 支撑结论的证据是什么?
  • 有没有可能的反例?
  • 它和前面的内容有什么关系?

整本书结束后,不看目录重新写出全书结构,把三百页文字压缩成二十个关键概念,再压缩成五个核心原则,最后形成一张知识地图。专家的优势通常不只是记住更多事实,更在于知识结构组织得更好。

二十六、为什么给别人讲很有效

给别人讲解天然包含提取、组织、解释和举例。听者继续追问原因时,知识漏洞也会迅速暴露。很多内容在阅读时显得清楚,直到真正开口解释,才发现结构并不完整。

没有真实听众时,也可以模拟教学:对着空气讲、录音讲、向学习伙伴复述,或者写成一篇文章。关键不在教学的仪式,而在没有材料帮助时重新组织并产出知识。

二十七、笔记有没有用,取决于大脑在做什么

做笔记并非天然有效或无效,关键是笔记过程中发生了什么认知活动。老师写一句、学生复制一句,主要是信息搬运;用自己的语言总结,已经多了一层加工;关闭材料后凭记忆写,再把概念之间的关系画出来,才真正结合了提取和组织。

例如把 Retrieval、Spacing、Forgetting、Desirable Difficulty 和 Long-term Retention 连接成关系图,笔记就不再只是储存知识的地方,而成为思考的产物。

二十八、Flashcard 为什么有效,又为什么容易被用废

Anki 等间隔重复工具能够结合 retrieval 和 spacing,因此很适合练习记忆。但卡片如果设计得太模糊,正面只写 Psychology chapter 3,背面塞入两页内容,就会变成看答案机器。

好的提取问题应当明确,例如:

  • What is retrieval practice?
  • Classical conditioning 与 operant conditioning 的核心区别是什么?
  • 为什么 massed practice 容易产生 mastery illusion?

对于需要理解的内容,卡片还应从 What 逐渐升级到 Why 和 When。学习 confirmation bias 时,不只回答它是什么,还要解释为什么会持续存在,并能在案例中判断是否属于这种偏差。这样卡片训练的才是概念,而不只是定义。

二十九、学习的三个阶段:Build、Strengthen、Generalize

第一阶段:Build

通过阅读、听课、观察示范和理解来建立知识,目标是形成初始模型。

第二阶段:Strengthen

通过主动回忆、间隔重复、测试和反馈来强化知识,目标是让知识能够长期提取。

第三阶段:Generalize

通过交错练习、变式任务、陌生题和真实问题来泛化知识,目标是让它离开教材后仍然可用。

许多学习停留在 Build 阶段,不断看视频、读书和上课,却很少进入 Strengthen,更少进入 Generalize。结果便是积累大量曾经看懂的知识,而不是现在拥有的能力。

三十、怎样判断自己是不是真的学会

可靠的掌握标准不应只是现在是否看懂,而应逐层检查:

  • 24 小时后,不看材料还能不能解释?
  • 一周后还能不能解释?
  • 问题稍作变化后还能不能解决?
  • 与相似概念混在一起时还能不能辨别?
  • 真实环境中没有提醒时,能不能想到应该使用它?

五项都能做到,才越来越接近 Mastery。延迟、变化和缺少提示,都是检验长期知识的必要条件。

三十一、这套方法的边界

主动回忆、间隔和交错并不能解决一切学习问题。效果还会受到材料性质、已有知识、反馈质量和任务类型影响,使用时需要认识四个边界。

第一,提取不能替代理解

没有理解牛顿第二定律,只是每天背 F = ma,强化的可能只是字符串。提取练习建立在初步理解和正确表征之上。

第二,记住知识不等于创造知识

研究、论文写作、提出新理论和解决开放问题,还需要推理、创造、批判性思维与问题定义,不能完全还原成 flashcards。

第三,并不是越难越好

无意义地把学习变复杂,不属于有益困难。困难只有在帮助提取、辨别、迁移或建立更好的知识结构时才值得保留。

第四,理论最优不等于行为最优

再科学的方法,如果每天都无法执行,实际效果仍然接近零。好的学习系统必须能融入生活,并长期坚持。

三十二、轻而易举并不是高质量学习的真实感受

《认知天性》的中文副标题容易让读者期待学习会变得轻松,但全书传递的恰恰是另一层意思:高质量学习经常伴随想不起来、犯错、等待、重新尝试、混合题型、困难和不确定。

这些体验主观上并不舒服,却可能比一路顺畅更接近长期学习。真正准确的概括是:稍微更难一点、但方向正确的学习,往往记得更久。

三十三、最值得长期保留的习惯:关掉答案

读完内容后合上书,关闭 PDF,暂停视频,遮住答案,然后检查没有提示时还剩下什么。这个动作很小,却能迅速把识别任务变成提取任务。

合上书后仍能重新组织出来的部分,才开始接近真正属于自己的知识;想不起来的部分,则准确指出下一轮学习应该放在哪里。

三十四、《Make It Stick》的十条核心原则

  1. 不要用熟悉感判断是否学会,要用能否独立提取来判断。
  2. 学习后尽快开始主动回忆,不要无限重复输入。
  3. 让复习之间产生间隔,不要把全部训练挤在一起。
  4. 允许适量遗忘发生,因为重新提取本身就是训练。
  5. 混合相近问题类型,练习何时使用哪一种知识。
  6. 先尝试再看答案,通常比直接接收答案更有学习价值。
  7. 犯错不是学习系统的故障,而是学习系统产生的信息。
  8. 不断解释为什么、有什么区别,并为概念举出新例子。
  9. 不要用训练时的流畅度判断长期掌握程度。
  10. 最终目标不只是记忆,而是在陌生环境中正确迁移知识。

结语:学习是持续重建知识的过程

普通的学习观常把学习理解为把知识输入大脑。更完整的过程应当是:

建立知识 → 提取知识 → 遗忘一部分 → 再次提取 → 纠正错误 → 重新组织 → 在不同情境中调用

学习不只是 Storage,更接近 Construction + Retrieval + Reconstruction。有人读过很多材料,却没有多少知识可以随时调用;也有人接触的材料并不更多,却建立了扎实、组织清晰的知识体系。差别往往不在投入时间的绝对数量,而在学习时大脑进行了怎样的认知活动。

长期学习公式:有效学习 ≈ 理解 × 主动提取 × 间隔 × 反馈 × 变式练习 × 反思

其中任何一个环节长期接近零,整体效果都会明显下降。学习过程很顺,不一定代表学得好;暂时感到困难,也不一定代表学得差。真正的检验,是一个星期、一个月甚至一年以后,还能否把知识拿出来,并知道何时使用。