← Deep Research
深度研究 · 易读版
学习方法排座次:哪些真有效,哪些是神话?(易读版)
TL;DR
考自己 + 隔开学是证据最硬的两个方法;混着练只在内容易混时有效;一万小时是畅销书发明——练习量只解释约 14% 的成就差异,重做原研究时顶尖组根本没练得更多;学习风格匹配教学检验了几十年都不过关,九成教师却相信。看任何宣传数字先问三件事:跟谁比、在哪测、谁在卖。
读 14 遍 40% vs 考 3 次 61%一万小时:复现不成立九成教师信学习风格交错课堂 RCT:61 vs 38 分
本文是同名深入版的精简版。所有关键数字都经过独立核查,想看完整论证和出处请读深入版。
你听过的学习建议,大多没有你以为的那种证据
关于怎么学习,流行文化有一套标准答案:练满一万小时就能成大师;每个人有自己的学习风格,按风格教才有效;划重点、反复读是学生的基本功。
学习科学也有一套答案——有的效应已经被测了一百多年——但它和流行答案几乎对不上。这篇文章把常见的学习方法按证据强度重新排了座次:哪些方法经得起反复检验,哪些是被畅销书造出来的神话。
示意:按效应稳健性 × 课堂证据 × 独立复现 × 偏倚检验四判据排出的座次;重读/划线为「低效用」而非无效
先学三个防骗口诀
看任何"某方法让成绩提升 X%"的说法之前,先问三个问题:
跟谁比?同一个"做练习题有效",跟"什么都不做"比,效果数字是跟"重读课本"比的两倍;跟"画概念图"这类认真学法比,优势几乎归零。卖课的永远引第一个数字。
在哪测的?实验室里背单词测出的大效果,搬进真实课堂常常大幅缩水。教育实验里,一个方法能让成绩提高"0.1 个标准差"就已经跑赢了大多数干预——听起来不性感,但这才是真实世界的刻度。
谁在卖?这个领域里,畅销书作者、测评问卷公司、培训机构都在报数字。连教育界最有名的"什么方法最有效"排行榜(Hattie 的《可见的学习》),都被统计学家抓到过算出"负的概率"这种低级错误,直接判为伪科学。排行榜也会错,而且错得离谱。
示意:课堂测验的效应量随对照组类型变化(Yang 等 2021,222 项课堂研究、48,478 名学生);对概念图等精细加工策略的 0.095 不显著(p=.062)——宣传引第一个数,严格比较看后两个
座次表最上面:考自己 + 隔开学
考自己(检索练习)。读完一篇材料,合上书回忆一遍,效果远好于再读一遍。经典实验:一组人反复读了 14 遍,一周后只记得 40%;另一组只读了 3 遍多、但做了三次回忆测试,记得 61%。最讽刺的是,读 14 遍的那组对自己最有信心——顺畅的感觉骗人,费力的回忆才在建记忆。两个使用条件:要延迟看效果(当天测,重读反而占优),最好带对答案的反馈。这个方法在几百项真实课堂研究里依然成立,而且被多种统计手段查过,没有发现"只发表好结果"的水分——这在教育研究里非常罕见。顺带说一句,担心"老考自己会焦虑"的方向也测过了:练习测验反而降低考试焦虑。
隔开学(间隔练习)。同样是复习三次,分三天做远胜一天连做三遍。这是心理学里最老、证据最厚的效应之一。两个实用口径:复习间隔大致取"离考试还有多久"的两成左右(备考一个月,隔几天复习一轮);流行软件里"间隔必须越拉越长"的设定,实测和均匀间隔没差别——不用迷信递增。要泼的冷水:把间隔练习轻飘飘塞进大学常规课程的实验里,平均只提高了 2 个百分点。方法真,但别指望不费力气的魔法。
混着练(交错练习)。做数学题时把不同类型的题混在一起做,而不是一类练完再练下一类。它有全领域最漂亮的一项课堂证据:787 名中学生、预注册的随机实验、练了四个月,一个月后突击测验,混着练的班 61 分,分块练的班 38 分。但边界很清楚:它只在"内容容易混淆、需要练判断"时有效(数学题型、画家风格);背单词时反而是分块更好。而且混着练更费时间、练的当下错得更多——又是"感觉差、效果好"。
示意:同为「对重读」口径,检索练习从实验室到课堂缩水约三分之一;交错练习是罕见例外(七年级数学,54 班预注册整群 RCT);间隔练习轻剂量进常规课堂时收益缩到约 2 个百分点
座次表中间:方向对,但数字被吹大了
上课动脑(主动学习)。几百项大学理工科研究说,课堂里让学生做题、讨论、回答问题,比全程听讲平均高 0.47 个标准差,挂科率从 34% 降到 22%。方向基本可信,但两个折扣要打:第一,这堆研究九成不是严格的随机实验,数字本身别当精确值;第二,哈佛做过一个漂亮的实验——同样的讲义,主动学习组实测多学了,但他们自我感觉学得更少,给课的评分更低。轻松听讲的"学到了"的感觉,很大程度是错觉。另外,争论双方其实有共识:有效的是"动脑+有引导",完全放羊的"自己探索"式教学,两派都反对。新手先看例题、学套路,有基础了再上难度——同一个方法对新手和熟手效果会反转。
示意:Deslauriers 等 2019(哈佛物理导论,N=149,随机分组、讲义相同)——主动学习组实测多学 0.46 SD,自我感觉却少学 0.56 SD;与「读 14 遍最自信、记得最少」是同一个元认知现象
座次表下面:两个著名神话
一万小时定律。这个说法不是科学家提的,是作家 Malcolm Gladwell 2008 年从一项 30 人的小提琴研究里包装出来的,原作者 Ericsson 生前明确否认"一万"有任何魔法。更要命的是后续账目:汇总近百项研究,练习量只能解释成就差异的约 14%——练习非常重要,但离"解释一切"差得远。2019 年有人用更严格的方法重做了那项小提琴研究:最顶尖的那组学生,累计练习时间根本不比次一档的组多。练习是必要条件,不是充分条件;天赋和练习也不是对手,而是互相放大的关系。
学习风格。"视觉型学习者要看图、听觉型要听讲"——这是全世界教师中流传最广的理论:各国调查里九成上下的教育者相信它。但按合格标准做的检验(先测风格、随机分配教法、统一考试),几十年来几乎全军覆没;2024 年对它最友好的一次汇总分析,也只找到一个勉强够到显著线的微弱效应,作者自己都说"太小、太罕见,不值得推广"。连 VARK 风格问卷的设计者本人都承认:没有任何可靠研究能证明知道自己的风格对学习有益。这个理论最大的本事不是帮人学习,是自我传播——它主要通过教师培训体系扩散。
附注:重读和划线没被判死刑,只是"性价比最低"——它们恰好是学生最常用的方法,却最不稳定。把重读换成"合上书回忆",是单位努力回报最高的一次替换。
示意:从 1993 年强主张到 2019 年预注册复现失败——「练习很重要」活着,「练习量解释一切」死了;两派均为同一批数据的再编码者
示意:18 国教育者的信念率(Newton & Salvi 2020)vs 理论所需交叉互作在最有利 meta 中的出现率(Clinton-Lisell 2024,且仅 5/21 研究达质量标准)vs Pashler 等 2008 的判语
这篇文章的判断,怎么检验
十二个可检验的主张,按证据从硬到软排:
- 考自己和隔开学是证据最厚的两个方法——多项大规模汇总收敛,课堂成立,统计查重没查出水分。
- 效果数字取决于对照组:跟"啥也不干"比 0.61,跟"重读"比 0.33,跟"认真学法"比接近 0——看到宣传数字先问跟谁比。
- 测试的好处要延迟才显现,当天比反而输;自信和实效经常反着走。
- "复习间隔必须递增"没有证据,和均匀间隔打平;"最优间隔"只是个随考期变化的粗略比例。
- 实验室效果进课堂会缩水,幅度看方法:检索练习缩三分之一,轻剂量间隔练习缩到只剩 2 个百分点,混着练是罕见的不缩水例外。
- 混着练有硬边界:内容要能混淆才有效,背单词反而分块好,还更费时间。
- 练习量只解释成就差异的约 14%(勘误后数字),重做原始研究时"顶尖组练得更多"直接不成立。
- 练习量本身有四到七成是遗传的;天赋和练习是相互放大,不是二选一。
- 学习风格匹配教学在合格检验下反复失败,但九成教育者相信——传染源主要是师训体系。
- 主动学习方向稳、数字虚:证据堆里九成是不严格的对照;而且学得多的学生自感学得少,评教会惩罚好教法。
- 两派教学之争的共识:有效的是动脑+引导;新手要例题和结构,熟手才受益于"合意的困难"。
- 教育研究本身有系统缺陷:只有 0.13% 的论文做复现,最著名的效应排行榜有算术错误——任何排行榜先查口径。
值得盯什么:学习技巧的权威评级(2013 年版)会不会出更新版;"混着练"能不能在数学之外再拿到一个严格课堂实验;AI 学习工具会把"考自己+隔开学+反馈"做成默认功能,还是继续卖"个性化学习风格"。
最要紧的几件事
- 把"再读一遍"换成"合上书回忆一遍",错了看答案——这是证据最硬、成本最低的一个改动。
- 把复习拆开摊在日历上,间隔大约是"离考试时间"的两成;不用纠结间隔要不要递增。
- 感觉费劲不等于学得差,感觉顺畅不等于学得好——挑学习方法时,警惕一切"轻松就能学会"的承诺。
- 别按"学习风格"买课或分班,那笔钱和时间投给检索、间隔、例题任何一个都更值。
- 练习很重要,但别拿一万小时给自己或孩子立军令状——方向、反馈、结构和天赋的匹配,和时长一样重要。
- 新手和熟手用药不同:入门先看例题、要引导;有基础了再自测、混练、上难度。