一个新单词到底消退得多快
19世纪80年代初,赫尔曼·艾宾浩斯把时间花在背诵无意义音节表并按固定间隔自测上。这并非刻意为难:没有意义的材料能剔除真实单词从你已有知识中获得的那份先发优势。他把剩下的部分记为节省量——重新学会这份清单比从零学起省下多少力气。2015年,Murre 与 Dros 在现代条件下重复了整套流程,曲线依然成立。
这些数字描述的不是缓慢渗漏,而是一道悬崖,后面接着一片高原。第一个小时里失去的,比接下来整整一个月失去的还多——这意味着最关键的那个间隔,恰恰是没人会安排的那个。
| 距离学习的时间 | 保留(节省量) | 实际意味着什么 |
|---|---|---|
| 约20分钟 | 约58% | 你还没放下手机,下降就已经开始了 |
| 约1小时 | 约44% | 一小时内超过一半消失,而且什么差错都没发生 |
| 1天 | 约34% | 陡峭段基本结束——决定这个词命运的就是这一天 |
| 6天 | 约25% | 再过五天的损失,比头六十分钟还小 |
| 31天 | 约21% | 曲线已经变平;撑过一个月的,大体会继续留下 |
请把它当作形状来读,而不是你自己词汇量的常数。数据来自19世纪80年代一个人自测的无意义音节;Murre 与 Dros(2015)重复了该流程并得到接近的数值——这很值得注意,但并不能使其普适。真实单词消退得更慢,因为意义、同源词和例句给了记忆痕迹可抓的地方。真正可迁移的是几何形状:陡峭的第一天,随后是长而平坦的尾巴。
三件不同的事都被叫作「忘了」
这个词至少覆盖三种失败,原因不同,办法也不同。弄清哪一种是你的,比任何学习技巧都值钱——因为三者中有两种根本不是记忆问题。
- 它根本没进去。 你半心半意扫过的单词,从来没有被编码到足以日后提取的深度。Craik 与 Lockhart(1972)把这称为加工水平:决定持久性的不是材料在你眼前停留多久,而是你对它的加工有多有意义。划过一条翻译,是可能存在的最浅加工。
- 它在里面,但你够不着。 Tulving 与 Pearlstone(1966)区分了可得性与可及性:那些人们自由回忆时说不出的词,一旦给出类别线索就回来了。这就是「话到嘴边」的感觉,也意味着「我忘了」常常描述的是缺失的线索,而不是缺失的记忆。
- 别的东西占了位置。 Underwood(1957)表明,在词表学习研究中看似自发衰退的部分,大多来自先前词表的干扰:一天后的回忆率从没有先前词表者的约80%,降到学过很多词表者的约20%。新语言里两个相似的词,也以同样方式互相干扰。
同一问题的另一面——单靠接触能带来多少词汇:被动学习真的有用吗?
你属于哪一种遗忘
下面每一行都是学习者真实说出的抱怨,与其背后正在发生的事并列。最后一列刻意收窄:一个改变,而不是一套学习体系。请留意有多少行的解决方式,是同样的东西在另一个时刻到达,而不是你更用功。
| 感觉是什么样 | 实际在发生什么 | 什么能改变它 |
|---|---|---|
| 「一看就认识,但说不出来」 | 接触训练的是再认;产出是另一种能力(Tulving 与 Pearlstone,1966) | 在揭晓答案之前先试着说——测试胜过重读(Roediger 与 Karpicke,2006) |
| 「昨晚还会,今早就没了」 | 第一天的正常下降,曲线最陡的一段 | 在损失集中的头24小时内做一次提取 |
| 「两个相似的词总是搞混」 | 是干扰而非衰退——Underwood(1957)分析中的主因 | 把这对词在时间上分开,并让它们互相对照练习,而不是各自单练 |
| 「只有在 App 里才想得起来」 | 记忆依赖线索:可得,但离开熟悉情境就够不着 | 在不同地点、不同顺序中与它相遇,让它不再依赖单一线索 |
| 「一晚刷了200张,然后几周没碰」 | 集中练习:练的时候像流利,练完就消退 | 把同样的分钟摊开——分散约47%,集中约37%(Cepeda 等,2006) |
| 「就是一直没坐下来复习」 | 这根本不是记忆出问题——出问题的是计划,而曲线只是照常运行 | 把复习挂在一个本来就会发生的时刻上 |
最后一行描述的是大多数人,也是唯一一行学习本身毫无问题的情况。需要你记住去执行的计划,要与一天里的所有其他事竞争;而遗忘曲线不与任何东西竞争,也从不落下任何一个晚上。
被遗忘的单词并没有回到零
这一领域最令人振奋的发现,藏在艾宾浩斯的方法里,而不是他的结果里。他无法测量自己记得什么,因为一个月后他常常有意识地什么也说不出——于是他改为测量重新学习快了多少。节省量之所以存在,是因为你提取不出的痕迹依然在那里发挥作用。第二次经过同一个词,总是更便宜,而且常常便宜得惊人。
Bahrick(1984)把这一点推到了极限。他就学校里学的西班牙语测试了近800人,其中一些人已过去五十年,结果找到了预期中的下降——但只出现在最初的三到六年。此后保持不再下降:剩下的部分在随后的二十五年里几乎没有变化,无论此人期间是否再碰过西班牙语。他把这层幸存下来的记忆称为permastore;而拥有更多的人,不出所料,正是当初学习分散在更多学期里的那些人。
这重新定义了整个问题。你并不是在对抗一场滑向零的必然过程;你是在设法把单词送过一道门槛,过了这道门槛,它们就不再需要你。Bahrick 与 Phelps(1987)显示了原始学习的分散程度有多决定性:以30天为间隔重新学习的词对,八年后的保持远好于同一天复习的同一批词对。所以那些让你内疚的单词——学过一次又丢掉的——并没有白费。它们只是建到一半,等着从未到来的重逢。
真正决定一个单词能否存活的因素
四个变量几乎解释了「能留几年的词汇」与「只撑一个周末的词汇」之间的全部差距。其中三个研究充分、效应很大。第四个几乎没有文献,因为它根本不是记忆问题——而对多数学习者来说,决定结果的恰恰是它。
请把右栏读作奖赏的大小。这不是几个百分点的边际差异:提取与重读之间的差距,大致相当于「记住几乎整份词表」与「只记住三分之一」之间的差距。
| 决定存活的因素 | 证据 | 效应有多大 |
|---|---|---|
| 你是提取,还是重读 | Karpicke 与 Roediger(2008),总学习时间保持不变 | 去掉重复提取后,一周后的回忆率从约80%降到约35% |
| 间隔拉得多开 | Cepeda 等(2006)254项研究;Bahrick 等(1993)历时九年 | 同样的集中时间下约47%对37%;56天间隔在所有长延迟上都胜过14天间隔 |
| 它得到了多少次相遇 | Nation 与 Wang(1999);Webb(2007) | 大致需要8~12次分散的相遇才能留住;到第十次时知识仍不完整 |
| 复习到底有没有发生 | 不需要研究——被跳过的复习没有效应量 | 决定性的。在没打开 App 的日子里,其余三行一文不值 |
Cepeda 等人(2008)补上了让第二行可执行的细节:最佳间隔约为你希望记住时长的10%~20%。想让一个词保持一个月,就在学会后大约三到六天复习它——几乎没人凭直觉能定到这个时间点,因为它感觉太晚了。
不依赖「记得去复习」的复习
如果决定性的是第四行,那么值得自动化的不是学习,而是出席。LearnScreen 正是按这个形状构建的:回应曲线的,是你一天中本来就存在的动作,而不是一份需要你遵守的计划。
复习自己找上门
手机每天大约被查看186次,相当于清醒时每小时约11.6次(Reviews.org,2026)。LearnScreen 通过 Apple 的屏幕使用时间 API 拦截你选定的 App,改为显示一个单词——于是这次相遇落在第一天之内,落在你本来就会做的动作上,没有东西要打开,也没有东西要记住。
要的是回忆,不是阅读
卡片先显示单词,在揭晓意思前等待。这次尝试正是 Karpicke 与 Roediger(2008)中约80%与约35%之间的差别——也是无法被自动化的那一部分,因此成了唯一留给你的部分。它花费约二十秒。
间隔会自己变宽
莱特纳系统把答对的词往上提,把答错的词拉回来,于是随着记忆增强,间隔逐渐拉长,趋向 Cepeda 等(2008)所说的10%~20%区间,而你什么也不用决定。正在流失的词最先回来,而那正是复习价值最高的位置。
- 剂量由你决定。 每次3到20个词,拦截多久回来一次也可调整——默认设置约合每天25次回忆尝试,分散开来约两分半钟。
- 18个主题、1080多个精选词。 支持11种目标语言,并可无限添加自己的单词,附翻译、注音和例句,让新词有可抓的地方。
- 落下进度也不会损失什么。 没有会断的连续记录,也不会因为清闲一周而受罚:答错的词留在队列里,而 permastore 的证据说明,把它们找回来比当初学会更便宜。
- 离线可用,无需账号。 安装后卡片与拦截无需联网即可运行;iCloud 备份写入你自己的私有数据库,而不是我们的服务器,也没有任何需要注册的东西。
继续阅读
- 被动学习真的有用吗? — 单靠接触能产生什么,又在哪里停下。
- 每天该学多少个单词? — 为什么上限由复习负担决定,而不是输入量。
- 能一边做别的事一边学吗? — 哪些时刻能承载一次复习,哪些不能。
- 每天几分钟能学会一门语言? — 时间的算术,以及这些分钟原本在哪里。
- 开口说需要多少词? — 按覆盖率和 CEFR 等级看目标的大小。
常见问题
资料来源
- Ebbinghaus, H. (1885). Über das Gedächtnis: Untersuchungen zur experimentellen Psychologie. Duncker & Humblot.
- Murre, J. M. J., & Dros, J. (2015). Replication and analysis of Ebbinghaus’ forgetting curve. PLOS ONE, 10(7), e0120644.
- Bahrick, H. P. (1984). Semantic memory content in permastore: Fifty years of memory for Spanish learned in school. Journal of Experimental Psychology: General, 113(1), 1–29.
- Bahrick, H. P., & Phelps, E. (1987). Retention of Spanish vocabulary over 8 years. Journal of Experimental Psychology: Learning, Memory, and Cognition, 13(2), 344–349.
- Bahrick, H. P., Bahrick, L. E., Bahrick, A. S., & Bahrick, P. E. (1993). Maintenance of foreign language vocabulary and the spacing effect. Psychological Science, 4(5), 316–321.
- Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380.
- Cepeda, N. J., Vul, E., Rohrer, D., Wixted, J. T., & Pashler, H. (2008). Spacing effects in learning: A temporal ridgeline of optimal retention. Psychological Science, 19(11), 1095–1102.
- Karpicke, J. D., & Roediger, H. L. (2008). The critical importance of retrieval for learning. Science, 319(5865), 966–968.
- Roediger, H. L., & Karpicke, J. D. (2006). Test-enhanced learning: Taking memory tests improves long-term retention. Psychological Science, 17(3), 249–255.
- Tulving, E., & Pearlstone, Z. (1966). Availability versus accessibility of information in memory for words. Journal of Verbal Learning and Verbal Behavior, 5(4), 381–391.
- Underwood, B. J. (1957). Interference and forgetting. Psychological Review, 64(1), 49–60.
- Craik, F. I. M., & Lockhart, R. S. (1972). Levels of processing: A framework for memory research. Journal of Verbal Learning and Verbal Behavior, 11(6), 671–684.
- Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
- Webb, S. (2007). The effects of repetition on vocabulary knowledge. Applied Linguistics, 28(1), 46–65.
- Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report
节省量百分比是艾宾浩斯本人的数据,由 Murre 与 Dros(2015)整理并重复验证;它们描述的是单一被试的无意义音节,在此作为遗忘的形状呈现,而非真实词汇的衰减速率。保持与分散效应来自各行所标注的研究。卡片数量与每日合计是基于约二十秒一次回忆尝试的算术,而非从 App 测得的数据。

