这些研究究竟比较了什么?
「单词要放在语境里记」被重复得太多,听上去像已有定论。并没有。把两种形式并排比较的实验,在它们所用的指标上大多得出了与民间建议相反的结果——原因不是语境没用,而是那些测验测的是这个词学得有多牢,而不是用得有多好。
下面每一行都是做过直接比较的研究。请仔细读第三列:其中好几个结果,都比人们据此写出的标题窄得多。
| 研究 | 比较了什么 | 发现了什么 |
|---|---|---|
| Laufer 与 Shmueli(1997) | 词单独呈现、放在短句里、放在文章里、放在扩写文章里;用母语注释或用第二语言解释 | 更短、语境更薄的呈现记得更牢,母语注释胜过第二语言解释 |
| Prince(1996) | 靠译文学习与靠语境学习,跨水平比较 | 译文一组回忆出的词更多——但那些词更难迁移到语境中使用,水平较低者尤其明显 |
| Webb(2008) | 信息量足的语境与信息量少的语境,遇见次数保持一致 | 语境不是一回事:信息量足的语境带来明显更大的增益,贫乏的几乎没有 |
| Horst、Cobb 与 Meara(1998) | 在完全不做刻意学习的情况下,读完一整本简写小说能学到什么 | 大约书中生词的 22%:确实是真实的学习,但这个速度独自撑不起一个词汇量 |
| Elgort(2011) | 靠词对刻意记住的词,会不会成为真正的心理词库词条 | 会:它们表现出真实词汇才有的启动效应,而不是死记硬背的信息 |
这些都是学习者、语言与测验各不相同的小规模研究,没有哪一项能单独作结。它们真正一致的地方比「谁赢」更窄也更有用:孤立形式在把一个词送进记忆这件事上效率可测,而它赢下的那些测验测的恰好就是这件事。语境赢在那些测验从未提出的问题上——Prince(1996)正是露出接缝的那项研究,因为译文组认识的词更多,能用它们做的事却更少。
三种不同的东西都被叫作「语境」
关于这件事的多数分歧,其实是人们用同一个词在为三种不同的做法辩护。它们的成本不同、证据不同、失败的方式也不同,把它们混为一谈才让建议自相矛盾。
- 为了情节而读的一整篇文章。 那个词出现一两次,周围是与它无关的材料。低产出正是从这里来的——一整本书里约 22% 的生词(Horst 等,1998)。Webb(2008)解释了这种波动:大多数句子并不限定一个生词可能是什么意思,所以大多数遇见几乎什么也教不了。
- 附在词旁边的一句例句。 一句因为能让词义一目了然而被挑出来的短句,紧挨着译文。这正是 Laufer 与 Shmueli(1997)发现记得最牢的形式;Bolger 等(2008)也发现,每次遇见都换一个语境并配上释义,比单一语境更能养出词义知识。它离词对比离阅读更近。
- 与人对面、有压力的真实使用。 没有任何学习形式能捕捉它,而它是唯一能检验这个词是否真正可用的。它同时也是你没法用「还没掌握的词」去练的:你会悄悄绕开它们——所以它是把词汇收尾,而不是把词汇建起来。
方向的问题——你的练习要求你认出这个词,还是把它说出来:主动词汇与被动词汇。
一个词的哪个部分,由哪种形式来教?
Nation(2001)把「认识一个词」当作一个包裹而不是一条事实:它的形、它的义、它要求的语法、和它同行的词、以及它所属的场合。包裹一打开,争论就化开了:两种形式并不在抢同一份工作。每一行是一个成分,最后一列是关于谁来提供它的坦白判断。
| 词的成分 | 词对给你什么 | 语境给你什么 |
|---|---|---|
| 形——怎么读、怎么拼 | 直接、立刻,没有别的东西来抢注意力 | 同样的东西,埋在你同时还在分析的句子里 |
| 核心词义 | 母语里毫不含糊的注释——现存最快的路径(Laufer 与 Shmueli,1997) | 一次推断,只有在语境信息量足时才可靠(Webb,2008) |
| 它的语法——格、介词、句型 | 没有,除非卡片上带着一句话 | 这是语境的工作,没有哪个词对能替代 |
| 搭配——它和哪些词同行 | 完全没有 | 只有这里才拿得到,而且要经过许多不同的遇见(Webb,2007) |
| 语体——多正式、多粗鲁、谁会这么说 | 没有,而且光秃秃的注释还可能误导 | 只有这里才拿得到,而且更多来自真实使用而非学习材料 |
| 速度——需要时它能出来 | 如果卡片压住答案,提取练习会把它练出来 | 靠量练出来,但需要的时数远超过大多数人拥有的 |
这张表里的两行就是全部的实用答案。词对在上面两行无可匹敌、在中间两行毫无用处;语境正好相反。所以证据最足的形式并非其中任何一种的纯粹形态:而是一个带着一句好例句的词对——让通往词义的最快路径和通往语法的唯一路径,落在同一张卡片上。
刻意学习不是那个「浅」的选项
「单词要放在语境里记」背后的怀疑是:译文会产生一种脆弱的、人造的知识——能考过试,却从来不真正属于你。Elgort(2011)直接检验了这一点。学习者刻意地从词对里学词,随后用启动任务来测量——这类任务揭示的是一个词是怎么被存储的,而不是学习者能就它说出些什么。那些刻意学来的词,表现得就像已经站稳的心理词库词条。无论直觉怎么说,产生出来的知识就是真的那一种。
Schmitt(2008)得出了整片文献指向的结论:显性学习与偶然接触是互补而非对手。显性学习在「每个词」的效率上高得多——几分钟就能推动一个词,而小说得花两万字才把它教到一半——接触则提供任何一副卡片都装不下的量、重复与深度。Nation(2001)把这变成一份预算,即他的四条线:以意义为中心的输入、以意义为中心的输出、以语言本身为对象的刻意学习,以及流利度培养,权重大致相当。词的显性学习占大约四分之一的时间,不再更多。
这就让真正的失败清楚起来了。几乎没有人缺输入;剧集、信息流、歌曲和文章都会自己找上门。缺掉的那条线是刻意的四分之一,因为它是唯一必须排进日程的,而必须排进日程的线就要和一天里的其他一切竞争。这些研究里任何一项测出的两种形式之差,跟「做不做那条刻意的线」之差比起来都很小。
无论你选哪种形式,决定结果的是什么
决定一个词能否活下来的有四件事,而「语境还是词对」并不在其中。三件已被充分测量,效应大到不用统计也看得见。第四件完全没有文献,因为它根本不是记忆问题——而对多数人来说,决定结果的正是它。
把右栏读成奖品的大小。这张表最上一行与最下一行之间的距离,远大于任意两种呈现形式之间的距离。
| 是什么在决定 | 证据 | 效应有多大 |
|---|---|---|
| 你是被要求想起来,还是只是被展示 | Karpicke 与 Roediger(2008);关于深度见 Craik 与 Lockhart(1972) | 去掉重复提取后,一周后的回忆从约 80% 降到约 35% |
| 遇见是否被拉开 | Cepeda 等(2006),涵盖 254 项研究 | 分散约 47%,集中约 37%——同样的材料,同样的总时间 |
| 遇见的次数够不够 | Nation 与 Wang(1999);Webb(2007) | 大致需要 8–12 次分散的遇见,而且十次之后仍有几个成分是不完整的 |
| 这次遇见到底有没有发生 | 不需要研究——从未开始的一次学习没有效应量 | 决定性的。在什么都没打开的日子里,上面三行一文不值 |
所以「语境还是词对」之争,配不上它得到的注意力。把注意力花在挑选完美形式上,然后三十天里只学四天,会输给几乎任何一种在多数日子里被用起来的形式。唯一有大答案的问题是最后一行。
一个词对和它的例句,自己找上门
如果决定性的那行是最后一行,值得自动化的就不是形式的选择,而是卡片的到达。LearnScreen 正是照这个形状造的——而它送来的卡片,恰好就是证据偏爱的那种:词对,下面一句话。
卡片来找你
手机平均每天被查看约 186 次,清醒时每小时约 11.6 次(Reviews.org,2026)。LearnScreen 通过 Apple 的屏幕使用时间 API 拦住你选定的应用,在那里放上一个词:刻意的那条线落在你本来就要做的动作上,不需要排进日程。
它同时带着两半
每个词都带有译文、音标和一句例句,于是毫不含糊的注释和那一个好语境落在同一张卡片上。这正是 Laufer 与 Shmueli(1997)发现记得最牢的呈现方式,而不是光秃秃的词对,也不是一整段散文。
它先等你,再给答案
答案在你点开之前一直藏着,所以这次遇见是一次提取而不是一次阅读。随后莱特纳系统会随着词变牢而拉长间隔,并把你没答上的词送回来——上表的第一到第三行,你什么都不用管。
- 剂量由你定。 每次的词数可在 3 到 20 之间调整,拦截返回的频率也一样;按默认设置,一天大约 25 次回忆尝试,合计约两分半,摊在一整天里。
- 18 个主题、1,080 多个精选词。 支持十一种语言作为学习目标,还可以不限量地添加自己的词,附上译文、音标和例句——让那个你总是记不住的词,拥有你自己挑的语境。
- 落下了也不会丢东西。 没有会断的连续记录,也没有对安静一周的惩罚:没答上的词留在队列里,而把一个半懂的词做完,比开一个新词更便宜。
- 离线可用,无需账号。 安装之后,卡片和拦截都不依赖网络;iCloud 备份写入你自己的私有数据库而不是我们的服务器,也没有什么需要注册。
继续阅读
- 被动学习真的有用吗 — 仅靠接触能产生什么,又在哪里停下。
- 主动词汇与被动词汇 — 为什么你看得懂的词,说话时却出不来。
- 为什么背过的词还会忘 — 两次遇见之间,一个词身上发生了什么。
- 说一门语言需要多少词 — 按覆盖率和 CEFR 等级看目标的大小。
常见问题
参考文献
- Laufer, B., & Shmueli, K. (1997). Memorizing new words: Does teaching have anything to do with it? RELC Journal, 28(1), 89–108.
- Prince, P. (1996). Second language vocabulary learning: The role of context versus translations as a function of proficiency. Modern Language Journal, 80(4), 478–493.
- Webb, S. (2008). The effects of context on incidental vocabulary learning. Reading in a Foreign Language, 20(2), 232–245.
- Webb, S. (2007). The effects of repetition on vocabulary knowledge. Applied Linguistics, 28(1), 46–65.
- Horst, M., Cobb, T., & Meara, P. (1998). Beyond A Clockwork Orange: Acquiring second language vocabulary through reading. Reading in a Foreign Language, 11(2), 207–223.
- Elgort, I. (2011). Deliberate learning and vocabulary acquisition in a second language. Language Learning, 61(2), 367–413.
- Nation, I. S. P. (2001). Learning Vocabulary in Another Language. Cambridge University Press.
- Schmitt, N. (2008). Instructed second language vocabulary learning. Language Teaching Research, 12(3), 329–363.
- Bolger, D. J., Balass, M., Landen, E., & Perfetti, C. A. (2008). Context variation and definitions in learning the meanings of words. Discourse Processes, 45(2), 122–159.
- Hulstijn, J. H., Hollander, M., & Greidanus, T. (1996). Incidental vocabulary learning by advanced foreign language students: The influence of marginal glosses, dictionary use, and reoccurrence of unknown words. Modern Language Journal, 80(3), 327–339.
- Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
- Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380.
- Karpicke, J. D., & Roediger, H. L. (2008). The critical importance of retrieval for learning. Science, 319(5865), 966–968.
- Craik, F. I. M., & Lockhart, R. S. (1972). Levels of processing: A framework for memory research. Journal of Verbal Learning and Verbal Behavior, 11(6), 671–684.
- Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report
语境与译文的对比研究以英语和希伯来语学习者为对象、采用笔头测量,样本小、设计各异;它们确立的是差异的方向,而不是一个普遍的比例。提取与分散的效应来自每一行中点名的研究。卡片数量与每日合计是按一次约二十秒的回忆尝试推算出来的,不是应用中测得的数据。
什么都不用打开,词和它的例句就到了
LearnScreen 把这份工作里刻意的四分之一——一个词对、一句话,以及答案之前的一次停顿——放进你本来就在做的看手机动作里。它只要大约二十秒,你这一天里别的什么都不必挪动。
在 App Store 下载
