真正起作用的是涵蓋率,不是字彙總量
研究關心的不是你抽象地認識多少字,而是在一段具體文本或對話中,你已經認識的字佔多大比例——也就是字彙涵蓋率。正是這個角度讓數字變得可用,因為字頻分布極不平均:一小撮高頻字幾乎承擔了全部工作。
Nation(2006)估計最高頻的 1,000 個詞族就佔口語的約 80%。之後每增加一千個,回報都在遞減。這既是好消息也是壞消息:最前面的 2,000 個詞族是你這輩子最划算的投入,而把涵蓋率從 95% 提到 98%,還要再花好幾千個字。
| 已掌握詞族 | 涵蓋率(約) | 實際感受 |
|---|---|---|
| 1,000 | 口語約 80% | 能抓到簡單對話的大意;每五個字有一個不認識 |
| 2,000–3,000 | 口語約 95% | 對話撐得住;空缺可以靠上下文猜出來 |
| 6,000–7,000 | 口語約 98% | 電影、Podcast 和語速快的對話都不必持續費力 |
| 8,000–9,000 | 書面語約 98% | 不查字典讀小說和報紙 |
| 約 17,000 個基礎字 | 母語者區間 | 受過教育的成年人(Goulden, Nation & Read, 1990) |
涵蓋率資料出自 Nation(2006)與 Adolphs & Schmitt(2003);母語者估算出自 Goulden, Nation & Read(1990)。測量以英語為對象:曲線形狀在其他語言同樣成立,但確切數字並不通用。
什麼算「一個字」?
上面所有數字都是詞族,不是字形。一個詞族是基礎字加上它的屈折形式與規則衍生:英語的 help, helps, helped, helping, helper, helpful, unhelpful 算一個詞族,而不是七個。這樣計數是因為,掌握字根與詞綴之後,其餘形式大致可以推得出來。
- 3,000 個詞族遠多於 3,000 個字。 依語言不同,可能對應二到四倍的不同字形。廣告上的「掌握 5,000 字」和研究中的計數幾乎從來不是同一個單位。
- 屈折發達的語言會虛增原始字數。 俄語、波蘭語、芬蘭語和韓語會把一個詞族攤成大量字形;達到同一涵蓋率所需的詞族數是可比的,但你遇到的字形數量不是。
- 理解性字彙與產出性字彙不是一回事。 CEFR 和涵蓋率的數字衡量的是你認得出的字。開口時你能主動用出來的,總是更少。
相關閱讀:往這個總數裡加一個詞族的成本,見一個字要看幾次才記得住(英文)。
CEFR 各級別對應多少字彙量?
CEFR 描述的是你能做什麼,而不是你認識多少字——並不存在官方的分級字數。但測量資料是有的。Milton(2010)測試了各級別的英語學習者,公布了隨之而來的字彙量。這些是離散度很大的觀測平均值,不是入門門檻。
| CEFR 級別 | 詞族數(實測) | 通常能應付什麼 |
|---|---|---|
| A1 | 約 1,500 以下 | 固定說法、自我介紹、當下需求 |
| A2 | 約 1,500–2,500 | 日常事務:購物、問路、簡短寒暄 |
| B1 | 約 2,750–3,250 | 熟悉話題的交談;無人協助也能旅行 |
| B2 | 約 3,250–3,750 | 討論與論證;多數媒體內容要費點力 |
| C1 | 約 3,750–4,500 | 學術與職場情境;言外之意 |
| C2 | 約 4,500–5,000+ | 幾乎完全理解;語氣與語域 |
Milton(2010),英語作為外語學習者的理解性字彙。測量工具最高只到 5,000 字檔,因此 C1 與 C2 被壓縮:C2 使用者的真實字彙量大於表格所能呈現的範圍。
為什麼「讀得懂」的門檻是 98% 而不是 95%
95% 聽起來近乎完整,其實不是:這代表每二十個字就有一個不認識,大約每行小說一個。Hu 與 Nation(2000)直接做了驗證,方法是調整小說文本中生字的密度。在 80% 涵蓋率下,幾乎沒有人能在無輔助的情況下達到足夠的理解;95% 時也只有少數人做到;到 98% 才有多數人能獨立讀懂。
之後 Schmitt、Jiang 與 Grabe(2011)用學術文本測試了 661 名學習者,發現涵蓋率與理解度之間基本呈線性關係——沒有斷崖,也沒有神奇的門檻。涵蓋率每提高一個百分點,理解度就相應增加一份。98% 是實用的規劃參考值,不是開關。
實際的讀法是:2,000–3,000 個詞族讓你能開口交談,此後每多一千個,這門語言就安靜一分——空缺更少、靠猜更少、疲勞更少。
3,000 個字要學多久?
目標一旦確定,時間就是一道除法題——而決定結果的是速度,恰恰是多數學習計畫算錯的那一項。閱讀時遇到的字大約需要 8–12 次相遇才留得住,而且這些相遇必須分散在不同日子才能存活。
所以「每天幾個字」指的不是你看到多少個,而是有多少個走完了自己的複習週期。用四種誠實的速度來算:
| 每天新字 | 每年 | 到 +1,250(A2→B1) | 從零到 3,000 |
|---|---|---|---|
| 1 | 365 | 約 3 年 5 個月 | 約 8 年 3 個月 |
| 2 | 730 | 約 1 年 8 個月 | 約 4 年 1 個月 |
| 3 | 1,095 | 約 1 年 2 個月 | 約 2 年 9 個月 |
| 5 | 1,825 | 約 8 個月 | 約 1 年 8 個月 |
這是假設不休息、不退步的純除法——而真正會垮掉的正是這個假設。每天三個字持續三年,難的不是某一天,而是連續 1,095 天都記得去做。
每天幾個字
究竟能從哪裡來
瓶頸從來不是目標,而是持續性——而持續性向既有習慣買,比向意志力買便宜得多。Reviews.org 2026 年的調查(約 1,000 名美國成年人)發現,人們每天看手機 186 次。對多數人而言,這是手上最大的一筆「重複時刻」存量。
把複習掛到習慣上
LearnScreen 透過 Apple 的螢幕使用時間 API 封鎖你指定的 App——Instagram、TikTok、X、遊戲。封鎖在系統層級運作,VPN 或 DNS 的小手段繞不過去。
每次開啟都變成一次回想
跳出來的不是 App,而是一張單字卡。答對之後,App 會解鎖一小段時間。這是主動提取——那種隔一段時間仍然留得住的相遇——而不是一眼掃過的單字表。
讓排程來挑字
萊特納式的間隔重複排程決定你看到哪個字。答錯的很快回來,熟的往後推。研究所要求的間隔安排,不需要你自己記帳就完成了。
- 18 個主題、1,080 個以上精選字彙 ——基礎、日常生活、旅行、飲食、工作、數字等,大致就是涵蓋率表中承擔最重工作的那個字頻區間。
- 11 種學習語言 ——英語、德語、西班牙語、法語、義大利語、日語、韓語、波蘭語、巴西葡萄牙語、俄語與中文(普通話)。
- 也可以加自己的字 ——任何單字都能附上譯文、音標與例句加入,進入同一輪換。
- 離線可用,免帳號。 安裝後卡片與封鎖都不需連網。免註冊、免電子郵件、免密碼;iCloud 備份使用你自己的私人資料庫。
常見問題
參考文獻
- Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
- Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438.
- Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
- Schmitt, N., Jiang, X., & Grabe, W. (2011). The percentage of words known in a text and reading comprehension. Modern Language Journal, 95(1), 26–43.
- Goulden, R., Nation, P., & Read, J. (1990). How large can a receptive vocabulary be? Applied Linguistics, 11(4), 341–363.
- Milton, J. (2010). The development of vocabulary breadth across the CEFR levels. EuroSLA Monographs 1, 211–232.
- Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report
最後查核:2026 年 7 月 28 日

