Chuyển tới nội dung
Nghiên cứu về từ vựng

Cần bao nhiêu từ vựng
để nói được một ngôn ngữ?

Khoảng 2.000–3.000 họ từ bao phủ chừng 95% một cuộc hội thoại hằng ngày — đủ để duy trì cuộc trò chuyện. Hiểu mà không phải gắng sức thì đắt hơn: 6.000–7.000 họ từ cho tiếng nói và 8.000–9.000 cho tiểu thuyết, báo chí (Nation, 2006). Người bản ngữ biết gấp nhiều lần con số đó, và chính vì vậy câu hỏi hữu ích không phải "có bao nhiêu từ" mà là vài nghìn từ đầu tiên gồm những từ nào — và thực tế ta thêm được chúng nhanh đến đâu.

Nguồn đầy đủ ở cuối trang

Thẻ từ vựng trên iPhone yêu cầu nhớ lại nghĩa của một từ

Điều quyết định là độ bao phủ, không phải kích thước vốn từ

Nghiên cứu không hỏi bạn biết bao nhiêu từ một cách trừu tượng, mà hỏi trong một văn bản hay cuộc trò chuyện cụ thể, bạn đã biết bao nhiêu phần trăm số từ — tức độ bao phủ từ vựng. Chính cách đặt vấn đề này làm các con số trở nên dùng được, bởi tần suất từ phân bố cực kỳ lệch: một nhóm nhỏ các từ rất phổ biến gánh gần như toàn bộ công việc.

Nation (2006) đặt 1.000 họ từ thông dụng nhất ở mức khoảng 80% tiếng nói. Mỗi nghìn tiếp theo mang lại ít hơn. Đây vừa là tin tốt vừa là tin xấu: 2.000 họ từ đầu tiên là khoản đầu tư hời nhất bạn từng học, còn leo từ 95% lên 98% độ bao phủ thì tốn thêm vài nghìn từ nữa.

Kích thước vốn từ theo họ từ, độ bao phủ tương ứng và ý nghĩa trong thực tế
Họ từ đã biếtBao phủ ~Cảm giác thế nào
1.000~80% lời nóiNắm ý chính của một cuộc trò chuyện đơn giản; cứ năm từ có một từ lạ
2.000–3.000~95% lời nóiTrò chuyện được; chỗ trống đoán được từ ngữ cảnh
6.000–7.000~98% lời nóiPhim, podcast và người nói nhanh mà không phải căng sức liên tục
8.000–9.000~98% văn bảnTiểu thuyết và báo chí không cần từ điển
~17.000 từ gốcNgưỡng bản ngữNgười trưởng thành có học vấn (Goulden, Nation & Read, 1990)

Số liệu bao phủ từ Nation (2006) và Adolphs & Schmitt (2003); ước lượng bản ngữ từ Goulden, Nation & Read (1990). Đo trên tiếng Anh: hình dạng đường cong lặp lại ở các ngôn ngữ khác, còn con số chính xác thì không.

Thế nào là "một từ"?

Mọi con số phía trên đều tính theo họ từ, không phải dạng thức từ. Một họ từ gồm từ gốc cùng các biến thể và phái sinh có quy tắc: trong tiếng Anh, help, helps, helped, helping, helper, helpful, unhelpful là một họ, không phải bảy từ. Người ta đếm như vậy vì khi đã nắm gốc từ và phụ tố, phần còn lại phần lớn có thể suy ra.

  • 3.000 họ từ nhiều hơn 3.000 từ rất nhiều. Tùy ngôn ngữ, có thể gấp hai đến bốn lần số dạng thức khác nhau. Khẩu hiệu quảng cáo "học 5.000 từ" và cách đếm trong nghiên cứu gần như không bao giờ cùng một đơn vị.
  • Ngôn ngữ biến hình mạnh làm phồng con số thô. Tiếng Nga, Ba Lan, Phần Lan và Hàn trải một họ từ ra rất nhiều dạng thức; số họ từ cần cho một mức bao phủ vẫn so sánh được, nhưng số dạng thức bạn gặp thì không.
  • Vốn từ tiếp nhận và vốn từ chủ động là hai chuyện khác nhau. Các con số CEFR và độ bao phủ đo cái bạn nhận ra. Cái bạn tự bật ra khi nói luôn ít hơn.

Liên quan: chi phí để thêm một họ từ vào tổng số đó — cần gặp một từ bao nhiêu lần để nhớ được (tiếng Anh).

Mỗi bậc CEFR cần bao nhiêu từ?

CEFR mô tả bạn làm được gì, chứ không phải bạn biết bao nhiêu từ: không có con số chính thức cho từng bậc. Nhưng có các phép đo. Milton (2010) khảo sát người học tiếng Anh ở mỗi bậc và công bố kích thước vốn từ đi kèm. Đây là trung bình quan sát được với độ phân tán lớn, không phải điều kiện đầu vào.

Vốn từ tiếp nhận đo được theo họ từ, phân theo bậc CEFR
Bậc CEFRHọ từ (đo được)Thường đủ để làm gì
A1dưới ~1.500Cụm cố định, giới thiệu bản thân, nhu cầu trước mắt
A2~1.500–2.500Việc thường ngày: cửa hàng, hỏi đường, trò chuyện ngắn
B1~2.750–3.250Trò chuyện về chủ đề quen thuộc; đi lại không cần trợ giúp
B2~3.250–3.750Thảo luận và lập luận; phần lớn báo đài nhưng phải cố
C1~3.750–4.500Dùng trong học thuật và nghề nghiệp; hiểu hàm ý
C2~4.500–5.000+Hiểu gần như trọn vẹn; sắc thái và văn phong

Milton (2010), vốn từ tiếp nhận của người học tiếng Anh như ngoại ngữ. Công cụ đo chỉ tới dải 5.000 từ nên C1 và C2 bị nén lại: vốn từ thực của người ở bậc C2 lớn hơn những gì bảng có thể thể hiện.

Vì sao ngưỡng "hiểu được" là 98% chứ không phải 95%

95% nghe như gần trọn vẹn. Thực ra không: nó nghĩa là cứ hai mươi từ có một từ lạ, tức khoảng một từ mỗi dòng tiểu thuyết. Hu và Nation (2000) kiểm chứng trực tiếp bằng cách thay đổi mật độ từ lạ trong một văn bản hư cấu. Ở mức bao phủ 80%, gần như không ai đạt được mức hiểu đủ mà không cần trợ giúp; ở 95% chỉ một thiểu số làm được; và 98% là điểm mà đa số tự xoay xở được.

Sau đó Schmitt, Jiang và Grabe (2011) khảo sát 661 người học trên các văn bản học thuật và thấy quan hệ giữa độ bao phủ và mức hiểu về cơ bản là tuyến tính — không có vực, cũng không có ngưỡng thần kỳ. Mỗi điểm phần trăm bao phủ mua về một lượng hiểu tương ứng. Vậy 98% là con số thực dụng để lập kế hoạch, không phải một công tắc.

Cách đọc thực dụng: với 2.000–3.000 họ từ bạn đã trò chuyện được, và mỗi nghìn tiếp theo khiến ngôn ngữ đó lặng đi — ít chỗ trống hơn, ít phải đoán hơn, ít mệt hơn.

3.000 từ mất bao lâu?

Khi mục tiêu đã rõ, thời gian chỉ còn là phép chia — và thứ quyết định là tốc độ, đúng cái biến mà phần lớn kế hoạch học tính sai. Một từ gặp trong lúc đọc cần chừng 8–12 lần chạm mặt mới bám lại, và những lần đó phải trải ra nhiều ngày mới sống sót.

Vậy nên "bao nhiêu từ mỗi ngày" không phải số từ bạn nhìn thấy, mà là số từ hoàn tất chu kỳ ôn tập của chúng. Tính toán với bốn tốc độ trung thực:

Thời gian đạt các mục tiêu từ vựng ở bốn tốc độ số từ học được mỗi ngày
Từ mới/ngàyMỗi nămĐến +1.250 (A2→B1)Đến 3.000 từ số 0
1365~3 năm 5 tháng~8 năm 3 tháng
2730~1 năm 8 tháng~4 năm 1 tháng
31.095~1 năm 2 tháng~2 năm 9 tháng
51.825~8 tháng~1 năm 8 tháng

Phép chia thuần túy với giả định không nghỉ ngày nào và không thụt lùi — và chính giả định đó mới là thứ gãy. Ba từ mỗi ngày trong ba năm không phải một ngày nặng nhọc, mà là 1.095 ngày liên tiếp bạn nhớ ra để làm.

Vài từ mỗi ngày
thực sự có thể đến từ đâu

Ràng buộc chưa bao giờ là mục tiêu, mà là sự đều đặn — và sự đều đặn mua từ một thói quen sẵn có thì rẻ hơn mua từ ý chí. Khảo sát Reviews.org năm 2026 (khoảng 1.000 người trưởng thành ở Mỹ) cho thấy người ta nhìn điện thoại 186 lần mỗi ngày. Đó là kho "khoảnh khắc lặp lại" lớn nhất mà hầu hết mọi người đang có.

1

Móc phần ôn tập vào một thói quen

LearnScreen chặn các ứng dụng bạn chọn — Instagram, TikTok, X, game — thông qua Screen Time API của Apple. Việc chặn chạy ở mức hệ điều hành nên không mẹo VPN hay DNS nào lách được.

2

Mỗi lần mở là một lần thử nhớ lại

Thay vì ứng dụng, một thẻ từ vựng hiện ra. Trả lời xong, ứng dụng mở khóa trong một khoảng thời gian. Đây là truy hồi chủ động — kiểu chạm mặt sống sót qua độ trễ — chứ không phải một danh sách từ lướt mắt qua.

3

Để lịch trình chọn từ

Lịch lặp lại ngắt quãng kiểu Leitner quyết định bạn thấy từ nào. Từ sai quay lại nhanh, từ đã thuộc thì giãn ra. Khoảng cách mà nghiên cứu đòi hỏi diễn ra mà bạn không phải ghi chép gì.

  • Hơn 1.080 từ được tuyển chọn trong 18 chủ đề — Cơ bản, Đời sống hằng ngày, Du lịch, Ẩm thực, Công việc, Số đếm và nhiều chủ đề khác: gần đúng dải tần suất gánh phần việc nặng nhất trong bảng bao phủ ở trên.
  • 11 ngôn ngữ để học — Anh, Đức, Tây Ban Nha, Pháp, Ý, Nhật, Hàn, Ba Lan, Bồ Đào Nha (Brazil), Nga và Trung (phổ thông).
  • Thêm cả từ của riêng bạn — nhập bất kỳ từ nào kèm bản dịch, phiên âm và câu ví dụ; nó vào cùng một vòng luân phiên.
  • Ngoại tuyến, không cần tài khoản. Sau khi cài, thẻ và phần chặn chạy được mà không cần mạng. Không đăng ký, không email, không mật khẩu; bản sao lưu iCloud dùng cơ sở dữ liệu riêng tư của chính bạn.

Mỗi lần một từ,
mỗi lần vài giây

Ba nghìn từ là một tổng số lớn được ghép từ những sự kiện rất ngắn.

Thẻ từ vựng thay chỗ ứng dụng bị chặn và hỏi bản dịch Chọn ứng dụng và danh mục cần chặn để mỗi lần mở đều kích hoạt một lượt ôn Mười một ngôn ngữ có sẵn để xây vốn từ Màn hình tiến độ với những từ đã tích đủ số lần ôn

Đọc thêm

Câu hỏi thường gặp

Cần biết bao nhiêu từ để nói được một ngôn ngữ?
Với hội thoại hằng ngày, khoảng 2.000–3.000 họ từ. Adolphs và Schmitt (2003) thấy 2.000–3.000 họ từ thông dụng nhất chiếm khoảng 95% tiếng Anh nói thường ngày, còn Nation (2006) đặt riêng 1.000 họ đầu tiên ở mức khoảng 80% lời nói. Đủ để tham gia trò chuyện — chưa đủ để nghe hiểu mọi thứ.
Cần bao nhiêu từ để nói trôi chảy?
Tùy vào "trôi chảy" phải bao gồm những gì. Nation (2006) ước tính 6.000–7.000 họ từ cho mức bao phủ 98% tiếng nói và 8.000–9.000 cho văn bản viết như tiểu thuyết và báo. Người bản ngữ tiếng Anh có học vấn biết khoảng 17.000 từ gốc (Goulden, Nation & Read, 1990) — vốn từ của người không bản ngữ nói trôi chảy chỉ là một phần nhỏ trong đó.
Họ từ là gì và vì sao không đếm từng từ?
Họ từ là từ gốc cùng các biến thể và phái sinh có quy tắc — help, helps, helper, helpful tạo thành một họ. Nghiên cứu đếm như vậy vì học được một thành viên thì các thành viên còn lại phần lớn suy ra được. Do đó 3.000 họ từ tương ứng với số dạng thức khác nhau nhiều hơn 3.000 khá xa.
Mỗi bậc CEFR đòi hỏi bao nhiêu từ?
Milton (2010) đo người học tiếng Anh và báo cáo xấp xỉ: A1 dưới 1.500 họ từ, A2 1.500–2.500, B1 2.750–3.250, B2 3.250–3.750, C1 3.750–4.500, C2 4.500–5.000. Đây là vốn từ tiếp nhận quan sát được với khác biệt cá nhân rất lớn, và bài kiểm tra dừng ở dải 5.000 nên các bậc cao trông bị nén lại. Bản thân CEFR không ấn định con số chính thức nào.
Học 3.000 từ mất bao lâu?
Mỗi ngày một từ mới thì khoảng tám năm; mỗi ngày ba từ thì khoảng hai năm chín tháng; mỗi ngày năm từ thì một năm tám tháng. Tốc độ quyết định mốc thời gian, và tốc độ bị giới hạn bởi số lần truy hồi ngắt quãng bạn thực sự hoàn thành — cỡ 8–12 lần chạm mặt cho mỗi từ gặp trong lúc đọc.
Có thể xây vốn từ mà không cần buổi học không?
Có, nếu phần lặp lại được móc vào thứ bạn vốn đã lặp đi lặp lại. Khảo sát Reviews.org năm 2026 (khoảng 1.000 người trưởng thành ở Mỹ) ghi nhận 186 lần nhìn điện thoại mỗi ngày. LearnScreen dùng Screen Time API của Apple để chặn các ứng dụng đã chọn và hiện thẻ khi bạn mở, nhờ vậy số lần truy hồi tích lũy ngay bên trong thói quen dùng điện thoại vốn có.

Nguồn

  1. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  2. Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438.
  3. Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
  4. Schmitt, N., Jiang, X., & Grabe, W. (2011). The percentage of words known in a text and reading comprehension. Modern Language Journal, 95(1), 26–43.
  5. Goulden, R., Nation, P., & Read, J. (1990). How large can a receptive vocabulary be? Applied Linguistics, 11(4), 341–363.
  6. Milton, J. (2010). The development of vocabulary breadth across the CEFR levels. EuroSLA Monographs 1, 211–232.
  7. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

Rà soát lần cuối: 28 tháng 7 năm 2026.

Bắt đầu từ
hai nghìn từ đầu tiên

Không cần tài khoản. Chạy ngoại tuyến. Lần tới bạn mở một ứng dụng bị chặn, đó là thêm một từ gần hơn.

Tải cho iOS