본문으로 건너뛰기
어휘 연구

외국어를 말하려면
단어를 몇 개 알아야 할까?

약 2,000~3,000개 어족이면 일상 대화의 95% 정도를 덮습니다. 대화를 이어가기에는 충분한 양입니다. 힘들이지 않고 이해하려면 더 필요합니다. 말은 6,000~7,000개 어족, 소설과 신문은 8,000~9,000개 어족입니다(Nation, 2006). 원어민은 그 몇 배를 압니다. 그래서 쓸모 있는 질문은 “단어가 몇 개나 있느냐”가 아니라, 그 처음 몇천 개가 어떤 단어이고 현실적으로 얼마나 빨리 늘릴 수 있느냐입니다.

전체 출처는 페이지 하단에

단어의 뜻을 떠올리도록 요구하는 iPhone 단어 카드

중요한 건 어휘 크기가 아니라 커버리지

연구가 묻는 것은 추상적으로 몇 단어를 아느냐가 아니라, 주어진 글이나 대화에 나오는 단어 가운데 몇 퍼센트를 이미 아느냐입니다. 이것이 어휘 커버리지입니다. 이 관점이 수치를 쓸모 있게 만듭니다. 단어 빈도는 극단적으로 치우쳐 있어서, 아주 흔한 단어의 작은 핵심 집합이 거의 모든 일을 처리하기 때문입니다.

Nation(2006)은 가장 빈번한 1,000개 어족이 말의 약 80%를 차지한다고 봅니다. 그다음 1,000개마다 수익은 점점 줄어듭니다. 좋은 소식이자 나쁜 소식입니다. 처음 2,000개 어족은 평생 배울 것 중 가장 수지맞는 투자이고, 커버리지를 95%에서 98%로 올리려면 다시 수천 개가 더 듭니다.

어족 수로 본 어휘 크기, 대응하는 어휘 커버리지, 그리고 실제로 가능한 것
아는 어족 수커버리지(대략)체감
1,000말의 약 80%쉬운 대화의 요지 파악. 다섯 단어 중 하나는 모르는 단어
2,000~3,000말의 약 95%대화가 됩니다. 빈틈은 맥락으로 메울 수 있음
6,000~7,000말의 약 98%영화·팟캐스트·빠른 말도 계속 애쓰지 않고
8,000~9,000글의 약 98%소설과 신문을 사전 없이
기본 단어 약 17,000원어민 범위교육받은 성인(Goulden, Nation & Read, 1990)

커버리지는 Nation(2006), Adolphs & Schmitt(2003) 기준. 원어민 추정치는 Goulden, Nation & Read(1990). 영어에서 측정한 값으로, 곡선의 모양은 다른 언어에서도 반복되지만 정확한 수치는 다릅니다.

“한 단어”는 무엇을 세는 것인가

위의 수치는 모두 어족(word family) 단위이며 단어형이 아닙니다. 어족은 기본 단어와 그 굴절형·규칙적 파생형을 묶은 단위입니다. 영어의 help, helps, helped, helping, helper, helpful, unhelpful은 일곱이 아니라 한 어족입니다. 어간과 접사를 알면 나머지는 대체로 예측되기 때문에 이렇게 셉니다.

  • 3,000개 어족은 3,000단어보다 훨씬 많습니다. 언어에 따라 두 배에서 네 배의 개별 형태가 됩니다. 광고의 “5,000단어 정복”과 연구의 계산은 같은 단위인 경우가 거의 없습니다.
  • 굴절이 많은 언어는 원시 숫자를 부풀립니다. 한국어·러시아어·폴란드어·핀란드어는 한 어족이 아주 많은 형태로 퍼집니다. 특정 커버리지에 필요한 어족 수는 비슷하지만, 마주치는 형태의 수는 그렇지 않습니다.
  • 이해 어휘와 표현 어휘는 다릅니다. CEFR과 커버리지 수치는 알아보는 어휘를 측정합니다. 말할 때 스스로 만들어 쓰는 어휘는 언제나 그보다 적습니다.

관련: 어족 하나를 늘리는 비용은 단어를 기억하려면 몇 번 봐야 하는가(영어)를 참고하세요.

CEFR 수준별 어휘량은?

CEFR은 무엇을 할 수 있는지를 기술할 뿐 몇 단어를 아는지는 규정하지 않으며, 수준별 공식 단어 수는 존재하지 않습니다. 대신 측정치는 있습니다. Milton(2010)은 각 수준의 영어 학습자를 검사해 함께 나타나는 어휘 크기를 발표했습니다. 편차가 큰 관측 평균이지 입학 요건이 아닙니다.

CEFR 수준별로 측정된 이해 어휘(어족 수)
CEFR 수준어족 수(측정치)보통 가능한 것
A1약 1,500 미만정형 표현, 자기소개, 당장의 필요
A2약 1,500~2,500일상 처리: 상점, 길 안내, 짧은 잡담
B1약 2,750~3,250익숙한 주제의 대화, 도움 없는 여행
B2약 3,250~3,750토론과 논증, 노력하면 대부분의 매체
C1약 3,750~4,500학술·직무 사용, 함축된 의미
C2약 4,500~5,000+거의 완전한 이해, 뉘앙스와 문체

Milton(2010), 외국어로서 영어 학습자의 이해 어휘. 측정 도구가 5,000단어대까지만 다루기 때문에 C1과 C2는 압축되어 보입니다. 실제 C2 화자의 어휘는 표가 보여줄 수 있는 것보다 큽니다.

“이해”의 기준이 95%가 아니라 98%인 이유

95%는 거의 전부처럼 들리지만 아닙니다. 스무 단어 중 하나가 모르는 단어이고, 소설이라면 한 행에 하나꼴입니다. Hu와 Nation(2000)은 소설 텍스트에서 미지 단어의 밀도를 조작해 이를 직접 검증했습니다. 커버리지 80%에서는 도움 없이 충분히 이해한 사람이 사실상 없었고, 95%에서도 소수에 그쳤으며, 98%에 이르러서야 대다수가 스스로 해냈습니다.

이후 Schmitt, Jiang, Grabe(2011)는 학술 텍스트로 661명을 검사해 커버리지와 이해도의 관계가 본질적으로 선형임을 확인했습니다. 절벽도, 마법의 임계값도 없습니다. 커버리지 1%포인트마다 이해가 비례해 늘 뿐입니다. 98%는 계획을 위한 실용적 수치이지 스위치가 아닙니다.

실용적으로 읽으면 이렇습니다. 2,000~3,000개 어족이면 대화가 되고, 그 뒤로 1,000개씩 늘 때마다 언어가 조용해집니다 — 빈틈이 줄고, 추측이 줄고, 피로가 줄어듭니다.

3,000단어는 얼마나 걸릴까

목표가 정해지면 기간은 나눗셈입니다. 그리고 결정하는 것은 속도, 곧 대부분의 계획이 잘못 잡는 바로 그 값입니다. 읽다가 만난 단어는 자리 잡기까지 대략 8~12번의 마주침이 필요하고, 그 마주침은 여러 날에 걸쳐 흩어져야 살아남습니다.

따라서 “하루 몇 단어”는 단어 수가 아니라 복습 주기를 끝낸 단어 수입니다. 정직한 네 가지 속도로 계산하면:

하루 학습 단어 수 네 가지로 본 어휘 목표까지의 소요 기간
하루 새 단어연간+1,250(A2→B1)까지0에서 3,000까지
1365약 3년 5개월약 8년 3개월
2730약 1년 8개월약 4년 1개월
31,095약 1년 2개월약 2년 9개월
51,825약 8개월약 1년 8개월

쉬는 날 0, 후퇴 0을 전제한 단순 나눗셈이며, 실제로 깨지는 것이 바로 이 전제입니다. 하루 3단어를 3년은 “힘든 하루”가 아니라 “잊지 않고 실행하는 날이 1,095일 연속”이라는 뜻입니다.

하루 몇 단어는
실제로 어디서 나올 수 있나

제약은 언제나 목표가 아니라 꾸준함입니다. 그리고 꾸준함은 의지력보다 이미 있는 습관에서 사는 편이 쌉니다. Reviews.org의 2026년 조사(미국 성인 약 1,000명)에 따르면 사람들은 하루 186번 휴대폰을 확인합니다. 대부분의 사람이 가진 가장 큰 “반복되는 순간”의 재고입니다.

1

복습을 습관에 걸어두기

LearnScreen은 사용자가 고른 앱 — Instagram, TikTok, X, 게임 — 을 Apple 스크린 타임 API로 차단합니다. 차단이 OS 수준에서 돌기 때문에 VPN이나 DNS 우회로는 빠져나갈 수 없습니다.

2

열 때마다 인출 시도가 되게

앱 대신 단어 카드가 뜹니다. 답하면 정해진 시간 동안 앱이 열립니다. 이것은 능동적 인출 — 시간이 지나도 남는 종류의 마주침 — 이지, 훑어보는 단어 목록이 아닙니다.

3

단어는 스케줄이 고르게

라이트너식 간격 반복 스케줄이 무엇을 보여줄지 정합니다. 틀린 단어는 빨리 돌아오고 아는 단어는 멀어집니다. 연구가 요구하는 간격이 따로 기록하지 않아도 지켜집니다.

  • 18개 주제, 1,080개 이상의 엄선된 단어 — 기초, 일상, 여행, 음식, 일, 숫자 등. 위 커버리지 표에서 가장 무거운 일을 하는 빈도대와 거의 일치합니다.
  • 학습 가능한 언어 11개 — 영어, 독일어, 스페인어, 프랑스어, 이탈리아어, 일본어, 한국어, 폴란드어, 브라질 포르투갈어, 러시아어, 중국어(표준어).
  • 직접 만든 단어도 — 번역·발음 표기·예문과 함께 어떤 단어든 추가할 수 있고, 같은 로테이션에 들어갑니다.
  • 오프라인, 계정 불필요. 설치 후에는 카드와 차단이 네트워크 없이 동작합니다. 가입도 이메일도 비밀번호도 없으며, iCloud 백업은 본인의 비공개 데이터베이스를 사용합니다.

한 번에 한 단어,
한 번에 몇 초

3,000단어라는 큰 합계는 아주 짧은 사건들로 이루어집니다.

차단된 앱을 대신해 번역을 묻는 단어 카드 열 때마다 복습이 시작되도록 차단할 앱과 카테고리를 고르는 화면 어휘를 쌓을 수 있는 11개 언어 충분한 복습 횟수를 채운 단어를 보여주는 진행 화면

이어서 읽기

자주 묻는 질문

외국어를 말하려면 단어를 몇 개 알아야 하나요?
일상 대화라면 약 2,000~3,000개 어족입니다. Adolphs와 Schmitt(2003)는 가장 빈번한 2,000~3,000개 어족이 일상 구어 영어의 약 95%를 차지한다고 밝혔고, Nation(2006)은 처음 1,000개만으로도 말의 약 80%로 봅니다. 대화에 참여하기에는 충분하지만 전부를 알아듣기에는 부족합니다.
유창해지려면 몇 단어가 필요한가요?
“유창함”이 무엇을 포괄해야 하느냐에 달렸습니다. Nation(2006)은 구어의 98% 커버리지에 6,000~7,000개 어족, 소설과 신문 같은 문어에 8,000~9,000개 어족으로 추정했습니다. 교육받은 영어 원어민은 기본 단어 기준 약 17,000개를 압니다(Goulden, Nation & Read, 1990). 유창한 비원어민의 어휘는 그 일부에 불과합니다.
어족이란 무엇이고 왜 단어를 세지 않나요?
어족은 기본 단어와 그 굴절형·규칙적 파생형을 묶은 단위로, help, helps, helper, helpful이 하나의 어족입니다. 하나를 배우면 나머지가 대체로 예측되기 때문에 연구는 이 단위로 셉니다. 그래서 3,000개 어족은 개별 단어형으로는 3,000개를 훨씬 넘습니다.
CEFR 각 수준은 어휘량이 얼마나 필요한가요?
Milton(2010)이 영어 학습자를 측정해 보고한 값은 대략 A1 1,500개 어족 미만, A2 1,500~2,500, B1 2,750~3,250, B2 3,250~3,750, C1 3,750~4,500, C2 4,500~5,000입니다. 개인차가 큰 관측 이해 어휘이며, 검사가 5,000단어대에서 멈추기 때문에 상위 수준은 압축되어 보입니다. CEFR 자체는 공식 단어 수를 정하지 않습니다.
3,000단어를 익히는 데 얼마나 걸리나요?
하루 1단어면 약 8년, 하루 3단어면 약 2년 9개월, 하루 5단어면 1년 8개월입니다. 기간을 정하는 것은 속도이고, 속도를 제한하는 것은 간격을 둔 인출 시도를 실제로 몇 번 끝내느냐입니다. 읽다가 만난 단어 기준으로 하나당 8~12번 정도입니다.
공부 시간 없이 어휘를 쌓을 수 있나요?
가능합니다. 단, 반복을 이미 반복하고 있는 행동에 붙였을 때입니다. Reviews.org의 2026년 조사(미국 성인 약 1,000명)에서는 하루 186번 휴대폰을 확인합니다. LearnScreen은 Apple 스크린 타임 API로 선택한 앱을 차단하고 열 때 카드를 띄우므로, 인출 시도가 원래 하던 휴대폰 사용 안에 쌓입니다.

출처

  1. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  2. Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438.
  3. Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
  4. Schmitt, N., Jiang, X., & Grabe, W. (2011). The percentage of words known in a text and reading comprehension. Modern Language Journal, 95(1), 26–43.
  5. Goulden, R., Nation, P., & Read, J. (1990). How large can a receptive vocabulary be? Applied Linguistics, 11(4), 341–363.
  6. Milton, J. (2010). The development of vocabulary breadth across the CEFR levels. EuroSLA Monographs 1, 211–232.
  7. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

최종 확인: 2026년 7월 28일

처음 2,000개부터
시작하세요

계정 불필요. 오프라인 동작. 다음번에 차단된 앱을 열면 그만큼 한 단어 더 가까워집니다.

iOS용 다운로드