Какие слова
учить первыми?
Первая 1 000 семей слов покрывает около 72 % письменного текста и больше 80 % устной речи, тогда как десятая тысяча даёт меньше процентного пункта (Нейшн и Уоринг, 1997; Нейшн, 2006). Значит, выбор слов весит больше выбора метода, и порядок здесь не дело вкуса: пройдите первые 2 000–3 000 семей, а затем работайте со среднечастотными диапазонами от 4 000 до 9 000, которые Шмитт и Шмитт (2014) описывают как слишком редкие, чтобы закрепиться от контакта, и слишком частые, чтобы их пропустить. После этого лучшее следующее слово — то, которое вам только что понадобилось и которого у вас не было.
Каждая цифра ниже подтверждена источником внизу страницы

Частотность слов распределена крайне неравномерно
Большинство советов обращается со словарным запасом как с кучей, которую надо разобрать, будто любая тысяча слов стоит примерно столько же, сколько любая другая. Языки устроены не так. Частотность подчиняется очень крутому степенному закону — тому самому распределению, которое описал Ципф (1949), — где горстка слов отвечает почти за всё сказанное и написанное, а остальное растягивается в очень длинный хвост.
Практическое следствие: диапазоны невзаимозаменяемы. Каждая строка ниже — это тысяча семей слов в порядке частотности и то, что этот диапазон добавляет к вашему покрытию обычного письменного текста.
| Частотный диапазон | Покрытие, которого достигает | Что в нём лежит |
|---|---|---|
| Первая 1 000 семей | Около 72 % письменного текста и больше 80 % устной речи | Служебные слова и повседневные глаголы и существительные, из которых собирается любое предложение — самый выгодный блок, который вы когда-либо выучите |
| Вторая тысяча | Доводит примерно до 80 % | Ещё около 8 пунктов за то же число слов: по-прежнему обиходная лексика, по-прежнему ничего, что разумно было бы пропустить |
| Третья тысяча | Доводит примерно до 84 % | Ещё около 4 пунктов: последний диапазон, который платит целыми процентами, и конец того, что Шмитт и Шмитт (2014) называют высокочастотной лексикой |
| С четвёртой по девятую тысячу | Ведёт от 84 % к 98 % | Среднечастотная зона: один-два пункта на диапазон, слишком редко, чтобы встречаться часто, слишком обиходно, чтобы выпустить |
| За десятой тысячей | Меньше одного пункта на тысячу | Хвост Ципфа: десятки тысяч слов, которые вы встретите один раз за годы чтения, и ни одно из них не срочное |
Цифры покрытия относятся к письменному тексту и взяты у Нейшна и Уоринга (1997) и Нейшна (2006); у устной речи они выше в нижних диапазонах и ниже в верхних, потому что разговор переиспользует меньшее ядро. Это цифры для английского: языки с более богатой словоизменительной системой распределяются иначе, поскольку одна семья слов покрывает там больше отдельных форм. На любой язык переносятся не точные проценты, а форма кривой — крутая в начале и почти плоская к десятой тысяче.
Три разных списка называют «словами, которые надо выучить»
Споры о том, какую лексику зубрить, обычно ведут люди, держащие в руках три разных списка и называющие все три одним словом. Это не соперники, а этапы, и каждый прав в своём месте.
- Частотный список. Слова, упорядоченные по тому, как часто они встречаются в большом корпусе. Объективный, безличный и непобедимый до третьей тысячи, потому что эти слова есть во всём, что вы когда-либо прочитаете или услышите. Его слабость в том, что он ничего не знает о вас — и это начинает иметь значение только тогда, когда слова перестают быть настолько частыми, что их невозможно обойти.
- Тематический или учебниковый список. Слова, сгруппированные по ситуации: аэропорт, ресторан, офис. Полезен для очерченной и близкой задачи и удобен в руках, но слеп к частотности: тематический список с удовольствием выучит вам редкое существительное раньше обиходного глагола, а слова одного смыслового поля, поданные вместе, мешают друг другу, пока ещё новы.
- Ваши собственные слова. Те, которые вы посмотрели, потому что хотели понять или сказать что-то конкретное. У них есть реальное преимущество при кодировании — Лауфер и Хюлстейн (2001) обнаружили, что слово, которое вам понадобилось, которое вы искали и значение которого выбирали сами, удерживается лучше поданного готовым, — но приходят они вообще без всякого порядка и, оставленные сами по себе, тянут в сторону редкого.
Соседний вопрос, сколько слов получится всего исходя из цели и уровня CEFR: сколько слов нужно, чтобы говорить на языке.
Что делает слово достойным следующей встречи
Каждая встреча стоит одних и тех же нескольких секунд, поэтому единственный значимый вопрос — что эти секунды покупают. Каждая строка — это свойство, меняющее ценность слова, то, что говорит о нём исследование, и то, как его применять, не ведя таблиц.
| Что проверяете | Что говорит исследование | Как это выглядит |
|---|---|---|
| В каком диапазоне лежит | Нейшн и Уоринг (1997); Нейшн (2006): первые три тысячи покупают покрытие целыми пунктами, последующие — долями | Сначала пройдите высокочастотное ядро: никакая цель этот порядок не меняет, потому что это факт о языке, а не о вас |
| Доставит ли его контакт с языком | Шмитт и Шмитт (2014); Кобб (2007): среднечастотные слова слишком редки, чтобы одно чтение дало достаточно встреч | Слова с 4 000 по 9 000 — это то, ради чего намеренное повторение вообще существует; первую тысячу вы встретите и так |
| Встречается ли в том, что вы потребляете | Уэбб и Роджерс (2009): около 3 000 семей покрывают 95 % телевидения, 7 000 покрывают 98 % | Выше третьей тысячи то, что вы реально смотрите и читаете, отбирает лучше общего корпусного рейтинга |
| Понадобилось ли оно вам самим | Лауфер и Хюлстейн (2001): потребность, поиск и взвешивание повышают удержание независимо от контакта | Слово, которое вы посмотрели, чтобы что-то сказать, приходит наполовину закодированным; оставьте его, но рядом с ядром, а не вместо него |
| Почти ли оно бесплатное | Де Гроот и Кейзер (2000): когнаты усваивались быстрее и забывались медленнее сопоставимых не-когнатов | Пропускайте те когнаты, которыми уже умеете пользоваться, но оставляйте ложных друзей — их так же легко выучить неправильно |
| Сколько оно тянет за собой | Бауэр и Нейшн (1993): один член семьи делает свои формы и регулярные производные в основном предсказуемыми | Корневое слово стоит больше производного: выучив помогать, вы в придачу получаете помощь, помощник, полезный |
О предпочтениях говорит только четвёртая строка. Остальные пять говорят о структуре языка и о структуре того, что вы потребляете, и именно поэтому отбор — это рычаг, который можно потянуть, ничего не зная о собственной психологии. Обратите внимание и на то, чего здесь нет: насколько слово интересное, насколько красиво звучит и попалось ли оно в том уроке, на котором вы случайно оказались.
Проблема среднечастотной лексики
Шмитт и Шмитт (2014) выдвинули предложение, которое звучит канцелярски, но таковым не является. Они делят словарный запас на высокочастотный — первые 3 000 семей, которым учит любой курс, — низкочастотный за пределами примерно 9 000, которому не учит никто и который никому не нужен, и среднюю зону между ними, у которой не было названия и, во многом поэтому, не было и плана. Их мысль в том, что именно там большинство тихо останавливается: она лежит между «следить за разговором» и «читать роман без словаря» и в несколько раз больше того ядра, на котором все сосредоточены.
Трудным этот диапазон делает зажим между двумя механизмами. Он слишком редок, чтобы контакт справился: слову нужно порядка восьми-двенадцати разнесённых встреч, чтобы остаться (Нейшн и Ван, 1999; Уэбб, 2007), а слово из седьмой тысячи попросту не появляется столько раз в том, что вы читаете для удовольствия. Кобб (2007) смоделировал ровно это, прогнав большие объёмы текста через симуляцию попутного усвоения, и обнаружил, что одно только чтение оставляет большую часть средних диапазонов невыученной, сколько ни читай. И он слишком обиходен, чтобы его пропустить, потому что именно эти слова составляют разницу между 84 % покрытия и теми 98 %, которые Ху и Нейшн (2000) связывают с пониманием без посторонней помощи.
Этот зажим и есть практический аргумент в пользу намеренного разнесённого повторения, и он на удивление точен насчёт того, где усилию место. Первая тысяча почти не нуждается в помощи: вы встречаете её постоянно в любом входящем материале. Хвост за десятью тысячами тоже не нуждается в помощи, потому что он не срочен. Среднечастотная зона — единственное место, где встреча не происходит сама собой и где слово при этом того стоит, что равнозначно утверждению: ценность системы повторения почти целиком зависит от того, какие слова вы в неё кладёте.
Где заканчивается каждый источник слов
Любой способ выбирать слова работает какое-то время, а потом перестаёт. Знать точку остановки полезнее, чем иметь любимый способ, потому что провал редко бывает от того, что метод был неверным: он бывает от того, что метод удержали за той точкой, где он ещё подходил.
На последней строке стоит большинство, само того не заметив.
| Источник | Что даёт | Где заканчивается |
|---|---|---|
| Общий частотный список | Ядро в правильном порядке, быстрее любого другого способа | Около третьей тысячи, где рейтинг перестаёт совпадать с вашим материалом и слова начинают казаться произвольными |
| Курс или тематический список | Очерченную ситуацию и достаточно структуры, чтобы продолжать | Как только вам понадобится что-то за пределами темы — да и упорядочен по частотности он всё равно никогда не был |
| Чтение и просмотр | Повторяющиеся контекстные встречи с высокочастотным ядром, без затрат усилия | В среднечастотных диапазонах, где Кобб (2007) обнаружил, что встречи попросту слишком редки, чтобы довести дело до конца |
| Слова, которые вы собираете сами | Высокую вовлечённость и идеальную релевантность тому, что вы хотели сказать | Нигде — но это тянет в сторону редкого и неупорядоченного, поэтому работает как дополнение и проваливается как весь план |
Сквозная картина по этим четырём строкам такова: ни один источник не покрывает весь диапазон, и среднечастотная полоса — та, что проваливается между ними всеми: слишком высока для списка новичка, слишком низка для ваших собственных запросов, слишком редка, чтобы её доставил входящий материал. Этой полосе нужен не лучший источник, а больше разнесённых встреч, чем даёт обычная жизнь: как часто повторять слова.
Потратить секунды на правильные слова
Если отбор — это рычаг, то задача системы — ставить выбранное слово перед вами достаточно часто, не прося вас ничего планировать. LearnScreen использует момент, который у вас уже есть — движение за телефоном, — так что усилие уходит на решение о том, какие слова, а не на поиск времени для них.
Список уже упорядочен
Больше 1 080 отобранных слов в 18 темах, упорядоченных так, что повседневное ядро идёт раньше специальной лексики, а не в том порядке, в каком её случайно ввёл параграф учебника. Одиннадцать языков доступны как изучаемые.
Ваши слова лежат рядом
Неограниченное число своих слов с переводом, транскрипцией и примером — те среднечастотные и лично необходимые слова, которых не предугадает ни один общий список, в одной очереди с ядром, а не в блоке, который вы перестаёте открывать.
Встречи приходят сами
Телефон проверяют около 186 раз в день, примерно 11,6 раза за час бодрствования (Reviews.org, 2026). Через API Экранного времени Apple LearnScreen блокирует выбранные вами приложения и ставит слово туда, где была бы лента, так что встречи, нужные редкому слову, происходят без планирования.
- Порядок возвращения определяет система Лейтнера. Слова с ошибкой возвращаются раньше, а верные разводятся геометрически, и именно это превращает длинный список в посильное число ежедневных встреч.
- Дозу задаёте вы. От 3 до 20 слов за подход, равно как и то, как часто возвращается блокировка; при настройках по умолчанию выходит около 25 попыток припоминания в день, примерно две с половиной минуты вразбивку.
- Ответ скрыт, пока вы не нажмёте. Каждая карточка — это попытка припоминания, а не чтение, и переносится именно направление: активный и пассивный словарь.
- Работает офлайн, без аккаунта. Карточки и блокировки работают без сети, как только приложение установлено; резервная копия iCloud пишется в вашу собственную приватную базу, а не на наши серверы, и регистрироваться не нужно.
Читать дальше
- Сколько слов нужно, чтобы говорить на языке? — Размер всей задачи по цели и уровню CEFR.
- Сколько слов в день? — Темп, которым проходится выбранный список.
- Учить слова в контексте? — Что писать на карточке, когда слово уже выбрано.
- Как часто повторять слова? — Интервалы, нужные редкому слову, чтобы выжить.
- Работает ли пассивное обучение? — Что даёт один контакт с языком и где он кончается.
- Почему я забываю выученные слова? — Что происходит со словом между двумя встречами.
Частые вопросы
Источники
- Nation, I. S. P., & Waring, R. (1997). Vocabulary size, text coverage and word lists. In N. Schmitt & M. McCarthy (Eds.), Vocabulary: Description, Acquisition and Pedagogy (pp. 6–19). Cambridge University Press.
- Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
- Schmitt, N., & Schmitt, D. (2014). A reassessment of frequency and vocabulary size in L2 vocabulary teaching. Language Teaching, 47(4), 484–503.
- Zipf, G. K. (1949). Human Behavior and the Principle of Least Effort. Addison-Wesley.
- Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438.
- Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
- Laufer, B., & Ravenhorst-Kalovski, G. C. (2010). Lexical threshold revisited: Lexical text coverage, learners’ vocabulary size and reading comprehension. Reading in a Foreign Language, 22(1), 15–30.
- Webb, S., & Rodgers, M. P. H. (2009). Vocabulary demands of television programs. Language Learning, 59(2), 335–366.
- van Zeeland, H., & Schmitt, N. (2013). Lexical coverage in L1 and L2 listening comprehension: The same or different from reading comprehension? Applied Linguistics, 34(4), 457–479.
- Cobb, T. (2007). Computing the vocabulary demands of L2 reading. Language Learning & Technology, 11(3), 38–63.
- Laufer, B., & Hulstijn, J. (2001). Incidental vocabulary acquisition in a second language: The construct of task-induced involvement. Applied Linguistics, 22(1), 1–26.
- de Groot, A. M. B., & Keijzer, R. (2000). What is hard to learn is easy to forget: The roles of word concreteness, cognate status, and word frequency. Language Learning, 50(1), 1–56.
- Brysbaert, M., Stevens, M., Mandera, P., & Keuleers, E. (2016). How many words do we know? Frontiers in Psychology, 7, 1116.
- Bauer, L., & Nation, P. (1993). Word families. International Journal of Lexicography, 6(4), 253–279.
- Schmitt, N., Jiang, X., & Grabe, W. (2011). The percentage of words known in a text and reading comprehension. Modern Language Journal, 95(1), 26–43.
- Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
- Webb, S. (2007). The effects of repetition on vocabulary knowledge. Applied Linguistics, 28(1), 46–65.
- Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report
Цифры покрытия — это корпусная статистика для английского, и точные значения смещаются вместе с корпусом, типом текста и подсчитываемой единицей: семьи слов, леммы и словоформы дают для одного и того же текста разные числа. Языки с более богатым словоизменением или продуктивным словосложением распределяются иначе, поэтому конкретные проценты стоит считать английскими, а форму кривой — общей. Шмитт, Цзян и Грейб (2011) к тому же обнаружили, что связь покрытия с пониманием в основном линейна и не является обрывом, так что 95 % и 98 % — полезные ориентиры, а не пороги, на которых включается понимание. Число карточек и дневные суммы — это арифметика исходя из попытки припоминания примерно в двадцать секунд, а не измеренные данные приложения.
Поставьте нужные слова туда, где вы их увидите
LearnScreen держит отобранное ядро и ваши собственные слова в одной разнесённой очереди и подаёт их в тот момент, когда вы тянетесь к телефону — так что слова, которые обычная жизнь никогда не повторяет достаточно часто, всё же получают свои встречи.
Скачать в App Store
