К содержанию
Исследования частотности

Какие слова
учить первыми?

Первая 1 000 семей слов покрывает около 72 % письменного текста и больше 80 % устной речи, тогда как десятая тысяча даёт меньше процентного пункта (Нейшн и Уоринг, 1997; Нейшн, 2006). Значит, выбор слов весит больше выбора метода, и порядок здесь не дело вкуса: пройдите первые 2 000–3 000 семей, а затем работайте со среднечастотными диапазонами от 4 000 до 9 000, которые Шмитт и Шмитт (2014) описывают как слишком редкие, чтобы закрепиться от контакта, и слишком частые, чтобы их пропустить. После этого лучшее следующее слово — то, которое вам только что понадобилось и которого у вас не было.

Каждая цифра ниже подтверждена источником внизу страницы

Карточка со словом на экране блокировки iPhone в момент открытия заблокированного приложения

Частотность слов распределена крайне неравномерно

Большинство советов обращается со словарным запасом как с кучей, которую надо разобрать, будто любая тысяча слов стоит примерно столько же, сколько любая другая. Языки устроены не так. Частотность подчиняется очень крутому степенному закону — тому самому распределению, которое описал Ципф (1949), — где горстка слов отвечает почти за всё сказанное и написанное, а остальное растягивается в очень длинный хвост.

Практическое следствие: диапазоны невзаимозаменяемы. Каждая строка ниже — это тысяча семей слов в порядке частотности и то, что этот диапазон добавляет к вашему покрытию обычного письменного текста.

Последовательные диапазоны по тысяче в порядке частотности, покрытие каждого и его содержимое
Частотный диапазонПокрытие, которого достигаетЧто в нём лежит
Первая 1 000 семейОколо 72 % письменного текста и больше 80 % устной речиСлужебные слова и повседневные глаголы и существительные, из которых собирается любое предложение — самый выгодный блок, который вы когда-либо выучите
Вторая тысячаДоводит примерно до 80 %Ещё около 8 пунктов за то же число слов: по-прежнему обиходная лексика, по-прежнему ничего, что разумно было бы пропустить
Третья тысячаДоводит примерно до 84 %Ещё около 4 пунктов: последний диапазон, который платит целыми процентами, и конец того, что Шмитт и Шмитт (2014) называют высокочастотной лексикой
С четвёртой по девятую тысячуВедёт от 84 % к 98 %Среднечастотная зона: один-два пункта на диапазон, слишком редко, чтобы встречаться часто, слишком обиходно, чтобы выпустить
За десятой тысячейМеньше одного пункта на тысячуХвост Ципфа: десятки тысяч слов, которые вы встретите один раз за годы чтения, и ни одно из них не срочное

Цифры покрытия относятся к письменному тексту и взяты у Нейшна и Уоринга (1997) и Нейшна (2006); у устной речи они выше в нижних диапазонах и ниже в верхних, потому что разговор переиспользует меньшее ядро. Это цифры для английского: языки с более богатой словоизменительной системой распределяются иначе, поскольку одна семья слов покрывает там больше отдельных форм. На любой язык переносятся не точные проценты, а форма кривой — крутая в начале и почти плоская к десятой тысяче.

Три разных списка называют «словами, которые надо выучить»

Споры о том, какую лексику зубрить, обычно ведут люди, держащие в руках три разных списка и называющие все три одним словом. Это не соперники, а этапы, и каждый прав в своём месте.

  • Частотный список. Слова, упорядоченные по тому, как часто они встречаются в большом корпусе. Объективный, безличный и непобедимый до третьей тысячи, потому что эти слова есть во всём, что вы когда-либо прочитаете или услышите. Его слабость в том, что он ничего не знает о вас — и это начинает иметь значение только тогда, когда слова перестают быть настолько частыми, что их невозможно обойти.
  • Тематический или учебниковый список. Слова, сгруппированные по ситуации: аэропорт, ресторан, офис. Полезен для очерченной и близкой задачи и удобен в руках, но слеп к частотности: тематический список с удовольствием выучит вам редкое существительное раньше обиходного глагола, а слова одного смыслового поля, поданные вместе, мешают друг другу, пока ещё новы.
  • Ваши собственные слова. Те, которые вы посмотрели, потому что хотели понять или сказать что-то конкретное. У них есть реальное преимущество при кодировании — Лауфер и Хюлстейн (2001) обнаружили, что слово, которое вам понадобилось, которое вы искали и значение которого выбирали сами, удерживается лучше поданного готовым, — но приходят они вообще без всякого порядка и, оставленные сами по себе, тянут в сторону редкого.

Соседний вопрос, сколько слов получится всего исходя из цели и уровня CEFR: сколько слов нужно, чтобы говорить на языке.

Что делает слово достойным следующей встречи

Каждая встреча стоит одних и тех же нескольких секунд, поэтому единственный значимый вопрос — что эти секунды покупают. Каждая строка — это свойство, меняющее ценность слова, то, что говорит о нём исследование, и то, как его применять, не ведя таблиц.

Шесть свойств, меняющих ценность слова прямо сейчас, доказательство по каждому и применение
Что проверяетеЧто говорит исследованиеКак это выглядит
В каком диапазоне лежитНейшн и Уоринг (1997); Нейшн (2006): первые три тысячи покупают покрытие целыми пунктами, последующие — долямиСначала пройдите высокочастотное ядро: никакая цель этот порядок не меняет, потому что это факт о языке, а не о вас
Доставит ли его контакт с языкомШмитт и Шмитт (2014); Кобб (2007): среднечастотные слова слишком редки, чтобы одно чтение дало достаточно встречСлова с 4 000 по 9 000 — это то, ради чего намеренное повторение вообще существует; первую тысячу вы встретите и так
Встречается ли в том, что вы потребляетеУэбб и Роджерс (2009): около 3 000 семей покрывают 95 % телевидения, 7 000 покрывают 98 %Выше третьей тысячи то, что вы реально смотрите и читаете, отбирает лучше общего корпусного рейтинга
Понадобилось ли оно вам самимЛауфер и Хюлстейн (2001): потребность, поиск и взвешивание повышают удержание независимо от контактаСлово, которое вы посмотрели, чтобы что-то сказать, приходит наполовину закодированным; оставьте его, но рядом с ядром, а не вместо него
Почти ли оно бесплатноеДе Гроот и Кейзер (2000): когнаты усваивались быстрее и забывались медленнее сопоставимых не-когнатовПропускайте те когнаты, которыми уже умеете пользоваться, но оставляйте ложных друзей — их так же легко выучить неправильно
Сколько оно тянет за собойБауэр и Нейшн (1993): один член семьи делает свои формы и регулярные производные в основном предсказуемымиКорневое слово стоит больше производного: выучив помогать, вы в придачу получаете помощь, помощник, полезный

О предпочтениях говорит только четвёртая строка. Остальные пять говорят о структуре языка и о структуре того, что вы потребляете, и именно поэтому отбор — это рычаг, который можно потянуть, ничего не зная о собственной психологии. Обратите внимание и на то, чего здесь нет: насколько слово интересное, насколько красиво звучит и попалось ли оно в том уроке, на котором вы случайно оказались.

Проблема среднечастотной лексики

Шмитт и Шмитт (2014) выдвинули предложение, которое звучит канцелярски, но таковым не является. Они делят словарный запас на высокочастотный — первые 3 000 семей, которым учит любой курс, — низкочастотный за пределами примерно 9 000, которому не учит никто и который никому не нужен, и среднюю зону между ними, у которой не было названия и, во многом поэтому, не было и плана. Их мысль в том, что именно там большинство тихо останавливается: она лежит между «следить за разговором» и «читать роман без словаря» и в несколько раз больше того ядра, на котором все сосредоточены.

Трудным этот диапазон делает зажим между двумя механизмами. Он слишком редок, чтобы контакт справился: слову нужно порядка восьми-двенадцати разнесённых встреч, чтобы остаться (Нейшн и Ван, 1999; Уэбб, 2007), а слово из седьмой тысячи попросту не появляется столько раз в том, что вы читаете для удовольствия. Кобб (2007) смоделировал ровно это, прогнав большие объёмы текста через симуляцию попутного усвоения, и обнаружил, что одно только чтение оставляет большую часть средних диапазонов невыученной, сколько ни читай. И он слишком обиходен, чтобы его пропустить, потому что именно эти слова составляют разницу между 84 % покрытия и теми 98 %, которые Ху и Нейшн (2000) связывают с пониманием без посторонней помощи.

Этот зажим и есть практический аргумент в пользу намеренного разнесённого повторения, и он на удивление точен насчёт того, где усилию место. Первая тысяча почти не нуждается в помощи: вы встречаете её постоянно в любом входящем материале. Хвост за десятью тысячами тоже не нуждается в помощи, потому что он не срочен. Среднечастотная зона — единственное место, где встреча не происходит сама собой и где слово при этом того стоит, что равнозначно утверждению: ценность системы повторения почти целиком зависит от того, какие слова вы в неё кладёте.

Где заканчивается каждый источник слов

Любой способ выбирать слова работает какое-то время, а потом перестаёт. Знать точку остановки полезнее, чем иметь любимый способ, потому что провал редко бывает от того, что метод был неверным: он бывает от того, что метод удержали за той точкой, где он ещё подходил.

На последней строке стоит большинство, само того не заметив.

Четыре источника лексики, что каждый даёт хорошо и точка, где каждый перестаёт работать
ИсточникЧто даётГде заканчивается
Общий частотный списокЯдро в правильном порядке, быстрее любого другого способаОколо третьей тысячи, где рейтинг перестаёт совпадать с вашим материалом и слова начинают казаться произвольными
Курс или тематический списокОчерченную ситуацию и достаточно структуры, чтобы продолжатьКак только вам понадобится что-то за пределами темы — да и упорядочен по частотности он всё равно никогда не был
Чтение и просмотрПовторяющиеся контекстные встречи с высокочастотным ядром, без затрат усилияВ среднечастотных диапазонах, где Кобб (2007) обнаружил, что встречи попросту слишком редки, чтобы довести дело до конца
Слова, которые вы собираете самиВысокую вовлечённость и идеальную релевантность тому, что вы хотели сказатьНигде — но это тянет в сторону редкого и неупорядоченного, поэтому работает как дополнение и проваливается как весь план

Сквозная картина по этим четырём строкам такова: ни один источник не покрывает весь диапазон, и среднечастотная полоса — та, что проваливается между ними всеми: слишком высока для списка новичка, слишком низка для ваших собственных запросов, слишком редка, чтобы её доставил входящий материал. Этой полосе нужен не лучший источник, а больше разнесённых встреч, чем даёт обычная жизнь: как часто повторять слова.

Потратить секунды на правильные слова

Если отбор — это рычаг, то задача системы — ставить выбранное слово перед вами достаточно часто, не прося вас ничего планировать. LearnScreen использует момент, который у вас уже есть — движение за телефоном, — так что усилие уходит на решение о том, какие слова, а не на поиск времени для них.

1

Список уже упорядочен

Больше 1 080 отобранных слов в 18 темах, упорядоченных так, что повседневное ядро идёт раньше специальной лексики, а не в том порядке, в каком её случайно ввёл параграф учебника. Одиннадцать языков доступны как изучаемые.

2

Ваши слова лежат рядом

Неограниченное число своих слов с переводом, транскрипцией и примером — те среднечастотные и лично необходимые слова, которых не предугадает ни один общий список, в одной очереди с ядром, а не в блоке, который вы перестаёте открывать.

3

Встречи приходят сами

Телефон проверяют около 186 раз в день, примерно 11,6 раза за час бодрствования (Reviews.org, 2026). Через API Экранного времени Apple LearnScreen блокирует выбранные вами приложения и ставит слово туда, где была бы лента, так что встречи, нужные редкому слову, происходят без планирования.

  • Порядок возвращения определяет система Лейтнера. Слова с ошибкой возвращаются раньше, а верные разводятся геометрически, и именно это превращает длинный список в посильное число ежедневных встреч.
  • Дозу задаёте вы. От 3 до 20 слов за подход, равно как и то, как часто возвращается блокировка; при настройках по умолчанию выходит около 25 попыток припоминания в день, примерно две с половиной минуты вразбивку.
  • Ответ скрыт, пока вы не нажмёте. Каждая карточка — это попытка припоминания, а не чтение, и переносится именно направление: активный и пассивный словарь.
  • Работает офлайн, без аккаунта. Карточки и блокировки работают без сети, как только приложение установлено; резервная копия iCloud пишется в вашу собственную приватную базу, а не на наши серверы, и регистрироваться не нужно.

Где появляются
слова

Четыре экрана из приложения: карточка блокировки, ответ с примером, список слов и прогресс.

Заблокированное приложение показывает карточку со словом вместо ленты Раскрытый ответ на карточке с переводом и примером предложения со словом Список слов с отобранными темами рядом с собственными словами пользователя Экран прогресса: сколько слов продвинулось вверх в очереди разнесённого повторения

Читать дальше

Частые вопросы

Какие слова учить первыми в новом языке?
Тысячу самых частых семей слов, и распределены они неравномерно. Нейшн и Уоринг (1997) оценивают первую 1 000 семей примерно в 72 % письменного текста, а Нейшн (2006) ставит её выше 80 % устной речи, потому что в этот диапазон входят служебные слова и повседневные глаголы, из которых собирается любое предложение. Вторая тысяча добавляет около 8 пунктов, третья — около 4, так что первые 3 000 семей стоят больше, чем всё идущее после них вместе взятое. Никакая цель этот порядок не меняет, потому что это свойство языка, а не изучающего: путешественнику, сдающему экзамен и читателю романов нужна одна и та же первая тысяча.
Сколько частых слов нужно на самом деле?
Зависит от того, что вы хотите с ними делать, и два порога лежат далеко друг от друга. Адольфс и Шмитт (2003) обнаружили, что самые частые 2 000–3 000 семей отвечают примерно за 95 % повседневной устной английской речи, а ван Зеланд и Шмитт (2013) нашли покрытие в 95 % достаточным для понимания на слух. Чтение требовательнее: Ху и Нейшн (2000) обнаружили, что понимание без посторонней помощи требует около 98 % покрытия, что Лауфер и Равенхорст-Каловски (2010) оценивают примерно в 8 000 семей слов. То есть 3 000 покупают разговор, а подъём до комфортного чтения стоит ещё нескольких тысяч.
Частотный список или слова из того, что я читаю?
Сначала частотный список, затем то, что вы читаете, с переключением около третьей тысячи. Ниже этой точки список непобедим, потому что эти слова встречаются во всём, а порядок объективно верен. Выше он перестаёт вам подходить: 5 000-е по частотности слово языка может быть редким именно в тех книгах, сериалах и разговорах, которые у вас реально есть. Уэбб и Роджерс (2009) обнаружили, что около 3 000 семей покрывают 95 % телевидения, а 7 000 покрывают 98 %, так что ваш собственный материал становится лучшим принципом отбора ровно там, где общий список начинает платить долями.
Что такое среднечастотные слова и почему они важны?
Шмитт и Шмитт (2014) предлагают этот термин для диапазонов примерно с 4 000 по 9 000 семей слов, между высокочастотным ядром, которому учат все, и низкочастотным хвостом, которому не учит никто. Они важны, потому что составляют разрыв между «следить за разговором» и «читать роман без помощи», и потому что это диапазон, который труднее всего подхватить случайно: слишком редкий, чтобы контакт дал достаточно встреч, и слишком обиходный, чтобы пропустить его без потерь. Кобб (2007) смоделировал задачу напрямую и обнаружил, что одно чтение оставляет большую часть этих диапазонов невыученной. Именно здесь намеренное разнесённое повторение даёт больше всего.
Стоит ли учить слова, которые мне нравятся, даже если они редкие?
Да, но как дополнение, а не как замену, и за исключением стоит реальный механизм. Лауфер и Хюлстейн (2001) описывают вызванную задачей вовлечённость: слово, которое вам понадобилось, которое вы искали и значение которого выбирали сами, удерживается лучше поданного готовым, так что слово, посмотренное ради того, чтобы что-то сказать, приходит наполовину закодированным. Это преимущество не отменяет частотного распределения. Рабочее разделение — держать высокочастотное ядро хребтом и пускать личные слова рядом с ним, а не позволять списку любимых редких существительных стать всем планом.
Считаются ли когнаты словами, которые я уже знаю?
Отчасти, и опознать их стоит рано, потому что они меняют реальный размер задачи. Де Гроот и Кейзер (2000) обнаружили, что когнаты усваивались быстрее и забывались медленнее сопоставимых не-когнатов, так что пересечение вашего родного языка с изучаемым — реальная фора, а не иллюзия. Действуют две оговорки. Ложные друзья лежат в том же множестве и так же легко выучиваются неправильно, а когнат, который вы узнаёте на странице, не обязательно тот, который вы сумеете произнести или употребить. Считайте их дешёвыми, а не бесплатными, и пропускайте только те, которыми уже умеете пользоваться.

Источники

  1. Nation, I. S. P., & Waring, R. (1997). Vocabulary size, text coverage and word lists. In N. Schmitt & M. McCarthy (Eds.), Vocabulary: Description, Acquisition and Pedagogy (pp. 6–19). Cambridge University Press.
  2. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  3. Schmitt, N., & Schmitt, D. (2014). A reassessment of frequency and vocabulary size in L2 vocabulary teaching. Language Teaching, 47(4), 484–503.
  4. Zipf, G. K. (1949). Human Behavior and the Principle of Least Effort. Addison-Wesley.
  5. Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438.
  6. Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
  7. Laufer, B., & Ravenhorst-Kalovski, G. C. (2010). Lexical threshold revisited: Lexical text coverage, learners’ vocabulary size and reading comprehension. Reading in a Foreign Language, 22(1), 15–30.
  8. Webb, S., & Rodgers, M. P. H. (2009). Vocabulary demands of television programs. Language Learning, 59(2), 335–366.
  9. van Zeeland, H., & Schmitt, N. (2013). Lexical coverage in L1 and L2 listening comprehension: The same or different from reading comprehension? Applied Linguistics, 34(4), 457–479.
  10. Cobb, T. (2007). Computing the vocabulary demands of L2 reading. Language Learning & Technology, 11(3), 38–63.
  11. Laufer, B., & Hulstijn, J. (2001). Incidental vocabulary acquisition in a second language: The construct of task-induced involvement. Applied Linguistics, 22(1), 1–26.
  12. de Groot, A. M. B., & Keijzer, R. (2000). What is hard to learn is easy to forget: The roles of word concreteness, cognate status, and word frequency. Language Learning, 50(1), 1–56.
  13. Brysbaert, M., Stevens, M., Mandera, P., & Keuleers, E. (2016). How many words do we know? Frontiers in Psychology, 7, 1116.
  14. Bauer, L., & Nation, P. (1993). Word families. International Journal of Lexicography, 6(4), 253–279.
  15. Schmitt, N., Jiang, X., & Grabe, W. (2011). The percentage of words known in a text and reading comprehension. Modern Language Journal, 95(1), 26–43.
  16. Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
  17. Webb, S. (2007). The effects of repetition on vocabulary knowledge. Applied Linguistics, 28(1), 46–65.
  18. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

Цифры покрытия — это корпусная статистика для английского, и точные значения смещаются вместе с корпусом, типом текста и подсчитываемой единицей: семьи слов, леммы и словоформы дают для одного и того же текста разные числа. Языки с более богатым словоизменением или продуктивным словосложением распределяются иначе, поэтому конкретные проценты стоит считать английскими, а форму кривой — общей. Шмитт, Цзян и Грейб (2011) к тому же обнаружили, что связь покрытия с пониманием в основном линейна и не является обрывом, так что 95 % и 98 % — полезные ориентиры, а не пороги, на которых включается понимание. Число карточек и дневные суммы — это арифметика исходя из попытки припоминания примерно в двадцать секунд, а не измеренные данные приложения.

Поставьте нужные слова туда, где вы их увидите

LearnScreen держит отобранное ядро и ваши собственные слова в одной разнесённой очереди и подаёт их в тот момент, когда вы тянетесь к телефону — так что слова, которые обычная жизнь никогда не повторяет достаточно часто, всё же получают свои встречи.

Скачать в App Store