К содержанию
Исследования эффективности приложений

Работают ли приложения
для изучения языков?

Да, измеримо — и в основном на уровне начинающих. Около 34 часов в приложении дали на тесте на уровень прирост, сопоставимый с первым семестром испанского в университете, — в исследовании, которое заказал сам разработчик приложения (Vesselinov и Grego, 2012). Независимый семестр с тем же приложением нашёл реальный рост в чтении и аудировании и почти нулевой в речи (Loewen et al., 2019). А тех, у кого получается, отличает от бросивших не приложение, а сколько занятий случилось.

Все цифры на этой странице снабжены ссылками в конце

Карточка со словом на экране блокировки iPhone в момент открытия заблокированного приложения

Что на самом деле измерили исследования эффективности

Языковые приложения — одна из самых скачиваемых категорий в мире и одна из наименее строго проверенных. Серьёзных исследований — горстка, они небольшие, и их результаты интереснее и рекламы, и презрения. Прочитанные вместе, они складываются в устойчивую картину: рост реальный, сосредоточен в узнавании, а не в порождении, и разброс между людьми колоссальный.

Столбец про финансирование важен не меньше столбца с выводами. Самая цитируемая цифра в этой области взята из исследования, оплаченного разработчиком. Это не делает её ложной, но делает её нижней границей для скепсиса, а не верхней для обещаний.

Пять исследований эффективности языковых приложений: что измеряло каждое и что нашло
ИсследованиеЧто измерялиЧто нашли
Vesselinov и Grego (2012)Взрослые начинающие в испанском, проверенные университетским тестом на уровень до и после самостоятельных занятий в приложении — заказ разработчикаВ среднем около 34 часов дали прирост, сопоставимый с первым университетским семестром, при огромном разбросе в том, сколько каждый занимался на самом деле
Loewen et al. (2019)Независимое семестровое исследование студентов, учивших турецкий с нуля в том же приложенииИзмеримый рост в чтении и аудировании, почти никакого сдвига в речи и резкое падение использования к концу семестра
Rachels и Rockinson-Szapkiw (2018)Геймифицированное приложение по испанскому против очных занятий в начальной школе; измеряли результат и самоэффективностьЗначимой разницы в результатах нет, а самоэффективность в группе приложения ниже: тот же результат, меньше уверенности
Golonka et al. (2014)Обзор всего технологического ландшафта изучения языков, упорядоченный по типу технологии и силе доказательствМного энтузиазма и мало строгих доказательств, что какая-либо конкретная технология превосходит обычное обучение; лучше всего подтверждены узкие и конкретные применения
Burston (2015)Два десятилетия проектов мобильного изучения языков, разобранных на предмет того, на чём держатся заявленные результатыПочти все проекты были очень короткими и очень маленькими: положительные результаты описывают недели новизны, а не семестры учёбы

Ни одно из этих исследований не проверяло это приложение, и ни одно не измеряло свободное владение. Они измеряют баллы теста на уровень, рецептивные навыки и школьную успеваемость за недели или один семестр. Вердикт для категории — «делает нечто реальное, на начальном уровне, сначала в узнавании», а любая цифра, обещающая разговорную речь от нажатий по экрану, ничем не подтверждена.

Под «приложения работают» едут три разных утверждения

За ними стоят совершенно разные доказательства, поэтому один и тот же человек справедливо считает, что приложения полезны, а их реклама — чушь. Хорошо подтверждено только первое.

  • Подтверждённое: измеримый прирост у начинающих, в основном рецептивный. Каждое исследование выше что-то нашло. Баллы теста растут, чтение и аудирование растут, а словарь — та часть, что растёт надёжнее всего: именно она лучше всего отзывается на распределённое припоминание, единственное, что программа делает лучше класса.
  • Преувеличенное: приложение заменяет курс. Rachels и Rockinson-Szapkiw (2018) нашли ничью с очным обучением, а не превосходство, а Loewen с коллегами нашли ровно тот разрыв в речи, ради закрытия которого класс и существует. Четыре нити Nation (2007) делают форму явной: вход, выход, целенаправленное изучение языка и развитие беглости — разные задачи, а приложение с выбором вариантов сильно ровно в одной.
  • Ложное: свободный язык за пятнадцать минут в день. Ни одно исследование в этой литературе не измеряло свободное владение, значит, ни одно не подтверждает обещание свободы. По десять минут в день 34 часа самого известного результата занимают около семи месяцев — и этот расчёт предполагает, что вы не пропускаете ни дня, что как раз и разбирает следующий раздел.

Экспозиция без припоминания — уже четвёртое утверждение, со своими данными: работает ли пассивное обучение?

Что на самом деле решает, сработает ли приложение у вас

Шесть вещей, каждая взята из исследования, а не из списка функций, и упорядочены по тому, насколько сильно сдвигают результат. Первая давит все остальные, что неудобно для всех, кто продаёт остальные пять.

Шесть факторов, определяющих, даст ли языковое приложение результат, доказательства по каждому и практический вид
Что решаетЧто говорят данныеКак это выглядит
Случилось ли занятие вообщеNielson (2011): федеральные служащие с лицензиями, оплаченным учебным временем и поддержкой тьюторов всё равно в большинстве бросили рано, и до значимого объёма дошли единицыСбой — не плохой урок, а урок, который не открыли: если бы хватало поддержки и оплаченного времени, то исследование закончилось бы иначе
Припоминаете вы или узнаётеRoediger и Karpicke (2006): проверка по материалу дала лучшее долгосрочное удержание, чем повторное чтение того же за то же времяВыбрать правильную клетку из четырёх намного легче, чем произвести слово, а лёгкая практика покупает меньше; тип упражнения важнее, чем приложение
Распределена ли практикаCepeda et al. (2006), синтез 254 исследований: около 47 % припоминания при распределённой практике против 37 % при той же практике подрядДесять минут шесть дней бьют час в воскресенье, и приложение, которое появляется каждый день, выигрывает на этой оси ещё до сравнения содержания
Хватает ли каждому слову встречNation и Wang (1999): слову обычно нужно от 8 до 12 распределённых встреч, чтобы остатьсяСерия из нового материала каждый день никогда ничего не завершает; остаются те слова, чьё возвращение запланировано
Стоят ли слова этих встречNation (2006): первые 3000 семей слов покрывают около 95 % повседневного разговора, дальше покрытие резко выполаживаетсяПорядок по частотности — почти вся отдача первого года: поэтому тематический курс с названиями животных ощущается продуктивным и плохо измеряется
Откуда берутся минутыReviews.org (2026): взрослые в США сообщают, что смотрят в телефон около 186 раз в день, примерно 11,6 раза в час бодрствованияПлан, которому нужен новый слот в дне, конкурирует со всем остальным в нём; план, который едет на существующей привычке, — нет

Только строки со второй по пятую про качество софта, и именно их почти вся категория давно решила. Первая и шестая — про доставку, и именно там результат и решается: поэтому сравнения методов раз за разом выходят ничейными.

Переменная, которую обзоры не измеряют

Сравнения приложений пишутся о функциях: насколько хорошо распознавание речи, чего стоят грамматические заметки, как устроена очередь повторений. Это настоящие различия, и они маленькие. Различие, которое не маленькое, — между тем, кто сделал сорок занятий, и тем, кто сделал четыре, и ни один обзор не скажет, кем окажетесь вы, потому что это не свойство приложения.

Поэтому литература об эффективности снова и снова даёт плоские результаты. Golonka с коллегами (2014) искали технологии с сильными доказательствами преимущества и нашли главным образом энтузиазм; Burston (2015) обнаружил, что два десятилетия мобильных проектов состоят в основном из исследований длиной в недели. Когда длительность мала, а время на задаче отличается между участниками на порядок, у разницы методов почти нет места, чтобы проявиться. Тем временем Nielson (2011) собрал то, что должно было стать лучшим случаем для самостоятельного софта — добровольцы, лицензии, защищённое время, тьюторы — и увидел, как большинство бросает. Регулярность — не мягкий фактор рядом с жёсткими. Она и есть жёсткий.

Это переформулирует вопрос, который люди на самом деле имеют в виду. Честная версия: даёт ли это приложение достаточно занятий в те дни, когда всё идёт плохо, чтобы эффекты распределения и припоминания накопились? Любая техника с этой страницы стоит нуля в приложении, которое вы перестали открывать в марте, и даже посредственная техника складывается в приложении, открывать которое никогда не приходилось решать. Продуктивный ход — не поиск упражнения получше. Это удар по шагу, где на самом деле теряется.

Чего стоит бросить, в единицах исследований

«Будьте последовательны» — совет, с которым нельзя ничего сделать. Дальше то же самое с цифрами: четыре конкретные вещи, которые перестают происходить, когда прекращаются занятия, каждая кем-то измерена.

Обратите внимание: три из четырёх — не про то, что вы выучите меньше. Они про потерю материала, за который уже заплачено.

Что теряется, когда занятия прекращаются, с измеренным размером каждой потери
Что теряетсяДоказательстваИзмеренный размер
Преимущество распределенияCepeda et al. (2006), синтез 254 исследований распределённой практикиОколо 47 % против 37 % — разрыв, который получают только вернувшись в другой день
Встречи, которых слову ещё не хватаетNation и Wang (1999), о том, сколько раз нужно встретить слово, чтобы оно держалосьПримерно 8–12 распределённых встреч: слово, брошенное на четвёртой, не выучено на треть — оно исчезло
Всё недоученноеMurre и Dros (2015), воспроизведение кривой забывания ЭббингаузаКрутая ранняя потеря без повторения: очередь, которую вы перестали разбирать, рассыпается быстрее всего в первые дни, а потом замедляется
Законченный курсNielson (2011), самостоятельное обучение на работе с лицензиями, временем и поддержкойБольшинство бросило рано: самый частый исход самостоятельного софта — незаконченный курс, а не плохой

Это не призыв к дисциплине. Это призыв устроить дело так, чтобы между вами и повторением стояло меньше решений, — задача проектирования, и решаемая. Что происходит со словом в промежутке, — на странице почему забываются слова.

Убрать шаг, на котором происходят потери

Если результат решает регулярность, полезный вопрос проектирования — не как сделать урок лучше. Он в том, как сделать, чтобы повторение случилось без чьего-либо решения начать. LearnScreen построен вокруг этой одной идеи; вот механизм, без украшений:

1

Нечего начинать

API Screen Time от Apple позволяет блокировать выбранные вами приложения. Когда вы открываете одно из них, вместо ленты появляется карточка со словом. В телефон заглядывают около 186 раз в день (Reviews.org, 2026), так что повторение едет на уже существующей привычке, а не просит нового слота в дне.

2

Каждая карточка — попытка вспомнить

Ответ скрыт, пока вы не коснётесь: карточка — это проверка, а не чтение, то самое направление, при котором Roediger и Karpicke (2006) нашли лучшее долгосрочное удержание. Фоновая доставка увеличивает число попыток; она не меняет цену одной попытки.

3

Расписание решает, что вернётся

Очередь Лейтнера возвращает ошибочные слова раньше, а известные отодвигает геометрически, так что 8–12 встреч, нужных слову (Nation и Wang, 1999), расходятся по дням, а не сбиваются в один заход.

  • Дозу задаёте вы. Слов за подход — от 3 до 20, как и частота возврата блокировки. При настройках по умолчанию выходит около 25 попыток вспомнить в день, примерно две с половиной минуты вразбивку: достаточно мало, чтобы не отменять ни один другой план.
  • Это не курс и не притворяется им. Это целенаправленная работа над словарём, одна из четырёх нитей Nation (2007). Говорение, чтение и аудирование — задачи, которых он не делает, и честное его место — под ними: активный и пассивный словарь.
  • Частотные списки или ваши собственные слова. Готовые наборы начинаются там, где покрытие дешевле всего (Nation, 2006), а всё, что вы добавите вручную или вставите пачкой, попадает в ту же очередь: сколько слов нужно.
  • Работает офлайн, без аккаунта. Карточки и блокировки работают без сети после установки; резервная копия iCloud пишется в вашу собственную приватную базу, а не на наши серверы, и регистрироваться негде.

Где появляются
слова

Четыре экрана приложения: карточка блокировки, ответ с примером предложения, список слов и прогресс.

Заблокированное приложение показывает карточку со словом на экране блокировки вместо ленты Раскрытый ответ на карточке: перевод и пример предложения с этим словом Список слов с готовыми темами рядом со словами, добавленными самим пользователем Экран прогресса: сколько слов поднялось в очереди интервального повторения

Что почитать дальше

Частые вопросы

Работают ли приложения для изучения языков?
Да, для измеримого прироста на уровне начинающих, прежде всего в чтении и аудировании. Самая цитируемая цифра: около 34 часов занятий в приложении дали на тесте на уровень улучшение, сопоставимое с первым университетским семестром испанского, — в исследовании по заказу самого разработчика (Vesselinov и Grego, 2012). Независимое семестровое исследование людей, учивших турецкий в том же приложении, нашло реальный рецептивный рост и почти нулевой сдвиг в речи (Loewen et al., 2019), а контролируемое сравнение с очным обучением не нашло значимой разницы в результатах и обнаружило более низкую самоэффективность в группе приложения (Rachels и Rockinson-Szapkiw, 2018). Ничто в этой литературе не подтверждает обещаний свободного владения, и ничто из неё не относится к занятиям, которых не было.
Хватит ли одного приложения, чтобы выучить язык?
Одного не хватит, и ограничение структурное, а не дефект конкретного продукта. Модель четырёх нитей Nation (2007) утверждает, что курсу нужны вход, ориентированный на смысл, выход, ориентированный на смысл, целенаправленное изучение языка и развитие беглости примерно поровну. Приложение с выбором вариантов очень хорошо в целенаправленном изучении и неплохо во входе; оно слабо в выходе, поэтому Loewen с коллегами (2019) измерили рост в чтении и аудировании и почти никакого в речи. Реалистичная роль — движок словаря и грамматики под разговорной практикой, которую вы берёте где-то ещё.
Почему сравнения приложений всегда выходят ничейными?
Потому что различия между методами малы по сравнению с различиями в том, сколько люди на самом деле делают. Обзоры технологий для языков раз за разом находили тонкие доказательства для любой конкретной технологии и короткие дизайны исследований (Golonka et al., 2014), а анализ Burston (2015) двух десятилетий мобильных проектов показал, что большинство длилось недели, а не семестры. Когда длительность мала, а время на задаче сильно различается между участниками, эффекты метода тонут. Практический вывод: приложение, которое вы будете открывать, лучше приложения, которое чуть лучше тестируется.
Сколько часов в приложении равны семестру занятий?
Около 34 часов, по одному тесту на уровень, в одном заказанном разработчиком исследовании испанского (Vesselinov и Grego, 2012), — и с этой цифрой надо обращаться осторожно. Она измеряет прирост в тесте на уровень, а не способность поддержать разговор; она получена от тех, кто дошёл до конца; и её оплатила компания, чей продукт оценивали. Считайте её доказательством, что категория что-то даёт, а не курсом обмена, и учтите: по десять минут в день 34 часа — это около семи месяцев.
Чем отличаются те, у кого приложение работает, от тех, кто бросает?
Тем, случаются ли занятия. Nielson (2011) дал федеральным служащим языковой софт с оплаченным временем и поддержкой тьюторов, и даже в этой необычно благоприятной обстановке большинство бросило рано, а до значимого объёма дошли единицы. Этот результат — про модель доставки, а не про софт: самостоятельное обучение требует каждый день решать начать, и именно там происходит отсев. Всё остальное на этой странице идёт после.
Считается ли пассивное или фоновое повторение использованием приложения?
Считается, если произошла попытка вспомнить. Одна экспозиция учит медленно, а окупается эффект тестирования: Roediger и Karpicke (2006) нашли, что проверка удерживает лучше повторного чтения, а Cepeda с коллегами (2006) на 254 исследованиях помещают распределённую практику примерно на 47 % припоминания против 37 % у практики подряд. Фоновая доставка меняет число попыток, а не цену одной. Карточка, мимо которой вы пролистали, стоит гораздо меньше карточки, на которую вы попытались ответить.

Источники

  1. Vesselinov, R., & Grego, J. (2012). Duolingo Effectiveness Study. City University of New York / University of South Carolina. Commissioned by Duolingo.
  2. Loewen, S., Crowther, D., Isbell, D. R., Kim, K. M., Maloney, J., Miller, Z. F., & Rawal, H. (2019). Mobile-assisted language learning: A Duolingo case study. ReCALL, 31(3), 293–311.
  3. Rachels, J. R., & Rockinson-Szapkiw, A. J. (2018). The effects of a mobile gamification app on elementary students’ Spanish achievement and self-efficacy. Computer Assisted Language Learning, 31(1–2), 72–89.
  4. Nielson, K. B. (2011). Self-study with language learning software in the workplace: What happens? Language Learning & Technology, 15(3), 110–129.
  5. Golonka, E. M., Bowles, A. R., Frank, V. M., Richardson, D. L., & Freynik, S. (2014). Technologies for foreign language learning: A review of technology types and their effectiveness. Computer Assisted Language Learning, 27(1), 70–105.
  6. Burston, J. (2015). Twenty years of MALL project implementation: A meta-analysis of learning outcomes. ReCALL, 27(1), 4–20.
  7. Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380.
  8. Roediger, H. L., & Karpicke, J. D. (2006). Test-enhanced learning: Taking memory tests improves long-term retention. Psychological Science, 17(3), 249–255.
  9. Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
  10. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  11. Nation, I. S. P. (2007). The four strands. Innovation in Language Learning and Teaching, 1(1), 2–13.
  12. Murre, J. M. J., & Dros, J. (2015). Replication and analysis of Ebbinghaus’ forgetting curve. PLOS ONE, 10(7), e0120644.
  13. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

Это небольшие исследования. Выборки — от отдельных классов до нескольких сотен человек, длительность — от недель до одного семестра, а измеряются тесты на уровень и батареи навыков, а не реальный разговор. Одно из них оплатила компания, чей продукт оценивали, и это указано там, где оно цитируется. LearnScreen не проходил исследования эффективности, и эта страница не утверждает обратного; цифры по приложению — арифметика из настроек по умолчанию и попытки вспомнить длиной около двадцати секунд, а не измеренные данные использования.

Почините шаг, который решает результат

Если исследования говорят, что регулярность бьёт метод, лечение — не лучший урок, а повторение, которое случается без решения. LearnScreen кладёт его в телефон, который вы и так собирались разблокировать, и не просит ни одной новой минуты.

Скачать в App Store