Que palavras aprender
primeiro?
As 1.000 famílias de palavras mais frequentes cobrem cerca de 72% do texto escrito e mais de 80% do falado, enquanto o décimo milhar acrescenta menos de um ponto percentual (Nation e Waring, 1997; Nation, 2006). Escolher bem as palavras pesa mais do que escolher bem o método, e a ordem não é questão de gosto: esgote as primeiras 2.000–3.000 famílias e depois trabalhe as faixas de frequência média, de 4.000 a 9.000, que Schmitt e Schmitt (2014) descrevem como raras demais para se absorver por exposição e comuns demais para pular. Daí em diante, a melhor próxima palavra é aquela de que você acabou de precisar e não tinha.
Todos os números abaixo estão referenciados no fim da página

A frequência das palavras é radicalmente desigual
Quase todo conselho trata vocabulário como uma pilha a ser vencida, em que qualquer milhar de palavras vale mais ou menos o mesmo que outro. Não é assim que um idioma se distribui. A frequência segue uma lei de potência bastante íngreme — o padrão que Zipf (1949) descreveu —, na qual um punhado de palavras responde por quase tudo que se diz e se escreve, e o resto afina numa cauda longuíssima.
A consequência prática é que as faixas não são intercambiáveis. Cada linha abaixo é um milhar de famílias de palavras, em ordem de frequência, com o que aquela faixa acrescenta à sua cobertura de texto escrito comum.
| Faixa de frequência | Cobertura que alcança | O que há nela |
|---|---|---|
| Primeiras 1.000 famílias | Cerca de 72% do texto escrito e mais de 80% do falado | As palavras funcionais e os verbos e substantivos do dia a dia com que se monta qualquer frase: o bloco mais valioso que você vai aprender |
| Segundo milhar | Leva você a cerca de 80% | Cerca de 8 pontos a mais pelo mesmo número de palavras: ainda é vocabulário comum e nada que se possa pular com sensatez |
| Terceiro milhar | Leva você a cerca de 84% | Cerca de 4 pontos a mais: a última faixa que paga em porcentagens inteiras e o fim do que Schmitt e Schmitt (2014) chamam de vocabulário de alta frequência |
| Do quarto ao nono milhar | Leva de 84% em direção a 98% | A faixa de frequência média: um a dois pontos por faixa, rara demais para cruzar com frequência, comum demais para deixar de fora |
| Além do décimo milhar | Menos de um ponto por milhar | A cauda de Zipf: dezenas de milhares de palavras que você encontraria uma vez em anos de leitura, e nenhuma delas urgente |
As porcentagens de cobertura são de texto escrito e vêm de Nation e Waring (1997) e Nation (2006); a fala dá números mais altos nas faixas baixas e mais baixos nas altas, porque a conversa reaproveita um núcleo menor. São dados do inglês: idiomas com flexão mais rica se distribuem de outro jeito, porque ali uma família de palavras cobre mais formas distintas. O que se transfere para qualquer idioma não são as porcentagens exatas, e sim o formato da curva: íngreme no começo e quase plana no décimo milhar.
Três listas diferentes recebem o nome de «as palavras a aprender»
Discussões sobre que vocabulário estudar costumam ser discussões entre pessoas segurando três listas diferentes e usando a mesma palavra para todas. Não são rivais: são etapas, e cada uma acerta num lugar diferente.
- A lista de frequência. Palavras ordenadas pela frequência com que aparecem num corpus grande. Objetiva, impessoal e imbatível abaixo do terceiro milhar, porque essas palavras aparecem em tudo que você vier a ler ou ouvir. Sua fraqueza é não saber nada sobre você — e isso só deixa de ser irrelevante exatamente quando as palavras deixam de ser comuns o bastante para serem inevitáveis.
- A lista temática ou do livro didático. Palavras agrupadas por situação: aeroporto, restaurante, escritório. Útil para uma necessidade definida e próxima, e fácil de manter, mas cega à frequência: uma lista temática ensina alegremente um substantivo raro antes de um verbo comum, e palavras do mesmo campo semântico apresentadas juntas interferem umas nas outras enquanto ainda são novas.
- As suas próprias palavras. As que você procurou porque queria entender ou dizer algo específico. Trazem uma vantagem real de codificação — Laufer e Hulstijn (2001) mostraram que uma palavra de que você precisou, que buscou e cujo sentido teve de escolher é retida melhor do que uma entregue pronta —, mas chegam sem ordem nenhuma e, sozinhas, puxam para o raro.
A pergunta vizinha, quantas palavras são no total por objetivo e nível QECR: quantas palavras são necessárias para falar um idioma.
O que torna uma palavra digna do seu próximo encontro
Cada encontro custa os mesmos poucos segundos, então a única pergunta que importa é o que esses segundos compram. Cada linha é uma propriedade que muda o valor de uma palavra, o que a evidência diz sobre ela e como aplicá-la sem manter uma planilha.
| O que checar | O que diz a evidência | Como isso aparece na prática |
|---|---|---|
| Em que faixa ela está | Nation e Waring (1997); Nation (2006): os três primeiros milhares compram cobertura em pontos inteiros; os seguintes, em frações | Esgote primeiro o núcleo de alta frequência: nenhum objetivo muda essa ordem, porque é um fato do idioma, não seu |
| Se a exposição vai entregá-la | Schmitt e Schmitt (2014); Cobb (2007): palavras de frequência média são raras demais para a leitura sozinha dar encontros suficientes | Palavras de 4.000 a 9.000 são para o que a revisão deliberada realmente serve; o primeiro milhar você vai cruzar de qualquer jeito |
| Se aparece no que você consome | Webb e Rodgers (2009): cerca de 3.000 famílias cobrem 95% da televisão e 7.000 cobrem 98% | Acima do terceiro milhar, o que você de fato assiste e lê seleciona melhor que um ranking geral de corpus |
| Se você mesmo precisou dela | Laufer e Hulstijn (2001): necessidade, busca e avaliação aumentam a retenção independentemente da exposição | Uma palavra que você procurou para dizer algo chega meio codificada; guarde-a, mas ao lado do núcleo e não no lugar dele |
| Se é quase de graça | De Groot e Keijzer (2000): cognatos foram aprendidos mais rápido e esquecidos mais devagar que não cognatos equivalentes | Pule os cognatos que você já sabe usar, mas mantenha os falsos cognatos, que se aprendem errado com a mesma facilidade |
| Quanto ela traz junto | Bauer e Nation (1993): um membro da família torna suas flexões e derivações regulares amplamente previsíveis | Uma palavra base vale mais que uma derivada: aprender ajudar entrega ajuda, ajudante, ajudado |
Só a quarta linha fala de preferência. As outras cinco falam da estrutura do idioma e da estrutura do que você consome, e é por isso que a seleção é uma alavanca acionável sem saber nada da própria psicologia. Repare também no que não aparece: o quanto a palavra é interessante, o quanto soa bonita e se ela estava na lição em que você parou.
O problema da frequência média
Schmitt e Schmitt (2014) fizeram uma proposta que soa administrativa e não é. Dividem o vocabulário em alta frequência — as primeiras 3.000 famílias, que todo curso ensina —, baixa frequência além de cerca de 9.000, que ninguém ensina nem precisa, e uma faixa intermediária que não tinha nome e que, em boa parte por isso, também não tinha plano. A tese é que é ali que a maioria empaca em silêncio: ela fica entre acompanhar uma conversa e ler um romance sem dicionário, e é várias vezes maior que o núcleo em que todo mundo se concentra.
O que torna essa faixa ingrata é um aperto entre dois mecanismos. É rara demais para a exposição dar conta: uma palavra precisa de algo como oito a doze encontros espaçados para ficar (Nation e Wang, 1999; Webb, 2007), e uma palavra do sétimo milhar simplesmente não aparece tantas vezes em nada que você leia por prazer. Cobb (2007) modelou exatamente isso, passando grandes volumes de texto por uma simulação de aprendizagem incidental, e encontrou que a leitura sozinha deixava a maior parte das faixas médias sem aprender, por mais leitura que houvesse. E é comum demais para pular, já que são justamente as palavras que fazem a diferença entre 84% de cobertura e os 98% que Hu e Nation (2000) associam à compreensão sem ajuda.
Esse aperto é o argumento prático a favor da revisão espaçada deliberada, e é curiosamente específico sobre onde o esforço pertence. O primeiro milhar quase não precisa de ajuda: você vai cruzar com ele constantemente em qualquer entrada. A cauda além dos dez mil também não precisa, porque não é urgente. A faixa de frequência média é o único lugar em que o encontro não vai acontecer sozinho e a palavra vale a pena — ou seja, o valor de um sistema de revisão depende quase inteiramente de que palavras você coloca nele.
Onde cada fonte de palavras se esgota
Toda forma de escolher palavras funciona por um tempo e depois para. Saber onde ela para é mais útil que ter uma favorita, porque a falha quase nunca é o método ser ruim: é ele ter sido mantido além do ponto em que ainda servia.
A última linha é aquela em que a maioria está pisando sem ter percebido.
| Fonte | O que entrega | Onde se esgota |
|---|---|---|
| Uma lista de frequência geral | O núcleo, na ordem correta, mais rápido que qualquer outro método | Por volta do terceiro milhar, quando o ranking deixa de bater com o que você consome e as palavras começam a parecer arbitrárias |
| Um curso ou lista temática | Uma situação delimitada e estrutura suficiente para continuar | Assim que você precisa de algo fora do tema — e ela nunca esteve ordenada por frequência |
| Ler e assistir | Encontros repetidos e contextualizados com o núcleo de alta frequência, sem custo de esforço | Nas faixas de frequência média, onde Cobb (2007) encontrou que os encontros são simplesmente escassos demais para terminar o trabalho |
| As palavras que você coleta | Alta carga de envolvimento e relevância perfeita para o que você queria dizer | Em lugar nenhum — mas puxa para o raro e sem ordem, então funciona como complemento e falha como plano inteiro |
O padrão nas quatro linhas é que nenhuma fonte cobre a faixa inteira, e a de frequência média é a que cai entre todas: alta demais para a lista de iniciante, baixa demais para as suas próprias buscas, rara demais para a entrada entregar. O que essa faixa precisa não é de uma fonte melhor, e sim de mais encontros espaçados do que a vida comum fornece: com que frequência revisar vocabulário.
Gastar os segundos nas palavras certas
Se a seleção é a alavanca, o trabalho de um sistema é colocar uma palavra escolhida na sua frente vezes suficientes, sem pedir que você agende nada. O LearnScreen faz isso com o momento que você já tem — o gesto de pegar o celular —, de modo que o esforço vá para decidir quais palavras, e não para arrumar tempo.
A lista já vem ordenada
Mais de 1.080 palavras selecionadas em 18 temas, sequenciadas para que o núcleo do dia a dia venha antes do vocabulário especializado, e não na ordem em que um capítulo de livro o introduziu. Onze idiomas estão disponíveis como língua de estudo.
Suas palavras ficam ao lado
Palavras próprias ilimitadas com tradução, transcrição e frase de exemplo: as de frequência média e as de que você precisa, que nenhuma lista geral consegue prever, na mesma fila do núcleo em vez de num caderno que você para de abrir.
Os encontros chegam sozinhos
O celular é conferido cerca de 186 vezes por dia, aproximadamente 11,6 vezes por hora acordada (Reviews.org, 2026). A API de Tempo de Uso da Apple permite ao LearnScreen bloquear os apps que você escolher e pôr uma palavra onde estaria o feed, então os encontros de que uma palavra rara precisa acontecem sem agendamento.
- Um esquema de Leitner decide a ordem de volta. Palavras erradas voltam antes e palavras certas se espaçam geometricamente, o que transforma uma lista longa num número administrável de encontros diários.
- A dose é sua. De 3 a 20 palavras por sessão, e também com que frequência o bloqueio retorna; nos ajustes padrão dá cerca de 25 tentativas de lembrança por dia, uns dois minutos e meio distribuídos.
- A resposta fica escondida até você tocar. Cada cartão é uma tentativa de lembrança e não uma leitura, que é a direção que transfere: vocabulário ativo e passivo.
- Funciona offline e sem conta. Cartões e bloqueios funcionam sem rede depois de instalado; o backup no iCloud grava no seu próprio banco privado e não nos nossos servidores, e não há cadastro nenhum.
Para ler em seguida
- Quantas palavras para falar um idioma? — O tamanho do trabalho inteiro, por objetivo e nível QECR.
- Quantas palavras por dia? — O ritmo em que a lista escolhida é percorrida.
- Deve-se aprender palavras em contexto? — O que colocar no cartão depois de escolhida a palavra.
- Com que frequência revisar vocabulário? — Os intervalos de que uma palavra rara precisa para sobreviver.
- Aprendizagem passiva funciona? — O que a exposição sozinha entrega e onde ela para.
- Por que esqueço o vocabulário? — O que acontece com uma palavra entre dois encontros.
Perguntas frequentes
Fontes
- Nation, I. S. P., & Waring, R. (1997). Vocabulary size, text coverage and word lists. In N. Schmitt & M. McCarthy (Eds.), Vocabulary: Description, Acquisition and Pedagogy (pp. 6–19). Cambridge University Press.
- Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
- Schmitt, N., & Schmitt, D. (2014). A reassessment of frequency and vocabulary size in L2 vocabulary teaching. Language Teaching, 47(4), 484–503.
- Zipf, G. K. (1949). Human Behavior and the Principle of Least Effort. Addison-Wesley.
- Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438.
- Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
- Laufer, B., & Ravenhorst-Kalovski, G. C. (2010). Lexical threshold revisited: Lexical text coverage, learners’ vocabulary size and reading comprehension. Reading in a Foreign Language, 22(1), 15–30.
- Webb, S., & Rodgers, M. P. H. (2009). Vocabulary demands of television programs. Language Learning, 59(2), 335–366.
- van Zeeland, H., & Schmitt, N. (2013). Lexical coverage in L1 and L2 listening comprehension: The same or different from reading comprehension? Applied Linguistics, 34(4), 457–479.
- Cobb, T. (2007). Computing the vocabulary demands of L2 reading. Language Learning & Technology, 11(3), 38–63.
- Laufer, B., & Hulstijn, J. (2001). Incidental vocabulary acquisition in a second language: The construct of task-induced involvement. Applied Linguistics, 22(1), 1–26.
- de Groot, A. M. B., & Keijzer, R. (2000). What is hard to learn is easy to forget: The roles of word concreteness, cognate status, and word frequency. Language Learning, 50(1), 1–56.
- Brysbaert, M., Stevens, M., Mandera, P., & Keuleers, E. (2016). How many words do we know? Frontiers in Psychology, 7, 1116.
- Bauer, L., & Nation, P. (1993). Word families. International Journal of Lexicography, 6(4), 253–279.
- Schmitt, N., Jiang, X., & Grabe, W. (2011). The percentage of words known in a text and reading comprehension. Modern Language Journal, 95(1), 26–43.
- Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
- Webb, S. (2007). The effects of repetition on vocabulary knowledge. Applied Linguistics, 28(1), 46–65.
- Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report
As porcentagens de cobertura são estatísticas de corpus do inglês, e os números exatos mudam com o corpus, o tipo de texto e a unidade contada: famílias de palavras, lemas e tipos dão números diferentes para o mesmo texto. Idiomas com flexão mais rica ou composição produtiva se distribuem de outra forma, então tome as porcentagens específicas como do inglês e o formato da curva como geral. Schmitt, Jiang e Grabe (2011) também encontraram que a relação entre cobertura e compreensão é aproximadamente linear e não um penhasco, de modo que 95% e 98% são referências úteis e não limiares em que o entendimento se acende. As contagens de cartões e os totais diários são aritmética a partir de uma tentativa de lembrança de cerca de vinte segundos, não dados medidos do aplicativo.
Ponha as palavras certas onde você vai vê-las
O LearnScreen mantém numa única fila espaçada um núcleo selecionado e as suas próprias palavras, e as entrega no momento em que você pega o celular — para que as palavras que a vida comum nunca repete o suficiente recebam mesmo assim seus encontros.
Baixar na App Store
