Quali parole imparare
per prime?
Le 1.000 famiglie di parole più frequenti coprono circa il 72% del testo scritto e oltre l'80% del parlato, mentre il decimo migliaio aggiunge meno di un punto percentuale (Nation e Waring, 1997; Nation, 2006). Scegliere bene le parole pesa quindi più che scegliere bene il metodo, e l'ordine non è questione di gusti: esaurisci le prime 2.000–3.000 famiglie, poi lavora sulle fasce di media frequenza, da 4.000 a 9.000, che Schmitt e Schmitt (2014) descrivono come troppo rare per essere assorbite dall'esposizione e troppo comuni per essere saltate. Da lì in poi, la parola migliore da prendere è quella che ti è appena servita e non avevi.
Ogni cifra qui sotto è referenziata in fondo alla pagina

La frequenza delle parole è radicalmente diseguale
Quasi tutti i consigli trattano il vocabolario come un mucchio da smaltire, in cui un migliaio di parole vale più o meno quanto un altro. Non è così che una lingua si distribuisce. La frequenza segue una legge di potenza molto ripida — lo schema descritto da Zipf (1949) —, in cui una manciata di parole rende conto di quasi tutto ciò che si dice e si scrive, e il resto si assottiglia in una coda lunghissima.
La conseguenza pratica è che le fasce non sono intercambiabili. Ogni riga qui sotto è un migliaio di famiglie di parole, in ordine di frequenza, con quello che quella fascia aggiunge alla tua copertura del testo scritto ordinario.
| Fascia di frequenza | Copertura raggiunta | Cosa contiene |
|---|---|---|
| Prime 1.000 famiglie | Circa il 72% del testo scritto e oltre l'80% del parlato | Le parole funzionali e i verbi e sostantivi quotidiani con cui si monta qualsiasi frase: il blocco più redditizio che imparerai mai |
| Secondo migliaio | Ti porta intorno all'80% | Circa 8 punti in più per lo stesso numero di parole: è ancora vocabolario ordinario, e niente che si possa saltare con criterio |
| Terzo migliaio | Ti porta intorno all'84% | Circa 4 punti in più: l'ultima fascia che paga in percentuali intere e la fine di quello che Schmitt e Schmitt (2014) chiamano vocabolario ad alta frequenza |
| Dal quarto al nono migliaio | Ti porta dall'84% verso il 98% | La fascia di media frequenza: uno o due punti per fascia, troppo rara per incontrarla spesso, troppo comune per lasciarla fuori |
| Oltre il decimo migliaio | Meno di un punto per migliaio | La coda di Zipf: decine di migliaia di parole che incontreresti una volta in anni di lettura, e nessuna urgente |
Le percentuali di copertura riguardano il testo scritto e vengono da Nation e Waring (1997) e Nation (2006); il parlato dà cifre più alte nelle fasce basse e più basse in quelle alte, perché la conversazione riusa un nucleo più ristretto. Sono dati dell'inglese: le lingue con flessione più ricca si distribuiscono diversamente, perché lì una famiglia di parole copre più forme distinte. Ciò che si trasferisce a qualsiasi lingua non sono le percentuali esatte ma la forma della curva: ripida all'inizio e quasi piatta al decimo migliaio.
Tre liste diverse vengono chiamate «le parole da imparare»
Le discussioni su quale vocabolario studiare sono di solito discussioni fra persone che hanno in mano tre liste diverse e usano la stessa parola per tutte e tre. Non sono rivali: sono fasi, e ciascuna ha ragione in un punto diverso.
- La lista di frequenza. Parole ordinate per quanto spesso compaiono in un grande corpus. Oggettiva, impersonale e imbattibile sotto il terzo migliaio, perché quelle parole compaiono in tutto ciò che leggerai o ascolterai. Il suo punto debole è che non sa nulla di te — e questo smette di essere irrilevante esattamente quando le parole smettono di essere così comuni da risultare inevitabili.
- La lista tematica o del manuale. Parole raggruppate per situazione: aeroporto, ristorante, ufficio. Utile per un bisogno definito e vicino, e facile da seguire, ma cieca alla frequenza: una lista tematica ti insegnerà volentieri un sostantivo raro prima di un verbo comune, e parole dello stesso campo semantico presentate insieme interferiscono fra loro finché sono nuove.
- Le tue parole. Quelle che hai cercato perché volevi capire o dire qualcosa di preciso. Portano un vantaggio reale di codifica — Laufer e Hulstijn (2001) hanno trovato che una parola di cui hai avuto bisogno, che hai cercato e di cui hai dovuto scegliere il senso si ricorda meglio di una servita pronta —, ma arrivano senza alcun ordine e, lasciate sole, tendono al raro.
La domanda vicina, quante parole servono in tutto per obiettivo e livello QCER: quante parole servono per parlare una lingua.
Cosa rende una parola degna del prossimo incontro
Ogni incontro costa gli stessi pochi secondi, quindi l'unica domanda che conta è cosa comprano quei secondi. Ogni riga è una proprietà che cambia il valore di una parola, cosa dice la ricerca al riguardo e come applicarla senza tenere un foglio di calcolo.
| Cosa guardare | Cosa dice la ricerca | Come si traduce in pratica |
|---|---|---|
| In quale fascia si trova | Nation e Waring (1997); Nation (2006): i primi tre migliaia comprano copertura in punti interi, i successivi in frazioni | Esaurisci prima il nucleo ad alta frequenza: nessun obiettivo cambia quest'ordine, perché dipende dalla lingua e non da te |
| Se l'esposizione te la porterà | Schmitt e Schmitt (2014); Cobb (2007): le parole di media frequenza sono troppo rare perché la sola lettura dia abbastanza incontri | Le parole da 4.000 a 9.000 sono ciò a cui serve davvero il ripasso deliberato; il primo migliaio lo incontrerai comunque |
| Se compare in ciò che consumi | Webb e Rodgers (2009): circa 3.000 famiglie coprono il 95% della televisione, 7.000 ne coprono il 98% | Sopra il terzo migliaio, ciò che guardi e leggi davvero seleziona meglio di una classifica generale di corpus |
| Se ti è servita di persona | Laufer e Hulstijn (2001): bisogno, ricerca e valutazione alzano la ritenzione a prescindere dall'esposizione | Una parola cercata per poter dire qualcosa arriva già mezza codificata; tienila, ma accanto al nucleo e non al suo posto |
| Se è quasi gratis | De Groot e Keijzer (2000): i cognati sono stati imparati più in fretta e dimenticati più lentamente dei non cognati equivalenti | Salta i cognati che sai già usare, ma tieni i falsi amici, che si imparano male con la stessa facilità |
| Quanto si porta dietro | Bauer e Nation (1993): un membro della famiglia rende le sue flessioni e derivazioni regolari in gran parte prevedibili | Una parola base vale più di una derivata: imparare aiutare ti consegna aiuto, aiutante, aiutato |
Solo la quarta riga riguarda le preferenze. Le altre cinque riguardano la struttura della lingua e la struttura di ciò che consumi, ed è per questo che la selezione è una leva azionabile senza sapere nulla della propria psicologia. Nota anche cosa manca: quanto la parola è interessante, quanto suona bella e se era nella lezione a cui eri arrivato.
Il problema della media frequenza
Schmitt e Schmitt (2014) hanno fatto una proposta che sembra amministrativa e non lo è. Dividono il vocabolario in alta frequenza — le prime 3.000 famiglie, che ogni corso insegna —, bassa frequenza oltre le 9.000 circa, che nessuno insegna e a nessuno serve, e una fascia intermedia che non aveva nome e che, in buona parte per questo, non aveva nemmeno un piano. La loro tesi è che è lì che la maggior parte di chi studia si arena in silenzio: sta fra il seguire una conversazione e il leggere un romanzo senza dizionario, ed è parecchie volte più grande del nucleo su cui tutti si concentrano.
A rendere scomoda quella fascia è una morsa fra due meccanismi. È troppo rara perché l'esposizione se ne occupi: una parola richiede qualcosa come otto-dodici incontri distanziati per restare (Nation e Wang, 1999; Webb, 2007), e una parola del settimo migliaio semplicemente non compare così spesso in nulla che leggeresti per piacere. Cobb (2007) ha modellato esattamente questo, facendo passare grandi volumi di testo in una simulazione di apprendimento incidentale, e ha trovato che la sola lettura lasciava non apprese la maggior parte delle fasce medie, per quanto si leggesse. Ed è troppo comune per saltarla, dato che sono proprio le parole che fanno la differenza fra l'84% di copertura e il 98% che Hu e Nation (2000) associano alla comprensione senza aiuto.
Quella morsa è l'argomento pratico a favore del ripasso distanziato deliberato, ed è stranamente preciso su dove debba andare lo sforzo. Il primo migliaio non ha quasi bisogno di aiuto: lo incontrerai di continuo in qualsiasi input. La coda oltre i diecimila non ne ha bisogno neanche lei, perché non è urgente. La fascia di media frequenza è l'unico posto in cui l'incontro non avverrà da solo e la parola vale la pena — il che equivale a dire che il valore di un sistema di ripasso dipende quasi interamente da quali parole ci metti dentro.
Dove si esaurisce ogni fonte di parole
Ogni modo di scegliere le parole funziona per un po' e poi si ferma. Sapere dove si ferma è più utile che avere una preferita, perché il fallimento raramente è che il metodo fosse sbagliato: è che è stato tenuto oltre il punto in cui ancora andava bene.
L'ultima riga è quella su cui la maggior parte di chi studia si trova senza essersene accorta.
| Fonte | Cosa consegna | Dove si esaurisce |
|---|---|---|
| Una lista di frequenza generale | Il nucleo, nell'ordine giusto, più in fretta di qualunque altro metodo | Intorno al terzo migliaio, dove la classifica smette di combaciare con i tuoi input e le parole iniziano a sembrare arbitrarie |
| Un corso o una lista tematica | Una situazione delimitata e abbastanza struttura per continuare | Appena ti serve qualcosa fuori dal tema — e comunque non è mai stata ordinata per frequenza |
| Leggere e guardare | Incontri ripetuti e contestualizzati con il nucleo ad alta frequenza, senza costo di sforzo | Nelle fasce di media frequenza, dove Cobb (2007) ha trovato che gli incontri sono semplicemente troppo radi per finire il lavoro |
| Le parole che raccogli tu | Alto carico di coinvolgimento e rilevanza perfetta per ciò che volevi dire | Da nessuna parte — ma tende al raro e al disordinato, quindi funziona come complemento e fallisce come piano intero |
Il motivo comune alle quattro righe è che nessuna fonte copre l'intero arco, e che la fascia di media frequenza è quella che cade fra tutte: troppo alta per la lista da principiante, troppo bassa per le tue ricerche, troppo rara perché l'input la consegni. Ciò di cui quella fascia ha bisogno non è una fonte migliore ma più incontri distanziati di quanti ne fornisca la vita ordinaria: ogni quanto ripassare il vocabolario.
Spendere i secondi sulle parole giuste
Se la selezione è la leva, il compito di un sistema è mettere una parola scelta davanti a te abbastanza spesso, senza chiederti di programmare niente. LearnScreen lo fa con il momento che hai già — il gesto verso il telefono —, così lo sforzo va nel decidere quali parole e non nel trovare loro il tempo.
La lista è già ordinata
Oltre 1.080 parole selezionate in 18 temi, messe in sequenza perché il nucleo quotidiano venga prima del vocabolario specialistico, e non nell'ordine in cui lo ha introdotto un capitolo di manuale. Undici lingue sono disponibili come lingua di studio.
Le tue parole stanno accanto
Parole personali illimitate con traduzione, trascrizione e frase d'esempio: quelle di media frequenza e quelle che servono a te, che nessuna lista generale può prevedere, nella stessa coda del nucleo invece che in un quaderno che smetti di aprire.
Gli incontri arrivano da soli
Il telefono viene controllato circa 186 volte al giorno, circa 11,6 volte per ora di veglia (Reviews.org, 2026). L'API Tempo di utilizzo di Apple permette a LearnScreen di bloccare le app che scegli e mettere una parola dove sarebbe stato il feed: gli incontri che una parola rara richiede avvengono senza essere programmati.
- Uno schema di Leitner decide l'ordine di ritorno. Le parole sbagliate tornano prima e quelle giuste si distanziano geometricamente, ed è questo che trasforma una lista lunga in un numero gestibile di incontri quotidiani.
- La dose la scegli tu. Da 3 a 20 parole per sessione, e altrettanto per quanto spesso torna il blocco; con le impostazioni predefinite vengono circa 25 tentativi di richiamo al giorno, circa due minuti e mezzo distribuiti.
- La risposta resta nascosta finché non tocchi. Ogni scheda è un tentativo di richiamo e non una lettura, che è la direzione che trasferisce: vocabolario attivo e passivo.
- Funziona offline e senza account. Schede e blocchi funzionano senza rete una volta installata l'app; il backup su iCloud scrive nel tuo database privato e non sui nostri server, e non c'è alcuna registrazione.
Da leggere dopo
- Quante parole servono per parlare una lingua? — La dimensione dell'intero lavoro, per obiettivo e livello QCER.
- Quante parole al giorno? — Il ritmo con cui si percorre la lista scelta.
- Conviene imparare le parole in contesto? — Cosa mettere sulla scheda una volta scelta la parola.
- Ogni quanto ripassare il vocabolario? — Gli intervalli che servono a una parola rara per sopravvivere.
- L'apprendimento passivo funziona? — Cosa produce la sola esposizione e dove si ferma.
- Perché dimentico le parole? — Cosa succede a una parola fra due incontri.
Domande frequenti
Fonti
- Nation, I. S. P., & Waring, R. (1997). Vocabulary size, text coverage and word lists. In N. Schmitt & M. McCarthy (Eds.), Vocabulary: Description, Acquisition and Pedagogy (pp. 6–19). Cambridge University Press.
- Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
- Schmitt, N., & Schmitt, D. (2014). A reassessment of frequency and vocabulary size in L2 vocabulary teaching. Language Teaching, 47(4), 484–503.
- Zipf, G. K. (1949). Human Behavior and the Principle of Least Effort. Addison-Wesley.
- Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438.
- Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
- Laufer, B., & Ravenhorst-Kalovski, G. C. (2010). Lexical threshold revisited: Lexical text coverage, learners’ vocabulary size and reading comprehension. Reading in a Foreign Language, 22(1), 15–30.
- Webb, S., & Rodgers, M. P. H. (2009). Vocabulary demands of television programs. Language Learning, 59(2), 335–366.
- van Zeeland, H., & Schmitt, N. (2013). Lexical coverage in L1 and L2 listening comprehension: The same or different from reading comprehension? Applied Linguistics, 34(4), 457–479.
- Cobb, T. (2007). Computing the vocabulary demands of L2 reading. Language Learning & Technology, 11(3), 38–63.
- Laufer, B., & Hulstijn, J. (2001). Incidental vocabulary acquisition in a second language: The construct of task-induced involvement. Applied Linguistics, 22(1), 1–26.
- de Groot, A. M. B., & Keijzer, R. (2000). What is hard to learn is easy to forget: The roles of word concreteness, cognate status, and word frequency. Language Learning, 50(1), 1–56.
- Brysbaert, M., Stevens, M., Mandera, P., & Keuleers, E. (2016). How many words do we know? Frontiers in Psychology, 7, 1116.
- Bauer, L., & Nation, P. (1993). Word families. International Journal of Lexicography, 6(4), 253–279.
- Schmitt, N., Jiang, X., & Grabe, W. (2011). The percentage of words known in a text and reading comprehension. Modern Language Journal, 95(1), 26–43.
- Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
- Webb, S. (2007). The effects of repetition on vocabulary knowledge. Applied Linguistics, 28(1), 46–65.
- Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report
Le percentuali di copertura sono statistiche di corpus dell'inglese, e le cifre esatte si spostano con il corpus, il tipo di testo e l'unità contata: famiglie di parole, lemmi e tipi danno numeri diversi per lo stesso testo. Le lingue con flessione più ricca o composizione produttiva si distribuiscono diversamente, quindi prendi le percentuali specifiche come dell'inglese e la forma della curva come generale. Schmitt, Jiang e Grabe (2011) hanno inoltre trovato che il rapporto fra copertura e comprensione è nel complesso lineare e non un dirupo, per cui il 95% e il 98% sono riferimenti utili e non soglie in cui la comprensione si accende. I conteggi delle schede e i totali giornalieri sono aritmetica a partire da un tentativo di richiamo di una ventina di secondi, non dati misurati nell'app.
Metti le parole giuste dove le vedrai
LearnScreen tiene in un'unica coda distanziata un nucleo selezionato e le tue parole, e le consegna nel momento in cui prendi il telefono — così le parole che la vita ordinaria non ripete mai abbastanza ricevono comunque i loro incontri.
Scarica su App Store
