Vai al contenuto
La ricerca sull’ascolto, applicata alla tua lista

Ascoltare una lingua
basta per impararla?

Per il sistema dei suoni sì, per il lessico molto meno — e le prove che separano le due cose sono insolitamente pulite. Bambini di nove mesi esposti al cinese da una persona presente ne hanno appreso i contrasti fonetici in dodici sessioni; chi ha ricevuto il materiale identico come registrazione audio non ha imparato nulla di misurabile (Kuhl, Tsao e Liu, 2003). Seguire il parlato spontaneo al 98 % richiede circa 6.000–7.000 famiglie di parole (Nation, 2006), e una parola ha bisogno di cinque-venti incontri prima di restare (Nation e Wang, 1999): esattamente ciò che un flusso audio non può programmare.

Tutti i numeri sono referenziati in fondo alla pagina

Una scheda di vocabolario sulla schermata di blocco di un iPhone, nel momento in cui si apre un’app bloccata

Cosa è stato davvero misurato sull’ascolto

«Tu ascolta e basta» è il consiglio linguistico più ripetuto e meno specificato che esista, ed è un peccato, perché l’ascolto è uno dei pochi comportamenti di apprendimento isolati in laboratorio e messi a confronto con sé stessi. Si è messa una persona presente contro la registrazione della stessa persona, si è contato il lessico che il parlato ordinario richiede, si è misurato cosa lascia una breve sessione di ascolto e si è verificato se l’audio riprodotto nel sonno faccia qualcosa. Il quadro che ne esce è più netto di quanto ammetta di solito ciascuna delle due fazioni.

Un avvertimento va in alto e non in nota: gli studi più puliti riguardano neonati e fonologia, non adulti e lessico. Un bambino di nove mesi che impara i toni del cinese non è un pendolare che impara sostantivi inglesi, e gli studi sull’acquisizione incidentale che usano davvero adulti sono brevi e testano soprattutto il riconoscimento. Dei numeri qui sotto serve la forma dell’effetto — quali strati di una lingua entrano da soli attraverso l’orecchio e quali non entrano mai —, non una promessa sul tuo dicembre.

Cinque risultati della ricerca sull’imparare una lingua ascoltando e cosa implica ciascuno
Cosa è stato misuratoCosa ha trovato lo studioCosa significa per te
Se l’audio da solo insegna il suonoKuhl, Tsao e Liu (2003): bambini di nove mesi esposti al cinese da una persona presente ne hanno appreso i contrasti fonetici; i gruppi che hanno ricevuto lo stesso materiale come audio o video non hanno mostrato apprendimento misurabileL’onda sonora era identica e ha funzionato una sola condizione. L’audio che gira nella stanza è proprio quella che non ha insegnato nulla: utile saperlo prima di comprarne un anno
Cosa l’ascolto insegna davvero, e in frettaSaffran, Aslin e Newport (1996): bambini di otto mesi hanno estratto i confini tra parole da due minuti di parlato continuo privo di senso, usando solo la statistica di quale sillaba segue qualeQuesto è il vero premio, e costa quasi nulla. Il tuo orecchio comincia a tirare struttura dal flusso molto prima che tu ne capisca una parola
Il lessico che il parlato richiedeNation (2006): circa 6.000–7.000 famiglie di parole per coprire il 98 % della lingua parlata, e circa 3.000 per il 95 %C’è una soglia, e pesa più di tutto il resto. Sotto le 3.000 famiglie circa, un episodio è suono che non riesci a tagliare in parole, per quante ore tu accumuli
Cosa lascia un’ora di ascoltoVan Zeeland e Schmitt (2013): i guadagni incidentali ascoltando racconti erano reali ma modesti, e il significato è rimasto assai più della formaTi resta un’idea sfocata di parole che già conoscevi a metà. La forma scritta — quella che ti serve per reincontrare la parola altrove — quasi non arriva
Se la parola sia recuperabile dopoKarpicke e Roediger (2008): il recupero attivo ha battuto lo studio ripetuto nella ritenzione successiva, con un vantaggio che cresce col tempoAscoltare è riesposizione a valanghe e recupero mai. Questa sola lacuna spiega l’orecchio comodo e la bocca vuota meglio di qualsiasi teoria sul talento

Leggi insieme le prime due righe. L’ascolto non è debole: è specifico. Consegna lo strato della lingua quasi impossibile da studiare di proposito, ed è quasi indifferente allo strato con cui tutti misurano i progressi. La soglia della terza riga è un numero che puoi stimare: quante parole servono per parlare una lingua?

Sotto «mettiti un podcast» viaggiano tre affermazioni diverse

Poggiano su prove completamente diverse, ed è per questo che il consiglio suona ovvio e insieme vagamente insoddisfacente. Solo le prime due reggono al contatto con gli studi, e la seconda solo sopra una soglia.

  • Quella solida: il tuo orecchio si ricostruisce. È il guadagno vero e non è piccolo. Ascoltare molto allena a tagliare il flusso in parole, a sopravvivere alla velocità e all’accento, a proseguire quando qualcosa sfugge; Saffran, Aslin e Newport (1996) hanno visto quel meccanismo girare con due minuti di input in bambini di otto mesi. Nessuna flashcard lo ha mai insegnato a nessuno. Se il tuo punto debole è l’ascolto, l’audio è quasi lo strumento ideale.
  • Quella condizionata: questo è input comprensibile. Vera sopra la soglia di copertura e falsa sotto. Nation (2006) colloca il 95 % di copertura del parlato attorno a 3.000 famiglie di parole e il 98 % tra 6.000 e 7.000; la comprensione sale ripida in quella fascia. Sotto, l’audio non è input in alcun senso utile: non si ricostruisce una frase quando manca una parola su dieci e non senti nemmeno dove finiscono le altre.
  • Quella falsa: le parole arriveranno da sole. Ciò che resta è limitato dalla frequenza. Peters e Webb (2018) hanno trovato che il numero di occorrenze prediceva l’apprendimento, e Nation e Wang (1999) collocano gli incontri necessari tra cinque e venti. Un episodio di un’ora ti consegna quasi tutto il suo lessico interessante esattamente una volta, che è proprio il caso in cui vince la curva dell’oblio.

La versione generale di questa domanda — cosa compra l’esposizione di qualunque tipo e dove si ferma — ha una pagina sua: l’apprendimento passivo funziona davvero?

Sei cose decidono se un’ora di ascolto ti insegna qualcosa

Due persone possono ascoltare le stesse ore in un anno e finire in posti completamente diversi. Nessuna delle sei ragioni è il talento e solo una è lo sforzo. Le altre sono proprietà del materiale e del calendario, ed è la buona notizia: sono quelle che si possono cambiare.

Sei fattori che decidono quanto rende l’ascolto, le prove per ciascuno e cosa fare
Cosa decideCosa dicono le proveCosa fare
Se c’è davvero qualcuno dall’altra parteKuhl, Tsao e Liu (2003): l’esposizione dal vivo ha prodotto apprendimento fonetico; quella registrata, con lo stesso materiale, nessunoTratta le registrazioni come pratica, non come lezione. Tutto ciò che ti costringe a rispondere — una persona, una pausa, una domanda — fa un lavoro che l’audio non fa
La tua copertura del materialeNation (2006): ~3.000 famiglie di parole per il 95 % di copertura del parlato, ~6.000–7.000 per il 98 %Sotto la soglia, dedica parte del tempo al nucleo frequente. È ciò che rende redditizia ogni ora di ascolto successiva
Quante volte una parola ritornaPeters e Webb (2018): la frequenza nel materiale prediceva l’apprendimento; Nation e Wang (1999): da cinque a venti incontri per parolaResta su un conduttore, una serie, un argomento. L’ascolto stretto trasforma incontri unici in ripetuti senza costi
Se mai recuperi qualcosa dalla memoriaKarpicke e Roediger (2008): il recupero attivo ha battuto lo studio ripetuto nella ritenzione successivaL’audio è tutta conferma e nessun recupero. Qualcosa fuori dal flusso deve farti la domanda
L’intervallo tra gli incontriCepeda et al. (2006), 254 studi: circa 47 % di richiamo distanziato contro 37 % massivoCosa ritorna, e quando, lo decide una scaletta. Nessuna playlist è mai stata ordinata in base a ciò che hai dimenticato
Cosa succede tra un episodio e l’altroMurre e Dros (2015): la classica curva dell’oblio si replica; ciò che non viene recuperato decade più in fretta subito dopo l’incontroLa parola cercata martedì deve tornare prima di venerdì, e l’episodio della settimana prossima non la porterà

Nota cosa manca da quella lista: concentrazione, disciplina e attitudine. Niente di tutto questo fallisce perché non hai ascoltato con abbastanza attenzione. Fallisce perché una registrazione non ha idea di quale parola ti sia sfuggita — ed è proprio quell’indifferenza a rendere l’ascolto piacevole per anni.

L’orecchio è reale. Manca il secondo incontro.

L’ascolto azzecca ciò che quasi ogni metodo deliberato sbaglia: è sostenibile. Nessuno va convinto a far partire un episodio sulla strada per il lavoro, nessuno spezza una serie, e l’input arriva in quantità, in un formato che il cervello accetta per quaranta minuti di fila. I quattro fili di Nation (2007) collocano l’input centrato sul significato attorno a un quarto di un programma equilibrato, e l’audio riempie quel quarto nei vuoti della giornata — la camminata, i piatti, la palestra — dove non arriva nient’altro. Tienilo. L’argomento qui non è che i podcast siano tempo perso: è che si chiede loro un lavoro per cui non sono mai stati fatti.

Quello che non possono fare è tornare. Un episodio decide cosa senti dopo secondo la propria scaletta; non sa quale parola ti abbia fatto riavvolgere, e non ha modo di reintrodurla tre giorni dopo, cioè quando varrebbe di più. Così le parole che il conduttore ripete si imparano quasi gratis, e quelle comparse una volta — di solito le interessanti, di frequenza media, quelle che ti servivano davvero — decadono lungo la curva di sempre (Murre e Dros, 2015). Qualche centinaio di ore dopo il profilo è familiare a chiunque ci sia passato: comprensione comoda, un orecchio che regge la velocità e un lessico parcheggiato attorno a ciò che il programma dice ogni settimana.

La riparazione è piccola, e non consiste nell’ascoltare di più. È un secondo incontro con le parole precise che sono sfuggite, distanziato nel tempo e in forma di domanda anziché di replica: la combinazione che Cepeda e colleghi (2006) hanno misurato attorno al 47 % di richiamo contro il 37 % massivo, e che Karpicke e Roediger (2008) hanno trovato superiore alla rilettura. La parte scomoda è sempre stata dove metterlo, perché una sessione di ripasso è una cosa in più da fissare e fissare è esattamente il passo in cui le persone falliscono. Da qui la convenienza di appoggiarlo su una superficie che si ripete già da sola: il telefono viene preso in mano circa 186 volte al giorno (Reviews.org, 2026), e nessuna di quelle volte va pianificata.

Podcast, musica, radio di sottofondo, audio nel sonno

Vengono raccomandati in un fiato come se fossero lo stesso intervento, e la ricerca li tratta in modi molto diversi. Due reggono, uno regge per una ragione che quasi tutti invertono, e uno funziona solo in un senso abbastanza stretto da meritare di essere detto con precisione.

Lo schema sotto è ogni volta lo stesso: più il formato ti chiede qualcosa, più te ne resta.

Quattro formati di ascolto, le prove a sostegno di ciascuno e ciò che nessuno farà
FormatoCosa sostengono le proveCosa non farà
Podcast e audiolibri al tuo livelloVan Zeeland e Schmitt (2013): guadagni incidentali reali seppur modesti ascoltando racconti, sopra la fascia di copertura che Nation (2006) fissa a ~3.000 famiglie per il 95 %Darti la forma scritta né restituirti la parola sfuggita. Il significato resta assai più della forma, e nessuno dei due è programmato
Musica e canzoniLudke, Ferreira e Schellenberg (2014): gli adulti che hanno cantato frasi in ungherese le ricordavano poi meglio di chi le aveva dette parlandoFunzionare con la musica semplicemente accesa. L’ingrediente attivo di quello studio era produrre la lingua; il testo di sottofondo è la condizione non testata, non quella testata
Radio di sottofondo mentre lavoriSaffran et al. (1996): la struttura fonologica si estrae dal flusso a costo sorprendentemente basso, quindi la familiarità col suono della lingua è un guadagno realeInsegnare lessico. È ciò che più assomiglia alla condizione audio registrato di Kuhl et al. (2003), quella che non ha prodotto apprendimento misurabile
Audio riprodotto durante il sonnoSchreiner e Rasch (2015): riprodurre parole che i partecipanti avevano già studiato prima di dormire ha migliorato il richiamo esattamente di quelle paroleInsegnarti una parola mai incontrata. Quel risultato è riattivazione di una traccia esistente: può chiudere un lavoro iniziato da svegli, non iniziarlo

La riga sul sonno è quella più spesso citata senza la sua condizione, quindi vale ripeterla: le parole hanno funzionato perché erano state studiate prima. Se ti interessa la questione del momento in cui studiare, ha una pagina sua: conviene studiare il lessico prima di dormire?

Un posto per le parole che l’episodio ha detto una volta

Quella distanza tra sentire una parola e saperla produrre è il motivo per cui è nato LearnScreen. Tieniti il podcast. Le parole per cui hai riavvolto tornano su una superficie che avresti guardato comunque.

1

La parola che hai riavvolto diventa una scheda

Aggiungila in pochi secondi dal foglio di condivisione, o incolla un’intera lista dopo l’episodio, ciascuna con traduzione e frase d’esempio. Entra nella stessa coda delle liste integrate: la parola detta una sola volta comincia a comportarsi come una parola frequente, e finalmente arriva con la forma scritta che l’ascolto le aveva negato.

2

Torna come domanda, non come replica

Usando l’API Tempo di utilizzo di Apple, LearnScreen blocca le app che scegli e mette la scheda dove sarebbe stato il feed, con la risposta nascosta finché non ti impegni in un tentativo. Ogni incontro diventa recupero: l’operazione che Karpicke e Roediger (2008) hanno trovato superiore alla riesposizione, e quella che un flusso audio strutturalmente non può eseguire.

3

Uno schema Leitner decide cosa torna

Le parole sbagliate tornano prima; quelle giuste si allontanano geometricamente. La distanza segue quanto conosci ogni parola invece della scaletta di un programma — la parte che la ricerca sulla pratica distribuita (Cepeda et al., 2006) indica come decisiva, e quella che nessuna playlist ha mai potuto fornire.

  • Non si aggiunge nulla in agenda. Il ripasso cade su sblocchi che facevi già, ed è per questo che sopravvive alle settimane in cui un episodio sulla strada per l’ufficio è tutto ciò che riesci a fare. Con le impostazioni predefinite sono circa 25 tentativi di richiamo al giorno: due minuti e mezzo scarsi, distribuiti su momenti che non usavi per niente.
  • Parti dal nucleo frequente se sei sotto la soglia. Oltre 1.080 parole selezionate in 18 temi e 11 lingue, ordinate perché la copertura più economica arrivi per prima — la via più rapida verso le ~3.000 famiglie che rendono leggibile il parlato ordinario (quali parole vengono prima).
  • Le tue parole, anche in blocco. Aggiungine una dal foglio di condivisione a metà episodio o incolla la lista costruita in viaggio; ogni voce accetta traduzione e frase d’esempio, così la scheda conserva il senso che l’episodio le aveva dato.
  • Offline, senza account. Schede e blocchi funzionano senza rete una volta installata l’app, e il backup su iCloud scrive nel tuo database privato, non sui nostri server.

Dove compaiono le parole

Quattro schermate dell’app: la scheda di blocco, la risposta con la frase d’esempio, la lista delle parole e i progressi.

Un’app bloccata che mostra una scheda di vocabolario sulla schermata di blocco al posto del feed La risposta svelata sulla scheda, con la traduzione e una frase d’esempio che usa la parola La lista di vocabolario con i temi selezionati accanto alle parole aggiunte dall’utente La schermata dei progressi con quante parole sono salite nella coda di ripetizione distanziata

Da leggere dopo

Domande frequenti

Si può imparare una lingua solo ascoltandola?
Se ne può imparare così buona parte del sistema dei suoni, e pochissimo lessico. L’ascolto allena segmentazione, ritmo e contrasti fonetici: è reale e difficile da ottenere altrimenti. Ma quanto resta di lessico dipende da copertura e ripetizione: sotto le 3.000 famiglie di parole circa una registrazione è suono che non riesci a tagliare in parole, e una parola richiede da cinque a venti incontri per restare (Nation e Wang, 1999). Nulla in un flusso audio è programmato in base a ciò che hai dimenticato.
I podcast aiutano davvero a imparare una lingua?
Sì, sopra una soglia, e soprattutto per la comprensione orale più che per il lessico. Nation (2006) colloca il 98 % di copertura del parlato tra 6.000 e 7.000 famiglie di parole, e il 95 % attorno a 3.000. Sopra quella fascia un podcast è input comprensibile e un ottimo uso del tragitto. Sotto, la comprensione crolla e ciò che alleni è tollerare la confusione. In ogni caso le parole dette una volta non torneranno secondo un calendario.
Ascoltare musica in un’altra lingua aiuta?
Le prove esistenti riguardano il cantare, non l’ascoltare. Ludke, Ferreira e Schellenberg (2014) hanno trovato che gli adulti che cantavano frasi in ungherese le ricordavano poi meglio di chi le aveva dette parlando. L’ingrediente attivo era produrre la lingua, non avere la musica accesa. Il testo di sottofondo assomiglia di più alla condizione che ripetutamente non ha mostrato apprendimento misurabile.
Ascoltare una lingua mentre si dorme funziona?
Per imparare parole nuove no, e in un senso stretto sì. Schreiner e Rasch (2015) hanno riprodotto parole straniere che i partecipanti avevano già studiato prima di dormire e hanno trovato un richiamo migliore proprio per quelle parole. È riattivazione di una memoria già esistente, non acquisizione. Bisogna aver incontrato la parola da svegli, il che rende l’audio notturno una possibile rifinitura e mai un sostituto.
Perché capisco molto più di quanto sappia dire?
Perché l’ascolto fornisce riconoscimento e non chiede mai recupero. Karpicke e Roediger (2008) hanno trovato che il recupero attivo batte lo studio ripetuto nella ritenzione successiva, e ore di input sono studio ripetuto per definizione. Orecchio comodo e bocca vuota è esattamente il profilo che prevederesti dopo anni di esposizione di qualità senza alcun recupero associato. La distanza ha una pagina sua: lessico attivo e passivo.
Quanto ascolto al giorno conviene?
Quanto ti va, visto che è il filo che sopravvive a una settimana storta. Nation (2007) colloca l’input centrato sul significato attorno a un quarto di un programma equilibrato, e l’audio riempie tragitti e faccende dove non arriva nient’altro. Ciò che conviene aggiungere è poco: qualche breve tentativo di richiamo per le parole precise che ti sono sfuggite, distanziato. La pratica distribuita ha dato circa il 47 % di richiamo contro il 37 % di quella massiva (Cepeda et al., 2006).

Fonti

  1. Kuhl, P. K., Tsao, F.-M., & Liu, H.-M. (2003). Foreign-language experience in infancy: Effects of short-term exposure and social interaction on phonetic learning. PNAS, 100(15), 9096–9101.
  2. Saffran, J. R., Aslin, R. N., & Newport, E. L. (1996). Statistical learning by 8-month-old infants. Science, 274(5294), 1926–1928.
  3. van Zeeland, H., & Schmitt, N. (2013). Incidental vocabulary acquisition through L2 listening: A dimensions approach. System, 41(3), 609–624.
  4. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  5. Peters, E., & Webb, S. (2018). Incidental vocabulary acquisition through viewing L2 television and factors that affect learning. Studies in Second Language Acquisition, 40(3), 551–577.
  6. Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
  7. Schreiner, T., & Rasch, B. (2015). Boosting vocabulary learning by verbal cueing during sleep. Cerebral Cortex, 25(11), 4169–4179.
  8. Ludke, K. M., Ferreira, F., & Schellenberg, E. G. (2014). Singing can facilitate foreign language learning. Memory & Cognition, 42(1), 41–52.
  9. Karpicke, J. D., & Roediger, H. L. (2008). The critical importance of retrieval for learning. Science, 319(5865), 966–968.
  10. Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380.
  11. Murre, J. M. J., & Dros, J. (2015). Replication and analysis of Ebbinghaus’ forgetting curve. PLOS ONE, 10(7), e0120644.
  12. Nation, I. S. P. (2007). The four strands. Innovation in Language Learning and Teaching, 1(1), 2–13.
  13. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

Con i numeri conviene portarsi via tre limiti. Gli studi sull’apprendimento fonetico riguardano neonati, e un neonato non è un adulto in formato ridotto: ciò che si trasferisce è il confronto tra le condizioni, non l’età. Gli studi sull’ascolto incidentale sono brevi e testano il riconoscimento più della produzione, quindi sottostimano cosa facciano anni di ascolto e sovrastimano quanto sia misurabile una singola ora. E il risultato sul sonno vale solo per parole già studiate prima di dormire. Dove questa pagina dà un numero, viene dallo studio citato accanto; dove generalizza al tuo ascolto, è un’inferenza, ed è segnalata come tale.

Continua ad ascoltare. Non lasciare che le parole se ne vadano con l’episodio.

La parola per cui hai riavvolto, di ritorno come domanda, su uno schermo che sblocchi già.

Scarica su App Store