Lernt man eine Sprache
durch Hören?
Für das Lautsystem ja, für den Wortschatz deutlich weniger – und die Befunde, die beides trennen, sind ungewöhnlich sauber. Neun Monate alte Babys, die Mandarin von einem anwesenden Menschen hörten, lernten dessen Lautkontraste in zwölf Sitzungen; wer dasselbe Material als reine Tonaufnahme bekam, lernte nichts Messbares (Kuhl, Tsao & Liu, 2003). Spontan gesprochener Sprache zu 98 % zu folgen verlangt rund 6.000–7.000 Wortfamilien (Nation, 2006), und ein Wort braucht fünf bis zwanzig Begegnungen, bis es bleibt (Nation & Wang, 1999) – genau das, was ein Audiofeed nicht planen kann.
Alle Zahlen sind am Seitenende belegt

Was Hören tatsächlich messbar bewirkt
„Hör einfach viel“ ist der meistgegebene und am wenigsten präzisierte Sprachlernrat überhaupt – schade, denn Hören gehört zu den wenigen Lernverhalten, die man im Labor isoliert und gegen sich selbst getestet hat. Man hat einen anwesenden Menschen gegen die Aufnahme genau dieses Menschen gestellt, den Wortschatz gezählt, den normale Rede verlangt, gemessen, was eine kurze Hörsitzung hinterlässt, und geprüft, ob Audio im Schlaf überhaupt etwas tut. Das Bild, das dabei herauskommt, ist schärfer, als beide Lager üblicherweise zugeben.
Eine Einschränkung gehört nach oben und nicht in eine Fußnote: die saubersten Studien handeln von Babys und Phonologie, nicht von Erwachsenen und Wortschatz. Ein Neunmonatiges, das Mandarin-Töne lernt, ist kein Pendler, der englische Substantive lernt, und die Studien zum beiläufigen Hören, die tatsächlich Erwachsene verwenden, sind kurz und prüfen überwiegend Wiedererkennen. Brauchbar an den Zahlen unten ist die Form des Effekts – welche Schichten einer Sprache von allein durchs Ohr kommen und welche nie –, kein Versprechen über deinen Dezember.
| Was gemessen wurde | Was die Studie fand | Was das für dich heißt |
|---|---|---|
| Ob Ton allein Laute lehrt | Kuhl, Tsao & Liu (2003): Neunmonatige, die Mandarin von einem anwesenden Menschen hörten, lernten dessen Lautkontraste; die Gruppen mit demselben Material als Ton- oder Videoaufnahme zeigten kein messbares Lernen | Die Schallwelle war identisch, und nur eine Bedingung funktionierte. Audio, das im Raum läuft, ist genau die, die nichts gelehrt hat – gut zu wissen, bevor man ein Jahr davon kauft |
| Was Hören sehr wohl lehrt, und zwar rasend schnell | Saffran, Aslin & Newport (1996): Achtmonatige zogen Wortgrenzen aus zwei Minuten zusammenhängender, bedeutungsloser Rede – allein aus der Statistik, welche Silbe auf welche folgt | Das ist der eigentliche Gewinn, und er ist fast umsonst. Dein Ohr beginnt Struktur aus dem Strom zu ziehen, lange bevor du ein Wort verstehst |
| Wie viel Wortschatz Rede verlangt | Nation (2006): rund 6.000–7.000 Wortfamilien für 98 % Abdeckung gesprochener Sprache, etwa 3.000 für 95 % | Es gibt eine Schwelle, und sie wiegt schwerer als alles andere. Unter etwa 3.000 Familien ist eine Folge Schall, den du nicht in Wörter zerlegen kannst – egal wie viele Stunden du sammelst |
| Was eine Stunde Hören hinterlässt | Van Zeeland & Schmitt (2013): beiläufige Zugewinne beim Hören von Geschichten waren real, aber bescheiden, und die Bedeutung blieb weit eher hängen als die Form | Es bleibt eine vage Ahnung von Wörtern, die du halb schon kanntest. Die Schriftform – die, die du brauchst, um dem Wort anderswo wiederzubegegnen – kommt kaum mit |
| Ob das Wort später abrufbar ist | Karpicke & Roediger (2008): aktives Abrufen schlug wiederholtes Lernen bei der späteren Behaltensleistung, mit wachsendem Abstand deutlicher | Hören ist Wiederbegegnung in Massen und Abruf nie. Diese eine Lücke erklärt das bequeme Ohr und den leeren Mund besser als jede Begabungstheorie |
Lies die ersten beiden Zeilen zusammen. Hören ist nicht schwach, es ist spezifisch. Es liefert genau die Schicht einer Sprache, die man kaum absichtlich üben kann, und ist nahezu gleichgültig gegenüber der Schicht, an der alle ihren Fortschritt messen. Die Schwelle aus Zeile drei kannst du selbst schätzen: wie viele Wörter braucht man, um eine Sprache zu sprechen?
Unter „hör einfach Podcasts“ reisen drei verschiedene Behauptungen
Sie stützen sich auf völlig unterschiedliche Belege – deshalb klingt der Rat gleichzeitig selbstverständlich und leise unbefriedigend. Nur die ersten beiden überstehen den Kontakt mit den Studien, und die zweite nur oberhalb einer Schwelle.
- Die belegte: dein Ohr baut sich um. Das ist der echte Ertrag, und er ist nicht klein. Viel Hören trainiert, den Strom in Wörter zu schneiden, Tempo und Akzent zu überstehen und weiterzumachen, wenn etwas durchrutscht – Saffran, Aslin und Newport (1996) sahen diese Maschinerie bei Achtmonatigen mit zwei Minuten Input laufen. Keine Vokabelkarte hat das je jemandem beigebracht. Wenn Hörverstehen dein schwacher Strang ist, ist Audio nahezu das ideale Instrument.
- Die bedingte: das ist verständlicher Input. Oberhalb der Abdeckungsschwelle wahr, darunter falsch. Nation (2006) setzt 95 % Abdeckung gesprochener Sprache bei rund 3.000 Wortfamilien an und 98 % bei 6.000–7.000; das Verstehen steigt in diesem Band steil. Darunter ist Audio in keinem brauchbaren Sinn Input: Man rekonstruiert keinen Satz, wenn jedes zehnte Wort fehlt und man nicht einmal hört, wo die anderen enden.
- Die falsche: die Wörter kommen von selbst. Was hängenbleibt, ist frequenzbegrenzt. Peters und Webb (2018) fanden, dass die Häufigkeit eines Wortes im Material vorhersagte, ob es gelernt wurde, und Nation und Wang (1999) setzen die nötigen Begegnungen zwischen fünf und zwanzig an. Eine einstündige Folge liefert dir ihren interessanten Wortschatz genau einmal – exakt der Fall, in dem die Vergessenskurve gewinnt.
Die allgemeine Fassung dieser Frage – was Exposition jeder Art bringt und wo sie aufhört – hat eine eigene Seite: funktioniert passives Lernen wirklich?
Sechs Dinge entscheiden, ob eine Stunde Hören dir etwas beibringt
Zwei Menschen können im Jahr gleich viele Stunden hören und völlig verschieden enden. Keiner der sechs Gründe ist Begabung, und nur einer ist Anstrengung. Der Rest sind Eigenschaften des Materials und des Kalenders – und das ist die gute Nachricht, denn genau die lassen sich ändern.
| Was entscheidet | Was die Belege sagen | Was zu tun ist |
|---|---|---|
| Ob wirklich jemand da ist | Kuhl, Tsao & Liu (2003): Live-Exposition erzeugte phonetisches Lernen; aufgezeichnete Exposition mit demselben Material keines | Behandle Aufnahmen als Übung, nicht als Unterricht. Alles, was dich zu einer Reaktion zwingt – ein Mensch, eine Pause, eine Frage – leistet, was das Audio nicht leistet |
| Deine Abdeckung des Materials | Nation (2006): ~3.000 Wortfamilien für 95 % Abdeckung gesprochener Sprache, ~6.000–7.000 für 98 % | Unter der Schwelle steck einen Teil der Zeit in den häufigen Kern. Er ist es, der jede spätere Hörstunde rentabel macht |
| Wie oft ein Wort wiederkommt | Peters & Webb (2018): die Häufigkeit im Material sagte das Lernen vorher; Nation & Wang (1999): fünf bis zwanzig Begegnungen pro Wort | Bleib bei einem Host, einer Serie, einem Thema. Enges Hören macht aus einmaligen Begegnungen wiederholte, ohne Mehraufwand |
| Ob du je etwas abrufst | Karpicke & Roediger (2008): aktives Abrufen schlug wiederholtes Lernen bei der späteren Behaltensleistung | Audio ist lauter Bestätigung und nie Abruf. Etwas außerhalb des Feeds muss dir die Frage stellen |
| Der Abstand zwischen Begegnungen | Cepeda et al. (2006), 254 Studien: rund 47 % Behalten verteilt gegen 37 % geballt | Was wiederkommt und wann, entscheidet ein Sendeablauf. Keine Playlist wurde je danach sortiert, was du vergessen hast |
| Was zwischen zwei Folgen passiert | Murre & Dros (2015): die klassische Vergessenskurve repliziert; nicht Abgerufenes zerfällt direkt nach der Begegnung am schnellsten | Das Wort, das du am Dienstag nachgeschlagen hast, muss vor Freitag wiederkommen – und die Folge nächste Woche bringt es nicht |
Achte darauf, was auf dieser Liste fehlt: Konzentration, Disziplin und Talent. Nichts davon scheitert daran, dass du nicht aufmerksam genug zugehört hättest. Es scheitert, weil eine Aufnahme keine Ahnung hat, welches Wort dir entgangen ist – und genau diese Gleichgültigkeit macht Hören über Jahre hinweg angenehm.
Das Ohr ist echt. Was fehlt, ist die zweite Begegnung.
Hören macht richtig, woran fast jede bewusste Methode scheitert: Es ist durchhaltbar. Niemand muss zu einer Folge auf dem Arbeitsweg überredet werden, niemand reißt eine Serie ab, und der Input kommt in Menge, in einem Format, das das Gehirn vierzig Minuten am Stück akzeptiert. Nations vier Stränge (2007) setzen bedeutungsorientierten Input bei etwa einem Viertel eines ausgewogenen Programms an, und Audio füllt dieses Viertel genau in den Lücken des Tages – Weg, Abwasch, Fitnessstudio –, an die sonst nichts herankommt. Behalte es. Das Argument hier lautet nicht, dass Podcasts Zeitverschwendung sind, sondern dass ihnen eine Aufgabe zugemutet wird, für die sie nie geformt waren.
Was sie nicht können, ist wiederkommen. Eine Folge entscheidet nach ihrem eigenen Ablauf, was du als Nächstes hörst; sie weiß nicht, welches Wort dich zum Zurückspulen brachte, und hat keine Möglichkeit, es drei Tage später erneut zu bringen – also dann, wenn es am meisten wert wäre. Die Wörter, die der Host zufällig wiederholt, lernst du fast umsonst; die, die einmal vorkamen – meist die interessanten mittelfrequenten, die du wirklich gebraucht hättest –, zerfallen entlang der gewöhnlichen Kurve (Murre & Dros, 2015). Ein paar hundert Stunden später ist das Profil jedem vertraut, der es durchgemacht hat: bequemes Verstehen, ein Ohr, das Tempo aushält, und ein Wortschatz, der um das parkt, was die Sendung jede Woche sagt.
Die Reparatur ist klein, und sie heißt nicht mehr hören. Sie heißt: eine zweite Begegnung mit genau den Wörtern, die durchgerutscht sind, zeitlich verteilt und als Frage statt als Wiederholung – die Kombination, die Cepeda und Kollegen (2006) bei rund 47 % Behalten gegen 37 % geballt maßen und die Karpicke und Roediger (2008) dem Nochmal-Lesen überlegen fanden. Unangenehm war immer nur, wohin damit, denn eine Wiederholungssitzung ist eine Sache mehr im Kalender, und genau am Eintragen scheitern Menschen. Deshalb spricht viel dafür, sie auf eine Fläche zu legen, die sich ohnehin von selbst wiederholt: Das Handy wird etwa 186-mal am Tag in die Hand genommen (Reviews.org, 2026) – und kein einziges Mal davon muss geplant werden.
Podcasts, Musik, Radio nebenbei, Audio im Schlaf
Diese vier werden in einem Atemzug empfohlen, als wären sie dieselbe Maßnahme, und die Forschung behandelt sie sehr unterschiedlich. Zwei halten stand, eines hält stand aus einem Grund, den fast alle verdrehen, und eines wirkt nur in einem so engen Sinn, dass er es wert ist, präzise gesagt zu werden.
Das Muster darunter ist jedes Mal dasselbe: Je mehr das Format von dir verlangt, desto mehr bleibt davon.
| Format | Was die Belege stützen | Was es nicht leisten wird |
|---|---|---|
| Podcasts und Hörbücher auf deinem Niveau | Van Zeeland & Schmitt (2013): reale, wenn auch bescheidene beiläufige Zugewinne beim Hören von Geschichten – oberhalb des Abdeckungsbandes, das Nation (2006) bei ~3.000 Familien für 95 % ansetzt | Dir die Schriftform geben oder das entgangene Wort zurückbringen. Bedeutung bleibt weit eher hängen als Form, und geplant ist keines von beidem |
| Musik und Lieder | Ludke, Ferreira & Schellenberg (2014): Erwachsene, die ungarische Sätze sangen, erinnerten sie danach besser als solche, die dieselben Sätze sprachen | Wirken, wenn die Musik bloß läuft. Der Wirkstoff dieser Studie war das Produzieren der Sprache; Liedtext im Hintergrund ist die ungetestete Bedingung, nicht die getestete |
| Radio nebenbei bei der Arbeit | Saffran et al. (1996): phonologische Struktur wird erstaunlich billig aus dem Strom gezogen – Vertrautheit mit dem Klang der Sprache ist also ein echter Gewinn | Wortschatz beibringen. Das kommt der Tonaufnahme-Bedingung bei Kuhl et al. (2003) am nächsten – der, die kein messbares Lernen erzeugte |
| Audio während des Schlafs | Schreiner & Rasch (2015): das Wiedereinspielen von Wörtern, die Teilnehmende vor dem Schlafen bereits gelernt hatten, verbesserte das Behalten genau dieser Wörter | Dir ein nie begegnetes Wort beibringen. Dieser Befund ist Reaktivierung einer bestehenden Spur: Er kann eine wach begonnene Arbeit abschließen, nicht beginnen |
Die Schlaf-Zeile wird am häufigsten ohne ihre Bedingung zitiert, also noch einmal: Die Wörter wirkten, weil sie vorher gelernt worden waren. Wenn dich die Zeitpunktfrage für sich interessiert, sie hat eine eigene Seite: sollte man Vokabeln vor dem Schlafen lernen?
Ein Ort für die Wörter, die die Folge einmal gesagt hat
Genau für diese Lücke zwischen Hören und Sagenkönnen wurde LearnScreen gebaut. Behalte den Podcast. Die Wörter, für die du zurückgespult hast, kommen auf einer Fläche wieder, auf die du ohnehin geschaut hättest.
Das zurückgespulte Wort wird zur Karte
In Sekunden über das Teilen-Menü hinzugefügt, oder nach der Folge eine ganze Liste eingefügt, je mit Übersetzung und Beispielsatz. Es landet in derselben Warteschlange wie die mitgelieferten Listen – das einmal gesagte Wort beginnt sich also wie ein häufiges zu verhalten, und es kommt endlich mit der Schriftform, die das Hören ihm vorenthalten hat.
Es kommt als Frage zurück, nicht als Wiederholung
Über Apples Bildschirmzeit-API sperrt LearnScreen die von dir gewählten Apps und setzt die Karte dorthin, wo der Feed gewesen wäre – die Antwort bleibt verdeckt, bis du dich festlegst. Damit wird jede Begegnung zum Abruf: die Operation, die Karpicke und Roediger (2008) der bloßen Wiederbegegnung überlegen fanden und die ein Audiofeed strukturell nicht leisten kann.
Ein Leitner-Plan entscheidet, was wiederkommt
Verpasste Wörter kommen früher zurück, gekonnte rücken geometrisch weg. Der Abstand richtet sich danach, wie gut du ein Wort kannst, nicht nach dem Sendeablauf – genau der Teil, den die Forschung zum verteilten Lernen (Cepeda et al., 2006) als entscheidend ausweist und den keine Playlist je liefern konnte.
- Es kommt nichts Zusätzliches in den Kalender. Die Wiederholung landet auf Entsperrungen, die du ohnehin gemacht hättest – deshalb übersteht sie die Wochen, in denen eine Folge auf dem Weg zur Arbeit alles ist, was geht. Mit den Voreinstellungen sind das etwa 25 Abrufversuche am Tag: rund zweieinhalb Minuten, verteilt auf Momente, die du für nichts genutzt hast.
- Fang beim häufigen Kern an, wenn du unter der Schwelle bist. Über 1.080 kuratierte Wörter in 18 Themen und 11 Sprachen, so geordnet, dass die billigste Abdeckung zuerst kommt – der schnellste Weg zu den ~3.000 Familien, die normale Rede lesbar machen (welche Wörter zuerst).
- Deine eigenen Wörter, auch als Liste. Eines mitten in der Folge über das Teilen-Menü hinzufügen oder die Liste einfügen, die du unterwegs gebaut hast; jeder Eintrag nimmt Übersetzung und Beispielsatz auf, damit die Karte den Sinn behält, den die Folge ihr gegeben hat.
- Offline, ohne Konto. Karten und Sperren laufen nach der Installation ohne Netz, und die iCloud-Sicherung schreibt in deine eigene private Datenbank, nicht auf unsere Server.
Weiterlesen
- Funktioniert passives Lernen wirklich? — was Exposition jeder Art messbar liefert und wo sie aufhört.
- Hilft Serienschauen beim Sprachenlernen? — dieselbe Frage, wenn es ein Bild und eine Untertitelspur gibt.
- Kann man nebenbei lernen? — welche Hälfte des Lernens geteilte Aufmerksamkeit übersteht.
- Wie viele Wörter braucht man für eine Sprache? — die Abdeckungsschwellen, die entscheiden, ob Audio Input oder Rauschen ist.
- Aktiver und passiver Wortschatz — warum du weit mehr Wörter erkennst als sagen kannst.
- Warum vergesse ich gelernte Vokabeln? — was mit einem Wort zwischen zwei Folgen passiert.
- Wie oft sollte man Vokabeln wiederholen? — die Abstände, die ein Sendeablauf nie liefern wird.
Häufige Fragen
Quellen
- Kuhl, P. K., Tsao, F.-M., & Liu, H.-M. (2003). Foreign-language experience in infancy: Effects of short-term exposure and social interaction on phonetic learning. PNAS, 100(15), 9096–9101.
- Saffran, J. R., Aslin, R. N., & Newport, E. L. (1996). Statistical learning by 8-month-old infants. Science, 274(5294), 1926–1928.
- van Zeeland, H., & Schmitt, N. (2013). Incidental vocabulary acquisition through L2 listening: A dimensions approach. System, 41(3), 609–624.
- Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
- Peters, E., & Webb, S. (2018). Incidental vocabulary acquisition through viewing L2 television and factors that affect learning. Studies in Second Language Acquisition, 40(3), 551–577.
- Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
- Schreiner, T., & Rasch, B. (2015). Boosting vocabulary learning by verbal cueing during sleep. Cerebral Cortex, 25(11), 4169–4179.
- Ludke, K. M., Ferreira, F., & Schellenberg, E. G. (2014). Singing can facilitate foreign language learning. Memory & Cognition, 42(1), 41–52.
- Karpicke, J. D., & Roediger, H. L. (2008). The critical importance of retrieval for learning. Science, 319(5865), 966–968.
- Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380.
- Murre, J. M. J., & Dros, J. (2015). Replication and analysis of Ebbinghaus’ forgetting curve. PLOS ONE, 10(7), e0120644.
- Nation, I. S. P. (2007). The four strands. Innovation in Language Learning and Teaching, 1(1), 2–13.
- Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report
Drei Einschränkungen gehören zu den Zahlen dazu. Die Studien zum phonetischen Lernen betreffen Babys, und ein Baby ist kein Erwachsener im Kleinformat: Übertragbar ist der Vergleich zwischen den Bedingungen, nicht das Alter. Die Studien zum beiläufigen Hören sind kurz und prüfen eher Wiedererkennen als Produktion – sie unterschätzen also, was Jahre des Hörens bewirken, und überschätzen, wie messbar eine einzelne Stunde ist. Und der Schlafbefund gilt nur für Wörter, die vor dem Schlafen bereits gelernt wurden. Wo diese Seite eine Zahl nennt, stammt sie aus der daneben genannten Studie; wo sie auf dein eigenes Hören verallgemeinert, ist das eine Schlussfolgerung und als solche gekennzeichnet.
Hör weiter. Lass die Wörter nur nicht mit der Folge gehen.
Das Wort, für das du zurückgespult hast, zurück als Frage – auf einem Bildschirm, den du ohnehin entsperrst.
Im App Store laden
