Aller au contenu
La recherche sur le visionnage, appliquée à votre liste

Regarder des séries en VO
fait-il vraiment progresser ?

Oui pour l’oreille, beaucoup moins pour les mots nouveaux, et ce qui décide lequel des deux vous obtenez, c’est la couverture, pas l’effort. Suivre une série ordinaire à 95 % demande environ 3 000 familles de mots ; atteindre 98 % en demande près de 7 000 (Webb et Rodgers, 2009). En dessous de ce seuil, un épisode est surtout du son que vous ne pouvez pas découper en mots. Ce qui reste dépend de la fréquence : le nombre d’occurrences d’un mot était le meilleur prédicteur de son apprentissage (Peters et Webb, 2018), et les sous-titres en langue originale battent l’absence de sous-titres, en compréhension comme en vocabulaire (Montero Perez et al., 2013).

Tous les chiffres de cette page sont référencés à la fin

Une carte de vocabulaire sur l’écran de verrouillage d’un iPhone, au moment où une app bloquée est ouverte

Ce que le visionnage a réellement été mesuré comme apportant

La télévision est le conseil linguistique le plus répété et le moins chiffré qui soit, ce qui est dommage : c’est l’un des mieux étudiés. La linguistique appliquée a compté le vocabulaire qu’une série exige, testé ce que laisse une seule heure de visionnage, et méta-analysé si les sous-titres changent la réponse. Les résultats sont cohérents et nettement plus précis que « immergez-vous ».

Une réserve, en haut et non en note de bas de page : ces études sont courtes et testent surtout la reconnaissance. Un participant qui regarde un documentaire en laboratoire n’est pas quelqu’un qui en est à sa troisième saison, et reconnaître un mot dans un test n’est pas le produire dans une phrase. Ce que valent les chiffres ci-dessous, c’est la forme de l’effet, pas une promesse sur votre mois de décembre.

Cinq résultats de la recherche sur l’apprentissage du vocabulaire par le visionnage et ce que chacun implique
Ce qui a été mesuréCe que l’étude a trouvéCe que cela signifie pour vous
Le vocabulaire qu’exige la télévisionWebb et Rodgers (2009) : environ 3 000 familles de mots plus les noms propres et mots marginaux pour 95 % de couverture, et près de 7 000 pour 98 %Il y a un seuil, et c’est le facteur le plus lourd. En dessous de 3 000 familles environ, un épisode est du son qu’on ne peut pas découper en mots
Ce que laisse une heure de visionnagePeters et Webb (2018) : les gains incidents d’une heure de télévision en L2 étaient réels mais modestes, et la fréquence d’occurrence était le meilleur prédicteur des mots apprisVous gardez ce que le scénario a répété. Tout ce qui n’est dit qu’une fois est, statistiquement, un mot rencontré puis perdu
Avec sous-titres contre sansMontero Perez et al. (2013), méta-analyse : la vidéo sous-titrée a surpassé la vidéo sans sous-titres pour la compréhension orale et le vocabulaireLe changement le moins coûteux à votre portée est un réglage du lecteur : sous-titres en langue originale plutôt qu’aucun
Une seule série contre des programmes variésRodgers et Webb (2011) : les programmes apparentés répètent bien davantage leur vocabulaire, parce qu’une série garde son décor, sa distribution et son sujetFinir une série vaut mieux qu’en essayer dix. Le visionnage étroit transforme gratuitement des rencontres uniques en rencontres répétées
La possibilité de retrouver le mot plus tardNon mesurée par les études de visionnage ; mais Karpicke et Roediger (2008) ont montré que c’est la récupération, pas la réexposition, qui rend un contenu récupérableLe visionnage fournit la réexposition en abondance et la récupération jamais. C’est l’origine de l’oreille à l’aise et de la bouche vide

Relisez la première ligne. Presque toutes les disputes sur l’efficacité de la télévision opposent en réalité deux personnes à des niveaux de couverture différents, décrivant fidèlement deux expériences différentes. Le conseil n’est pas faux : il est conditionnel, et la condition est un nombre que vous pouvez estimer — combien de mots faut-il connaître.

Trois affirmations voyagent sous « regarde des séries en VO »

Elles reposent sur des preuves différentes, d’où ce mélange d’évidence et de vague insatisfaction. Seules les deux premières tiennent, et la deuxième seulement au-dessus d’un seuil.

  • Celle qui tient : votre oreille progresse. C’est le bénéfice réel et fiable, et il n’est pas mince. Écouter beaucoup de parole naturelle entraîne à découper le flux en mots, à encaisser la vitesse et les accents, et à tolérer de ne pas tout attraper — une compétence qu’aucune carte de vocabulaire n’a jamais enseignée. Si votre point faible est la compréhension orale, la série est presque l’instrument idéal.
  • Celle qui est conditionnelle : c’est de l’input compréhensible. Vraie au-dessus du seuil de couverture, fausse en dessous. Webb et Rodgers (2009) situent 95 % de couverture télévisuelle autour de 3 000 familles de mots, et la compréhension grimpe fortement dans cette zone. En dessous, le matériau n’est pas de l’input en un sens utile : on ne reconstitue pas le sens d’une phrase quand il manque un mot sur dix et qu’on ne sait pas où ils commencent.
  • Celle qui est fausse : les mots viendront tout seuls. L’acquisition est limitée par la fréquence. Peters et Webb (2018) ont trouvé que le nombre d’occurrences prédisait l’apprentissage, et Nation et Wang (1999) situent les rencontres nécessaires entre cinq et vingt. Un film d’une heure et demie vous donne l’essentiel de son vocabulaire intéressant exactement une fois — précisément le cas où la courbe de l’oubli l’emporte.

La version générale de cette question — ce que l’exposition seule apporte et où elle s’arrête — a sa propre page : l’apprentissage passif fonctionne-t-il vraiment ?

Six choses décident si un épisode vous apprend quelque chose

Deux personnes peuvent regarder la même série pendant un an et finir à des endroits complètement différents. Aucune des six raisons n’est le talent et une seule est l’effort. Cinq sont des propriétés du matériau et du calendrier — bonne nouvelle : ce sont celles qu’on peut changer.

Six facteurs qui décident du vocabulaire gagné par le visionnage, les preuves et ce qu’il faut faire
Ce qui décideCe que dit la rechercheCe qu’il faut faire
Votre couverture de ce programmeWebb et Rodgers (2009) : ~3 000 familles de mots pour 95 % de couverture, ~7 000 pour 98 %Sous le seuil, consacrez une partie du temps à bâtir le noyau fréquent : c’est lui qui rend le visionnage rentable
La fréquence de répétition d’un motPeters et Webb (2018) : la fréquence dans le programme prédisait l’apprentissage ; Nation et Wang (1999) : de cinq à vingt rencontresFinissez une série au lieu de regarder dix pilotes : le visionnage étroit multiplie les rencontres (Rodgers et Webb, 2011)
Sous-titres activés ou nonMontero Perez et al. (2013) : la vidéo sous-titrée bat la vidéo sans sous-titres ; Winke et al. (2010) : les sous-titres aident à relier son et forme écriteSous-titres en langue originale par défaut. C’est un seul réglage et le changement le mieux étayé de la liste
Si quelque chose est un jour récupéré de mémoireKarpicke et Roediger (2008) : la récupération bat la relecture pour le rappel ultérieurLe visionnage est pure confirmation, jamais rappel. Il faut que quelque chose, hors de l’épisode, vous pose la question
L’intervalle entre deux rencontresCepeda et al. (2006), 254 études : environ 47 % de rappel en espacé contre 37 % en masséC’est l’intrigue qui décide de ce qui revient et quand. Rien dans un scénario n’est calé sur ce que vous avez oublié
Ce qui se passe entre deux épisodesMurre et Dros (2015) : la courbe de l’oubli classique se réplique — ce qui n’est pas récupéré décline le plus vite juste aprèsLe mot cherché mardi doit revenir avant vendredi, et l’épisode suivant ne le ramènera pas

Remarquez ce qui manque à cette liste : l’attention, la discipline et le talent. Rien n’échoue ici faute de concentration. Cela échoue parce qu’un scénario a d’autres priorités que votre vocabulaire — ce qui est exactement ce qui le rend assez agréable pour durer.

L’input est réel. C’est la deuxième rencontre qui manque.

La télévision réussit une chose que presque toutes les méthodes délibérées ratent : elle est tenable. Personne n’a besoin d’être convaincu de lancer un épisode, personne ne casse une série de jours, et l’input arrive en quantité, sous une forme que le cerveau accepte pendant une heure. Les quatre brins de Nation (2007) placent l’input centré sur le sens à environ un quart d’un programme équilibré, et le visionnage remplit ce quart mieux que tout ce qui est disponible hors du pays. Gardez-le. L’argument ici n’est pas que la série est du temps perdu.

Ce qu’elle ne peut pas faire, c’est revenir. Une série décide de ce que vous entendez ensuite selon l’intrigue ; elle ignore quel mot vous a échappé et n’a aucun moyen de le réintroduire trois jours plus tard, au moment où ce serait le plus rentable. Les mots que le scénario répète s’apprennent donc presque gratuitement, et ceux apparus une fois — en général les mots intéressants, de fréquence moyenne, ceux dont vous aviez vraiment besoin — déclinent selon la courbe habituelle (Murre et Dros, 2015). Dix saisons plus tard, le profil est connu : compréhension confortable, oreille qui encaisse le débit, et vocabulaire bloqué autour de ce que la série dit à chaque épisode.

Le correctif est petit, et ce n’est pas « regarder plus ». C’est une deuxième rencontre avec les mots précis qui vous ont échappé, espacée, et formulée en question plutôt qu’en rappel — la combinaison que Cepeda et ses collègues (2006) ont mesurée autour de 47 % de rappel contre 37 % en massé, et celle que Karpicke et Roediger (2008) ont trouvée supérieure à la relecture. Le point délicat a toujours été : où la mettre ? Une session de révision est une chose de plus à planifier, et la planification est justement l’étape où l’on échoue. D’où l’intérêt de la poser sur une surface qui revient déjà toute seule : le téléphone est consulté environ 186 fois par jour (Reviews.org, 2026), et aucune de ces fois n’a besoin d’être organisée.

Sous-titres : à quoi sert vraiment chaque réglage

C’est la partie de la question qui fait le plus débat et celle que la recherche tranche le plus proprement. Montero Perez, Van Den Noortgate et Desmet (2013) ont méta-analysé la vidéo sous-titrée et l’ont trouvée supérieure à la vidéo non sous-titrée pour la compréhension orale comme pour le vocabulaire, et Winke, Gass et Sydorenko (2010) ont montré pourquoi : les sous-titres permettent de relier ce que l’on entend à une forme écrite — la forme dont vous aurez besoin pour recroiser le mot ailleurs.

Les quatre réglages ne sont pas tant meilleurs ou pires que bons à des tâches différentes. Le piège : le plus confortable est le moins productif.

Quatre réglages de sous-titres, ce à quoi chacun sert et ce qu’il coûte
RéglageÀ quoi il sertCe qu’il coûte
Sous-titres en langue originaleLe choix le mieux étayé : compréhension et vocabulaire progressent par rapport à l’absence de sous-titres (Montero Perez et al., 2013), et le son est relié à la forme écriteUn peu moins d’écoute pure, et une vraie tentation de lire au lieu d’écouter
Aucun sous-titreEntraînement pur à la segmentation — ce qui ressemble le plus aux conditions réelles d’écouteSous le seuil de couverture, cela produit presque aucun vocabulaire : un mot inconnu qu’on ne sait pas écrire est introuvable
Sous-titres dans votre langueProfiter d’une série qu’on abandonnerait sinon, et suivre une intrigue compliquéeL’option confortable qui fait le moins : l’attention part vers la traduction et l’épisode devient de la lecture avec bande-son
Un revisionnage, sous-titres au second passageTransformer un épisode en deux rencontres avec le même vocabulaire — l’effet que le visionnage étroit produit sur une série (Rodgers et Webb, 2011)Du temps. C’est l’option la plus rentable du tableau et celle que personne ne fait

Quelle que soit la ligne choisie, aucune ne change la limite de fond : chacune décide de votre compréhension pendant la lecture. Ce qui décide de ce que vous saurez encore dans quinze jours, c’est ce qui se passe entre les épisodes.

Un endroit pour les mots que l’épisode n’a dits qu’une fois

C’est cet écart entre regarder et retenir que LearnScreen comble. Gardez la série : les mots que vous avez cherchés reviennent sur un écran que vous alliez regarder de toute façon.

1

Le mot qui vous a fait mettre en pause devient une carte

Ajoutez-le en quelques secondes, ou collez une liste entière après l’épisode, avec traduction et phrase d’exemple. Tout ce que vous ajoutez rejoint la même file que les listes intégrées : le vocabulaire donné une seule fois par le scénario se met à se comporter comme s’il était répété.

2

Il revient sous forme de question, pas de rappel

Via l’API Temps d’écran d’Apple, LearnScreen bloque les apps que vous choisissez et met la carte là où était le fil, réponse cachée jusqu’à ce que vous vous engagiez. Chaque rencontre devient une tentative de récupération — ce que Karpicke et Roediger (2008) ont trouvé supérieur à la réexposition, et ce qu’un épisode ne fait jamais.

3

Un système de Leitner décide de ce qui revient

Les mots ratés reviennent plus tôt, les mots réussis s’espacent géométriquement. L’espacement dépend de votre maîtrise de chaque mot, pas de l’épisode en cours — la part qui, selon la recherche sur la pratique distribuée (Cepeda et al., 2006), fait le travail.

  • Rien de neuf n’est planifié. La révision atterrit sur des déverrouillages que vous faisiez déjà, ce qui lui permet de survivre aux semaines où lancer un épisode est le maximum possible. Les réglages par défaut donnent environ 25 tentatives de rappel par jour : à peu près deux minutes et demie, réparties.
  • Commencez par le noyau fréquent si vous êtes sous le seuil. Plus de 1 080 mots sélectionnés, 18 thèmes, 11 langues, classés pour que la couverture la moins chère vienne en premier — le chemin le plus court vers les 3 000 familles qui rendent une série lisible (combien de mots faut-il connaître).
  • Vos propres mots, en lot. Ajoutez un mot depuis la feuille de partage ou collez la liste faite en regardant ; chaque entrée accepte une traduction et une phrase d’exemple, donc la carte garde le contexte que la scène lui a donné.
  • Hors ligne, sans compte. Les cartes et les blocages fonctionnent sans réseau une fois l’app installée, et la sauvegarde iCloud écrit dans votre base privée, pas sur nos serveurs.

Où les mots
apparaissent

Quatre écrans de l’app : la carte de blocage, la réponse avec sa phrase d’exemple, la liste de mots et la progression.

Une app bloquée affiche une carte de vocabulaire sur l’écran de blocage à la place du fil La réponse révélée sur la carte : la traduction et une phrase d’exemple contenant le mot La liste de vocabulaire, avec les thèmes choisis et les mots ajoutés par l’utilisateur L’écran de progression : combien de mots ont monté dans la file de répétition espacée

À lire ensuite

Questions fréquentes

Peut-on vraiment apprendre une langue en regardant des séries ?
On peut y gagner énormément en compréhension orale, et assez peu en vocabulaire nouveau. Le nombre qui décide lequel des deux est la couverture : Webb et Rodgers (2009) ont trouvé que comprendre 95 % des mots d’une série ordinaire demande environ 3 000 familles de mots plus les noms propres et les mots marginaux, et 98 % près de 7 000. Au-dessus de ce seuil, le visionnage se comporte comme de l’input et les mots s’accrochent à ce que vous savez déjà. En dessous, l’essentiel de ce qui arrive ne peut pas être découpé en mots, et les épisodes supplémentaires achètent surtout une familiarité avec la sonorité de la langue.
Combien de mots retient-on d’une heure de série ?
Moins que l’heure ne le laisse croire, et ce sont ceux qui se sont répétés. Peters et Webb (2018) ont mesuré l’acquisition incidente de vocabulaire sur une heure de télévision en L2 et trouvé des gains réels mais modestes, la fréquence d’occurrence dans le programme étant le meilleur prédicteur. Cela rejoint la littérature sur la répétition : Nation et Wang (1999) situent les rencontres nécessaires entre cinq et vingt, et Webb (2007) a montré que la connaissance d’un mot croît progressivement au fil des répétitions. Un épisode vous donne l’essentiel de ses mots exactement une fois.
Faut-il regarder avec ou sans sous-titres ?
Avec, en langue originale, si l’objectif est le vocabulaire. Montero Perez, Van Den Noortgate et Desmet (2013) ont méta-analysé la vidéo sous-titrée et l’ont trouvée supérieure à la vidéo non sous-titrée pour la compréhension orale comme pour l’apprentissage lexical. Winke, Gass et Sydorenko (2010) ont montré que les sous-titres aident à relier ce que l’on entend aux formes écrites — c’est ce lien qui rend un mot retrouvable ensuite. Les sous-titres dans votre langue sont l’option confortable et celle qui fait discrètement le moins : la compréhension monte, et l’attention va à la traduction plutôt qu’à la langue pour laquelle vous êtes venu.
Pourquoi je comprends la série mais je n’arrive pas à parler ?
Parce que le visionnage entraîne la reconnaissance et ne demande jamais de production. Chaque mot arrive avec sa forme, sa voix et son contexte déjà fournis : vous confirmez au lieu de récupérer. Karpicke et Roediger (2008) ont montré que c’est la récupération, et non l’étude répétée, qui rend un contenu récupérable ensuite. Une saison, c’est des milliers de confirmations et zéro tentative de rappel — d’où le profil que tout le monde décrit : une oreille à l’aise et une bouche vide.
Vaut-il mieux regarder une seule série ou en varier ?
Une seule, et c’est mesurable. Rodgers et Webb (2011) ont comparé programmes apparentés et non apparentés : les épisodes d’une même série répètent nettement plus leur vocabulaire, parce qu’une série garde son décor, sa distribution et son sujet. Cet effet de visionnage étroit transforme des rencontres uniques en rencontres répétées sans effort supplémentaire — c’est le seul levier interne au visionnage qui change la quantité de vocabulaire livrée.
Que faut-il ajouter au visionnage pour que les mots restent ?
Une deuxième rencontre avec les mots précis qui vous ont échappé, espacée et formulée en question plutôt qu’en rappel. Cepeda et ses collègues (2006), sur 254 études, ont trouvé environ 47 % de rappel en pratique espacée contre 37 % en pratique massée, et ce qui n’est jamais récupéré décline sur la courbe de l’oubli habituelle (Murre et Dros, 2015). La télévision ne peut pas planifier cela : son ordre de passage est décidé par l’intrigue, pas par ce que vous avez raté. Gardez le visionnage pour l’input et placez la révision là où elle se produit sans qu’une session ait à être organisée.

Sources

  1. Webb, S., & Rodgers, M. P. H. (2009). Vocabulary demands of television programs. Language Learning, 59(2), 335–366.
  2. Rodgers, M. P. H., & Webb, S. (2011). Narrow viewing: The vocabulary in related television programs. TESOL Quarterly, 45(4), 689–717.
  3. Peters, E., & Webb, S. (2018). Incidental vocabulary acquisition through viewing L2 television and factors that affect learning. Studies in Second Language Acquisition, 40(3), 551–577.
  4. Montero Perez, M., Van Den Noortgate, W., & Desmet, P. (2013). Captioned video for L2 listening and vocabulary learning: A meta-analysis. System, 41(3), 720–739.
  5. Winke, P., Gass, S., & Sydorenko, T. (2010). The effects of captioning videos used for foreign language listening activities. Language Learning & Technology, 14(1), 65–86.
  6. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  7. Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
  8. Webb, S. (2007). The effects of repetition on vocabulary knowledge. Applied Linguistics, 28(1), 46–65.
  9. Karpicke, J. D., & Roediger, H. L. (2008). The critical importance of retrieval for learning. Science, 319(5865), 966–968.
  10. Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380.
  11. Murre, J. M. J., & Dros, J. (2015). Replication and analysis of Ebbinghaus’ forgetting curve. PLOS ONE, 10(7), e0120644.
  12. Nation, I. S. P. (2007). The four strands. Innovation in Language Learning and Teaching, 1(1), 2–13.
  13. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

Les limites, dites franchement. Les études de visionnage citées ici sont courtes — un épisode ou un documentaire, pas des années de séries — et testent la reconnaissance bien plus souvent que la production : elles mesurent donc l’extrémité facile de la connaissance d’un mot. Les chiffres de couverture viennent d’analyses de corpus télévisuels : ils décrivent des programmes, ils ne prédisent pas la compréhension d’un individu. Rien ici n’a été mesuré sur un écran de verrouillage : les résultats sur la récupération, l’espacement et l’oubli ont été établis sur d’autres matériaux, et cette page les applique au visionnage plutôt que de rapporter un essai de la combinaison. Traitez cela comme un raisonnement solidement étayé — et traitez toute promesse qu’un abonnement de streaming remplace le travail de vocabulaire comme dépourvue de la moindre preuve.

Continuez à regarder. Mais que les mots ne partent pas au générique.

LearnScreen place les mots que vous avez cherchés sur l’écran que vous déverrouillez de toute façon, cache la réponse jusqu’à votre tentative, et ramène ceux que vous avez ratés avant que vous les oubliiez.

Télécharger sur l’App Store