Virker sprogapps
egentlig?
Ja, målbart, og især på begynderniveau. Omkring 34 timer i en app matchede et første universitetssemester i spansk på en niveautest — i en undersøgelse, som appens egen producent bestilte (Vesselinov og Grego, 2012). Et uafhængigt semester med samme app fandt reelle fremskridt i læsning og lytning og næsten ingen i tale (Loewen et al., 2019). Og det, der adskiller dem, det virker for, fra dem, der stopper, er ikke appen: det er hvor mange sessioner der finder sted.
Hvert tal på denne side har kilde til sidst

Hvad effektstudierne faktisk målte
Sprogapps er en af verdens mest downloadede kategorier og en af de mindst strengt evaluerede. Der findes en håndfuld seriøse studier, de er små, og deres resultater er mere interessante end både reklamen og hånen. Læst sammen tegner de en konsistent form: reelle fremskridt, koncentreret i genkendelse frem for produktion, med enorm variation mellem personer.
Kolonnen om finansiering vejer lige så tungt som kolonnen om fundene. Feltets mest citerede tal kommer fra et studie, producenten betalte. Det gør det ikke forkert, men det gør det til et gulv for skepsis frem for et loft for løfter.
| Studie | Hvad det målte | Hvad det fandt |
|---|---|---|
| Vesselinov og Grego (2012) | Voksne begyndere i spansk, testet med en universitetsniveautest før og efter selvstudium i appen — bestilt af producenten | Gennemsnitligt omkring 34 timer gav en forbedring på niveau med et første universitetssemester, med enorm spredning i hvor meget hver enkelt faktisk studerede |
| Loewen et al. (2019) | Uafhængigt semesterstudie med studerende, der lærte tyrkisk fra nul med samme app | Målbare fremskridt i læsning og lytning, meget lidt bevægelse i tale, og et brat fald i brug hen over semestret |
| Rachels og Rockinson-Szapkiw (2018) | En gamificeret spanskapp sammenlignet med undervisning i klassen i grundskolen, med resultater og self-efficacy som mål | Ingen signifikant forskel i resultater og lavere self-efficacy i appgruppen: samme udbytte, mindre selvtillid |
| Golonka et al. (2014) | Oversigt over hele teknologifeltet for sprogindlæring, ordnet efter teknologitype og styrken i belægget | Meget begejstring og tyndt stringent belæg for at nogen enkelt teknologi slår almindelig undervisning; de bedst underbyggede anvendelser var snævre og specifikke |
| Burston (2015) | To årtiers mobile sprogprojekter, analyseret for hvad de rapporterede resultater egentlig hviler på | Næsten alle projekter var meget korte og meget små: positive resultater beskriver uger med nyhedsværdi, ikke semestre med indlæring |
Ingen af disse studier testede denne app, og ingen målte flydende sprog. De måler niveautestpoint, receptive færdigheder og skoleresultater over uger eller et semester. Tag kategoridommen som «gør noget reelt, på begynderniveau, i genkendelse først» — og betragt hvert tal, der lover samtale ud af skærmtryk, som udokumenteret.
Under «apps virker» rejser tre forskellige påstande
De hviler på helt forskelligt belæg, og derfor kan samme person med god grund mene, at apps er nyttige, og at deres markedsføring er nonsens. Kun den første er godt underbygget.
- Den underbyggede: målbare begynderfremskridt, mest receptive. Alle studier ovenfor fandt noget. Niveaupoint flytter sig, læsning og lytning flytter sig, og ordforrådet er den del, der flytter sig mest pålideligt: komponenten, der reagerer bedst på fordelt fremkaldelse, det ene software gør bedre end et klasselokale.
- Den overdrevne: en app erstatter et kursus. Rachels og Rockinson-Szapkiw (2018) fandt lige resultater med klasseundervisning, ikke overlegenhed, og Loewen med kolleger fandt netop det talehul, klasselokalet findes for at lukke. Nations (2007) fire strenge gør formen tydelig: input, output, bevidst sprogstudium og udvikling af flydende sprog er forskellige opgaver, og en tryk-og-vælg-app er stærk i præcis én.
- Den falske: flydende på femten minutter om dagen. Intet studie i denne litteratur målte flydende sprog, så intet understøtter et løfte om det. Ved ti minutter om dagen tager det mest kendte resultats 34 timer omkring syv måneder — og den regning antager, at du aldrig springer en dag over, hvilket er præcis det, næste afsnit skiller ad.
Eksponering uden fremkaldelse er en fjerde påstand med sit eget belæg: virker passiv læring?
Hvad der faktisk afgør, om en app virker for dig
Seks ting, hver hentet fra et studie frem for en funktionsliste, sorteret efter hvor meget de flytter resultatet. Den første knuser de øvrige, hvilket er ubelejligt for alle, der sælger de andre fem.
| Hvad der afgør | Hvad belægget siger | Hvordan det ser ud |
|---|---|---|
| Om sessionen finder sted | Nielson (2011): føderale ansatte med licenser, betalt studietid og vejlederstøtte stoppede alligevel tidligt for de flestes vedkommende, og meget få nåede meningsfuld brug | Fejlen er ikke en dårlig lektion, den er en lektion, der aldrig blev åbnet: hvis støtte og betalt tid var nok, var det studie endt anderledes |
| Om du fremkalder frem for at genkende | Roediger og Karpicke (2006): at blive testet på materialet gav bedre langtidshukommelse end at genlæse det lige så længe | At vælge det rigtige felt ud af fire er meget lettere end at producere ordet, og let øvelse køber mindre; øvelsestypen vejer mere end appen |
| Om øvelsen er fordelt | Cepeda et al. (2006), sammenfatning af 254 studier: omkring 47 % genkaldelse ved fordelt øvelse mod 37 % ved samme øvelse i én blok | Ti minutter på seks dage slår en time om søndagen, og appen, der dukker op dagligt, vinder på den akse før noget indhold sammenlignes |
| Om hvert ord får nok møder | Nation og Wang (1999): et ord kræver typisk 8 til 12 fordelte møder, før det bliver hængende | En række af nyt materiale hver dag afslutter aldrig noget; ordene, der bliver, er dem, hvis genkomst er planlagt |
| Om ordene er møderne værd | Nation (2006): de første 3.000 ordfamilier dækker omkring 95 % af daglig samtale, og dækningen flader skarpt ud derefter | Frekvensrækkefølge er næsten hele udbyttet det første år — derfor føles et temakursus med dyrenavne produktivt og måler dårligt |
| Hvor minutterne kommer fra | Reviews.org (2026): amerikanske voksne angiver at tjekke telefonen omkring 186 gange dagligt, cirka 11,6 gange pr. vågen time | En plan, der kræver et nyt hul i dagen, konkurrerer med alt andet i den; en, der kører med på en eksisterende vane, gør ikke |
Kun række to til fem handler om softwarekvalitet, og det er netop de rækker, næsten hele kategorien allerede har løst. Række et og seks handler om levering, og der afgøres resultaterne for alvor — hvilket er grunden til, at metodesammenligninger igen og igen bliver flade.
Variablen, som ingen test måler
Appsammenligninger skrives om funktioner: hvor god talegenkendelsen er, om grammatiknoterne er noget værd, hvordan gentagelseskøen er planlagt. Det er reelle forskelle, og de er små. Forskellen, der ikke er lille, ligger mellem én med fyrre sessioner og én med fire, og ingen test kan sige hvilken af de to du bliver, for det er ikke en egenskab ved appen.
Derfor bliver effektforskningen ved med at give flade resultater. Golonka med kolleger (2014) søgte efter teknologier med stærkt belæg for fordel og fandt mest begejstring; Burston (2015) fandt, at to årtiers mobile projekter var domineret af studier på få uger. Når varigheden er kort, og tiden brugt varierer en størrelsesorden mellem deltagere, har en metodeforskel næsten ingen plads at vise sig. Samtidig byggede Nielson (2011) det, der burde have været bedste tilfælde for selvstudiesoftware — frivillige, licenser, beskyttet tid, vejledere — og så de fleste stoppe. At blive ved er ikke en blød faktor ved siden af de hårde. Det er den hårde.
Det omformulerer spørgsmålet, folk faktisk mener. Den ærlige version er: producerer denne app nok sessioner, på dage hvor intet lykkes, til at fordeling og fremkaldelse hober sig op? Enhver teknik på denne side er værdiløs i en app, du holdt op med at åbne i marts, og selv en middelmådig teknik forrenter sig i en, du aldrig behøvede at beslutte at åbne. Det produktive træk er ikke at jagte en bedre øvelse. Det er at angribe trinnet, hvor tabene faktisk er.
Hvad det koster at stoppe, i forskningens enheder
«Vær konsekvent» er råd, ingen kan handle på. Det følgende er samme punkt med tal: fire konkrete ting, der holder op med at ske, når sessionerne holder op, hver målt af nogen.
Bemærk, at tre af de fire ikke handler om at lære mindre. De handler om at tabe materiale, du allerede havde betalt for.
| Hvad der tabes | Belæg | Målt størrelse |
|---|---|---|
| Fordelingsfordelen | Cepeda et al. (2006), sammenfatning af 254 studier om fordelt øvelse | Omkring 47 % fordelt mod 37 % samlet — et spring, du kun indløser ved at komme tilbage en senere dag |
| Møderne et ord stadig mangler | Nation og Wang (1999), om hvor mange møder et ord kræver for at holde | Cirka 8 til 12 fordelte møder, så et ord opgivet ved det fjerde er ikke en tredjedel lært — det er væk |
| Alt det halvlærte | Murre og Dros (2015), replikation af Ebbinghaus’ glemselskurve | Brat tidligt tab uden gentagelse: køen, du holder op med at tømme, forfalder hurtigst de første dage, før det bremser op |
| Det færdige kursus | Nielson (2011), selvstudium på arbejdet med licenser, tid og støtte | De fleste stoppede tidligt: det mest almindelige udfald af selvstyret software er et ufærdigt kursus, ikke et dårligt |
Dette er ikke et argument for disciplin. Det er et argument for at indrette tingene, så der står færre beslutninger mellem dig og en gentagelse — et designproblem, og et løseligt. Hvad der sker med ordet i mellemtiden står på hvorfor man glemmer ord.
At fjerne trinnet, hvor tabene sker
Hvis vedholdenhed er den variabel, der afgør resultatet, er det nyttige designspørgsmål ikke, hvordan man gør en lektion bedre. Det er, hvordan en gentagelse finder sted, uden at nogen beslutter at begynde. LearnScreen er bygget om den ene idé; her er mekanismen, uden pynt:
Ingen session at starte
Apples Screen Time-API lader appen blokere de apps, du vælger. Åbner du en af dem, dukker et ordkort op, hvor feedet ville have været. Telefonen tjekkes omkring 186 gange dagligt (Reviews.org, 2026), så gentagelsen kører med på en vane, der allerede findes, i stedet for at kræve et nyt hul.
Hvert kort er et fremkaldelsesforsøg
Svaret er skjult, indtil du trykker, så kortet er en test og ikke en læsetekst — retningen, Roediger og Karpicke (2006) fandt holdt bedre på lang sigt. Omgivende levering hæver antallet af forsøg; den ændrer ikke, hvad ét forsøg er værd.
En plan afgør, hvad der vender tilbage
En Leitner-kø bringer forkerte ord tilbage tidligere og lader kendte ord glide geometrisk ud, så de 8 til 12 møder, et ord kræver (Nation og Wang, 1999), spredes over dage i stedet for at stimle sammen i én omgang.
- Du sætter dosen. Ord pr. session går fra 3 til 20, ligesom hvor ofte blokeringen vender tilbage. Standardindstillingerne giver omkring 25 fremkaldelsesforsøg om dagen, cirka to og et halvt minut fordelt: lille nok til, at ingen anden plan skal aflyses.
- Det er ikke et kursus og udgiver sig ikke for at være det. Dette er bevidst ordforrådsstudium, en af Nations (2007) fire strenge. At tale, læse og lytte er opgaver, den ikke udfører, og dens ærlige plads er under dem: aktivt og passivt ordforråd.
- Frekvenslister, eller dine egne ord. De klargjorte sæt begynder, hvor dækningen er billigst (Nation, 2006), og alt, du tilføjer i hånden eller indsætter samlet, ryger i samme kø: hvor mange ord der skal til.
- Virker offline, uden konto. Kort og blokeringer virker uden netværk efter installation; iCloud-backup skriver til din egen private database og ikke til vores servere, og der er intet at tilmelde sig.
Læs videre
- Virker passiv læring? — Hvad eksponering alene giver, og hvor den stopper.
- Hvordan holder man op med at opgive et sprog? — Vedholdenhedsproblemet, denne side ender med, taget alvorligt.
- Hvor mange minutter om dagen kræves der? — Hvordan de 34 timer ser ud fordelt over et år.
- Hvor ofte skal man gentage ord? — Planen, der gør sessioner til hukommelse.
- Aktivt og passivt ordforråd — Hvorfor appfremskridt lander i genkendelse først.
- Hvilke ord skal man lære først? — Hvordan man gør hvert møde værd at have.
Ofte stillede spørgsmål
Kilder
- Vesselinov, R., & Grego, J. (2012). Duolingo Effectiveness Study. City University of New York / University of South Carolina. Commissioned by Duolingo.
- Loewen, S., Crowther, D., Isbell, D. R., Kim, K. M., Maloney, J., Miller, Z. F., & Rawal, H. (2019). Mobile-assisted language learning: A Duolingo case study. ReCALL, 31(3), 293–311.
- Rachels, J. R., & Rockinson-Szapkiw, A. J. (2018). The effects of a mobile gamification app on elementary students’ Spanish achievement and self-efficacy. Computer Assisted Language Learning, 31(1–2), 72–89.
- Nielson, K. B. (2011). Self-study with language learning software in the workplace: What happens? Language Learning & Technology, 15(3), 110–129.
- Golonka, E. M., Bowles, A. R., Frank, V. M., Richardson, D. L., & Freynik, S. (2014). Technologies for foreign language learning: A review of technology types and their effectiveness. Computer Assisted Language Learning, 27(1), 70–105.
- Burston, J. (2015). Twenty years of MALL project implementation: A meta-analysis of learning outcomes. ReCALL, 27(1), 4–20.
- Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380.
- Roediger, H. L., & Karpicke, J. D. (2006). Test-enhanced learning: Taking memory tests improves long-term retention. Psychological Science, 17(3), 249–255.
- Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
- Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
- Nation, I. S. P. (2007). The four strands. Innovation in Language Learning and Teaching, 1(1), 2–13.
- Murre, J. M. J., & Dros, J. (2015). Replication and analysis of Ebbinghaus’ forgetting curve. PLOS ONE, 10(7), e0120644.
- Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report
Det er små studier. Stikprøverne går fra enkelte klasser til få hundrede personer, varigheden fra uger til et semester, og målene er niveautest og færdighedsbatterier frem for reel samtale. Et af dem blev betalt af firmaet, det vurderede, og det er anført, hvor det citeres. LearnScreen har ikke gennemgået et effektstudie, og denne side hævder ikke andet; app-tallene er regnestykker ud fra standardindstillingerne og et fremkaldelsesforsøg på omkring tyve sekunder, ikke målte brugsdata.
Ret trinnet, der afgør resultatet
Hvis forskningen siger, at vedholdenhed slår metode, er løsningen ikke en bedre lektion — det er en gentagelse, der sker uden en beslutning. LearnScreen lægger en på telefonen, du alligevel skulle låse op, og kræver ikke et enkelt nyt minut.
Hent i App Store
