Gå til indhold
Forskning i sprogapps’ effekt

Virker sprogapps
egentlig?

Ja, målbart, og især på begynderniveau. Omkring 34 timer i en app matchede et første universitetssemester i spansk på en niveautest — i en undersøgelse, som appens egen producent bestilte (Vesselinov og Grego, 2012). Et uafhængigt semester med samme app fandt reelle fremskridt i læsning og lytning og næsten ingen i tale (Loewen et al., 2019). Og det, der adskiller dem, det virker for, fra dem, der stopper, er ikke appen: det er hvor mange sessioner der finder sted.

Hvert tal på denne side har kilde til sidst

Et ordkort på låseskærmen på en iPhone, i det øjeblik en blokeret app åbnes

Hvad effektstudierne faktisk målte

Sprogapps er en af verdens mest downloadede kategorier og en af de mindst strengt evaluerede. Der findes en håndfuld seriøse studier, de er små, og deres resultater er mere interessante end både reklamen og hånen. Læst sammen tegner de en konsistent form: reelle fremskridt, koncentreret i genkendelse frem for produktion, med enorm variation mellem personer.

Kolonnen om finansiering vejer lige så tungt som kolonnen om fundene. Feltets mest citerede tal kommer fra et studie, producenten betalte. Det gør det ikke forkert, men det gør det til et gulv for skepsis frem for et loft for løfter.

Fem studier af sprogapps’ effekt: hvad hvert målte, og hvad det fandt
StudieHvad det målteHvad det fandt
Vesselinov og Grego (2012)Voksne begyndere i spansk, testet med en universitetsniveautest før og efter selvstudium i appen — bestilt af producentenGennemsnitligt omkring 34 timer gav en forbedring på niveau med et første universitetssemester, med enorm spredning i hvor meget hver enkelt faktisk studerede
Loewen et al. (2019)Uafhængigt semesterstudie med studerende, der lærte tyrkisk fra nul med samme appMålbare fremskridt i læsning og lytning, meget lidt bevægelse i tale, og et brat fald i brug hen over semestret
Rachels og Rockinson-Szapkiw (2018)En gamificeret spanskapp sammenlignet med undervisning i klassen i grundskolen, med resultater og self-efficacy som målIngen signifikant forskel i resultater og lavere self-efficacy i appgruppen: samme udbytte, mindre selvtillid
Golonka et al. (2014)Oversigt over hele teknologifeltet for sprogindlæring, ordnet efter teknologitype og styrken i belæggetMeget begejstring og tyndt stringent belæg for at nogen enkelt teknologi slår almindelig undervisning; de bedst underbyggede anvendelser var snævre og specifikke
Burston (2015)To årtiers mobile sprogprojekter, analyseret for hvad de rapporterede resultater egentlig hviler påNæsten alle projekter var meget korte og meget små: positive resultater beskriver uger med nyhedsværdi, ikke semestre med indlæring

Ingen af disse studier testede denne app, og ingen målte flydende sprog. De måler niveautestpoint, receptive færdigheder og skoleresultater over uger eller et semester. Tag kategoridommen som «gør noget reelt, på begynderniveau, i genkendelse først» — og betragt hvert tal, der lover samtale ud af skærmtryk, som udokumenteret.

Under «apps virker» rejser tre forskellige påstande

De hviler på helt forskelligt belæg, og derfor kan samme person med god grund mene, at apps er nyttige, og at deres markedsføring er nonsens. Kun den første er godt underbygget.

  • Den underbyggede: målbare begynderfremskridt, mest receptive. Alle studier ovenfor fandt noget. Niveaupoint flytter sig, læsning og lytning flytter sig, og ordforrådet er den del, der flytter sig mest pålideligt: komponenten, der reagerer bedst på fordelt fremkaldelse, det ene software gør bedre end et klasselokale.
  • Den overdrevne: en app erstatter et kursus. Rachels og Rockinson-Szapkiw (2018) fandt lige resultater med klasseundervisning, ikke overlegenhed, og Loewen med kolleger fandt netop det talehul, klasselokalet findes for at lukke. Nations (2007) fire strenge gør formen tydelig: input, output, bevidst sprogstudium og udvikling af flydende sprog er forskellige opgaver, og en tryk-og-vælg-app er stærk i præcis én.
  • Den falske: flydende på femten minutter om dagen. Intet studie i denne litteratur målte flydende sprog, så intet understøtter et løfte om det. Ved ti minutter om dagen tager det mest kendte resultats 34 timer omkring syv måneder — og den regning antager, at du aldrig springer en dag over, hvilket er præcis det, næste afsnit skiller ad.

Eksponering uden fremkaldelse er en fjerde påstand med sit eget belæg: virker passiv læring?

Hvad der faktisk afgør, om en app virker for dig

Seks ting, hver hentet fra et studie frem for en funktionsliste, sorteret efter hvor meget de flytter resultatet. Den første knuser de øvrige, hvilket er ubelejligt for alle, der sælger de andre fem.

Seks faktorer, der afgør om en sprogapp giver resultater, belægget bag hver og den praktiske form
Hvad der afgørHvad belægget sigerHvordan det ser ud
Om sessionen finder stedNielson (2011): føderale ansatte med licenser, betalt studietid og vejlederstøtte stoppede alligevel tidligt for de flestes vedkommende, og meget få nåede meningsfuld brugFejlen er ikke en dårlig lektion, den er en lektion, der aldrig blev åbnet: hvis støtte og betalt tid var nok, var det studie endt anderledes
Om du fremkalder frem for at genkendeRoediger og Karpicke (2006): at blive testet på materialet gav bedre langtidshukommelse end at genlæse det lige så længeAt vælge det rigtige felt ud af fire er meget lettere end at producere ordet, og let øvelse køber mindre; øvelsestypen vejer mere end appen
Om øvelsen er fordeltCepeda et al. (2006), sammenfatning af 254 studier: omkring 47 % genkaldelse ved fordelt øvelse mod 37 % ved samme øvelse i én blokTi minutter på seks dage slår en time om søndagen, og appen, der dukker op dagligt, vinder på den akse før noget indhold sammenlignes
Om hvert ord får nok møderNation og Wang (1999): et ord kræver typisk 8 til 12 fordelte møder, før det bliver hængendeEn række af nyt materiale hver dag afslutter aldrig noget; ordene, der bliver, er dem, hvis genkomst er planlagt
Om ordene er møderne værdNation (2006): de første 3.000 ordfamilier dækker omkring 95 % af daglig samtale, og dækningen flader skarpt ud derefterFrekvensrækkefølge er næsten hele udbyttet det første år — derfor føles et temakursus med dyrenavne produktivt og måler dårligt
Hvor minutterne kommer fraReviews.org (2026): amerikanske voksne angiver at tjekke telefonen omkring 186 gange dagligt, cirka 11,6 gange pr. vågen timeEn plan, der kræver et nyt hul i dagen, konkurrerer med alt andet i den; en, der kører med på en eksisterende vane, gør ikke

Kun række to til fem handler om softwarekvalitet, og det er netop de rækker, næsten hele kategorien allerede har løst. Række et og seks handler om levering, og der afgøres resultaterne for alvor — hvilket er grunden til, at metodesammenligninger igen og igen bliver flade.

Variablen, som ingen test måler

Appsammenligninger skrives om funktioner: hvor god talegenkendelsen er, om grammatiknoterne er noget værd, hvordan gentagelseskøen er planlagt. Det er reelle forskelle, og de er små. Forskellen, der ikke er lille, ligger mellem én med fyrre sessioner og én med fire, og ingen test kan sige hvilken af de to du bliver, for det er ikke en egenskab ved appen.

Derfor bliver effektforskningen ved med at give flade resultater. Golonka med kolleger (2014) søgte efter teknologier med stærkt belæg for fordel og fandt mest begejstring; Burston (2015) fandt, at to årtiers mobile projekter var domineret af studier på få uger. Når varigheden er kort, og tiden brugt varierer en størrelsesorden mellem deltagere, har en metodeforskel næsten ingen plads at vise sig. Samtidig byggede Nielson (2011) det, der burde have været bedste tilfælde for selvstudiesoftware — frivillige, licenser, beskyttet tid, vejledere — og så de fleste stoppe. At blive ved er ikke en blød faktor ved siden af de hårde. Det er den hårde.

Det omformulerer spørgsmålet, folk faktisk mener. Den ærlige version er: producerer denne app nok sessioner, på dage hvor intet lykkes, til at fordeling og fremkaldelse hober sig op? Enhver teknik på denne side er værdiløs i en app, du holdt op med at åbne i marts, og selv en middelmådig teknik forrenter sig i en, du aldrig behøvede at beslutte at åbne. Det produktive træk er ikke at jagte en bedre øvelse. Det er at angribe trinnet, hvor tabene faktisk er.

Hvad det koster at stoppe, i forskningens enheder

«Vær konsekvent» er råd, ingen kan handle på. Det følgende er samme punkt med tal: fire konkrete ting, der holder op med at ske, når sessionerne holder op, hver målt af nogen.

Bemærk, at tre af de fire ikke handler om at lære mindre. De handler om at tabe materiale, du allerede havde betalt for.

Hvad der tabes, når sessionerne stopper, med den målte størrelse af hvert tab
Hvad der tabesBelægMålt størrelse
FordelingsfordelenCepeda et al. (2006), sammenfatning af 254 studier om fordelt øvelseOmkring 47 % fordelt mod 37 % samlet — et spring, du kun indløser ved at komme tilbage en senere dag
Møderne et ord stadig manglerNation og Wang (1999), om hvor mange møder et ord kræver for at holdeCirka 8 til 12 fordelte møder, så et ord opgivet ved det fjerde er ikke en tredjedel lært — det er væk
Alt det halvlærteMurre og Dros (2015), replikation af Ebbinghaus’ glemselskurveBrat tidligt tab uden gentagelse: køen, du holder op med at tømme, forfalder hurtigst de første dage, før det bremser op
Det færdige kursusNielson (2011), selvstudium på arbejdet med licenser, tid og støtteDe fleste stoppede tidligt: det mest almindelige udfald af selvstyret software er et ufærdigt kursus, ikke et dårligt

Dette er ikke et argument for disciplin. Det er et argument for at indrette tingene, så der står færre beslutninger mellem dig og en gentagelse — et designproblem, og et løseligt. Hvad der sker med ordet i mellemtiden står på hvorfor man glemmer ord.

At fjerne trinnet, hvor tabene sker

Hvis vedholdenhed er den variabel, der afgør resultatet, er det nyttige designspørgsmål ikke, hvordan man gør en lektion bedre. Det er, hvordan en gentagelse finder sted, uden at nogen beslutter at begynde. LearnScreen er bygget om den ene idé; her er mekanismen, uden pynt:

1

Ingen session at starte

Apples Screen Time-API lader appen blokere de apps, du vælger. Åbner du en af dem, dukker et ordkort op, hvor feedet ville have været. Telefonen tjekkes omkring 186 gange dagligt (Reviews.org, 2026), så gentagelsen kører med på en vane, der allerede findes, i stedet for at kræve et nyt hul.

2

Hvert kort er et fremkaldelsesforsøg

Svaret er skjult, indtil du trykker, så kortet er en test og ikke en læsetekst — retningen, Roediger og Karpicke (2006) fandt holdt bedre på lang sigt. Omgivende levering hæver antallet af forsøg; den ændrer ikke, hvad ét forsøg er værd.

3

En plan afgør, hvad der vender tilbage

En Leitner-kø bringer forkerte ord tilbage tidligere og lader kendte ord glide geometrisk ud, så de 8 til 12 møder, et ord kræver (Nation og Wang, 1999), spredes over dage i stedet for at stimle sammen i én omgang.

  • Du sætter dosen. Ord pr. session går fra 3 til 20, ligesom hvor ofte blokeringen vender tilbage. Standardindstillingerne giver omkring 25 fremkaldelsesforsøg om dagen, cirka to og et halvt minut fordelt: lille nok til, at ingen anden plan skal aflyses.
  • Det er ikke et kursus og udgiver sig ikke for at være det. Dette er bevidst ordforrådsstudium, en af Nations (2007) fire strenge. At tale, læse og lytte er opgaver, den ikke udfører, og dens ærlige plads er under dem: aktivt og passivt ordforråd.
  • Frekvenslister, eller dine egne ord. De klargjorte sæt begynder, hvor dækningen er billigst (Nation, 2006), og alt, du tilføjer i hånden eller indsætter samlet, ryger i samme kø: hvor mange ord der skal til.
  • Virker offline, uden konto. Kort og blokeringer virker uden netværk efter installation; iCloud-backup skriver til din egen private database og ikke til vores servere, og der er intet at tilmelde sig.

Hvor ordene
dukker op

Fire skærme fra appen: blokeringskortet, svaret med eksempelsætning, ordlisten og fremgangen.

En blokeret app viser et ordkort på blokeringsskærmen i stedet for feedet Svaret afsløret på kortet: oversættelsen og en eksempelsætning med ordet Ordlisten med klargjorte temaer ved siden af de ord, brugeren selv har tilføjet Fremgangsskærmen, der viser hvor mange ord der er rykket op i gentagelseskøen

Læs videre

Ofte stillede spørgsmål

Virker sprogapps egentlig?
Ja, til målbare fremskridt på begynderniveau, især i læsning og lytning. Det mest citerede tal er, at omkring 34 timers studium i en app gav en forbedring på en niveautest på niveau med et første universitetssemester i spansk, i et studie bestilt af producenten (Vesselinov og Grego, 2012). Et uafhængigt semesterstudie med folk, der lærte tyrkisk i samme app, fandt reelle receptive fremskridt og meget lidt bevægelse i tale (Loewen et al., 2019), og en kontrolleret sammenligning med klasseundervisning fandt ingen signifikant forskel i resultater samt lavere self-efficacy i appgruppen (Rachels og Rockinson-Szapkiw, 2018). Intet i den litteratur understøtter løfter om flydende sprog, og intet af det gælder sessioner, der ikke finder sted.
Er én app nok til at lære et sprog?
Ikke alene, og begrænsningen er strukturel snarere end en fejl ved ét produkt. Nations (2007) fire strenge siger, at et kursus kræver betydningsorienteret input, betydningsorienteret output, bevidst sprogstudium og udvikling af flydende sprog i nogenlunde lige dele. En tryk-og-vælg-app er meget god til bevidst studium og rimelig til input; den er svag til output, og derfor målte Loewen med kolleger (2019) fremskridt i læsning og lytning og næsten ingen i tale. Den realistiske rolle er som ordforråds- og grammatikmotor under taletræning, du får andetsteds.
Hvorfor ender sammenlignende studier af sprogapps altid fladt?
Fordi forskellene mellem metoder er små sammenlignet med forskellene i, hvor meget folk faktisk gør. Oversigter over sprogteknologi har gentagne gange fundet tyndt belæg for hver enkelt teknologi og korte studiedesign (Golonka et al., 2014), og Burstons (2015) analyse af to årtiers mobile projekter fandt, at de fleste varede uger frem for semestre. Når varigheden er kort, og tiden brugt varierer voldsomt mellem deltagere, drukner metodeeffekter. Praktisk læst: appen, du vil åbne, er bedre end appen, der tester marginalt bedre.
Hvor mange apptimer svarer til et semesters undervisning?
Omkring 34 timer, på én niveautest, i et producentbestilt spanskstudie (Vesselinov og Grego, 2012) — og tallet bør håndteres varsomt. Det måler forbedring på en niveautest, ikke evnen til at føre en samtale; det kommer fra folk, der gennemførte; og det blev finansieret af firmaet, hvis produkt det vurderede. Tag det som belæg for, at kategorien gør noget, ikke som en omregningskurs, og bemærk at 34 timer ved ti minutter om dagen tager omkring syv måneder.
Hvad adskiller dem, en app virker for, fra dem, der stopper?
Om sessionerne finder sted. Nielson (2011) gav føderale ansatte sprogsoftware med betalt tid og vejlederstøtte, og selv i den usædvanligt gunstige ramme stoppede de fleste tidligt, og meget få nåede meningsfuld brug. Det resultat handler om leveringsmodellen, ikke om softwaren: selvstyret studium kræver, at du beslutter at begynde, hver dag, og der ligger frafaldet. Alt andet på denne side kommer efter det.
Tæller passiv eller omgivende gentagelse som appbrug?
Det tæller, hvis et fremkaldelsesforsøg finder sted. Eksponering alene lærer langsomt, og det, der betaler sig, er testeffekten: Roediger og Karpicke (2006) fandt, at det at blive testet holdt bedre på lang sigt end at genlæse, og Cepeda med kolleger (2006) placerer over 254 studier fordelt øvelse på omkring 47 % genkaldelse mod 37 % for samlet øvelse. Hvad omgivende levering ændrer, er antallet af forsøg, ikke værdien af ét. Et kort, du swiper forbi, er langt mindre værd end et, du forsøgte at besvare.

Kilder

  1. Vesselinov, R., & Grego, J. (2012). Duolingo Effectiveness Study. City University of New York / University of South Carolina. Commissioned by Duolingo.
  2. Loewen, S., Crowther, D., Isbell, D. R., Kim, K. M., Maloney, J., Miller, Z. F., & Rawal, H. (2019). Mobile-assisted language learning: A Duolingo case study. ReCALL, 31(3), 293–311.
  3. Rachels, J. R., & Rockinson-Szapkiw, A. J. (2018). The effects of a mobile gamification app on elementary students’ Spanish achievement and self-efficacy. Computer Assisted Language Learning, 31(1–2), 72–89.
  4. Nielson, K. B. (2011). Self-study with language learning software in the workplace: What happens? Language Learning & Technology, 15(3), 110–129.
  5. Golonka, E. M., Bowles, A. R., Frank, V. M., Richardson, D. L., & Freynik, S. (2014). Technologies for foreign language learning: A review of technology types and their effectiveness. Computer Assisted Language Learning, 27(1), 70–105.
  6. Burston, J. (2015). Twenty years of MALL project implementation: A meta-analysis of learning outcomes. ReCALL, 27(1), 4–20.
  7. Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380.
  8. Roediger, H. L., & Karpicke, J. D. (2006). Test-enhanced learning: Taking memory tests improves long-term retention. Psychological Science, 17(3), 249–255.
  9. Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
  10. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  11. Nation, I. S. P. (2007). The four strands. Innovation in Language Learning and Teaching, 1(1), 2–13.
  12. Murre, J. M. J., & Dros, J. (2015). Replication and analysis of Ebbinghaus’ forgetting curve. PLOS ONE, 10(7), e0120644.
  13. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

Det er små studier. Stikprøverne går fra enkelte klasser til få hundrede personer, varigheden fra uger til et semester, og målene er niveautest og færdighedsbatterier frem for reel samtale. Et af dem blev betalt af firmaet, det vurderede, og det er anført, hvor det citeres. LearnScreen har ikke gennemgået et effektstudie, og denne side hævder ikke andet; app-tallene er regnestykker ud fra standardindstillingerne og et fremkaldelsesforsøg på omkring tyve sekunder, ikke målte brugsdata.

Ret trinnet, der afgør resultatet

Hvis forskningen siger, at vedholdenhed slår metode, er løsningen ikke en bedre lektion — det er en gentagelse, der sker uden en beslutning. LearnScreen lægger en på telefonen, du alligevel skulle låse op, og kræver ikke et enkelt nyt minut.

Hent i App Store