Lompat ke kandungan
Penyelidikan keberkesanan aplikasi

Adakah aplikasi belajar
bahasa benar-benar berkesan?

Ya, secara boleh diukur — dan terutamanya pada tahap permulaan. Kira-kira 34 jam belajar dalam aplikasi menghasilkan kemajuan setara satu semester pertama bahasa Sepanyol di universiti dalam ujian penempatan, dalam kajian yang ditempah oleh syarikat pembuat aplikasi itu sendiri (Vesselinov dan Grego, 2012). Satu semester kajian bebas dengan aplikasi yang sama menemui kemajuan sebenar dalam membaca dan mendengar, dan hampir tiada dalam pertuturan (Loewen dll., 2019). Dan yang membezakan mereka yang berjaya daripada yang berhenti bukan aplikasinya, tetapi berapa sesi yang berlaku.

Semua angka di halaman ini disertakan sumbernya di bahagian akhir

Kad perbendaharaan kata pada skrin kunci iPhone ketika aplikasi yang disekat dibuka

Apa yang sebenarnya diukur oleh kajian keberkesanan

Aplikasi bahasa ialah antara kategori paling banyak dimuat turun di dunia dan antara yang paling kurang diuji secara ketat. Kajian seriusnya segelintir, saiznya kecil, dan penemuannya lebih menarik daripada iklan mahupun cemuhan. Dibaca bersama, kesemuanya membentuk corak yang tekal: kemajuannya nyata, tertumpu pada pengecaman berbanding penghasilan, dan berbeza-beza secara besar antara orang.

Lajur pembiayaan sama pentingnya dengan lajur penemuan. Angka yang paling banyak dipetik dalam bidang ini datang daripada kajian yang dibayar oleh syarikat itu sendiri. Itu tidak menjadikannya palsu, tetapi menjadikannya lantai untuk kesangsian, bukan siling untuk janji.

Lima kajian tentang keberkesanan aplikasi bahasa: apa yang diukur setiap satu dan apa yang ditemui
KajianYang diukurYang ditemui
Vesselinov dan Grego (2012)Orang dewasa peringkat permulaan bahasa Sepanyol, diuji dengan ujian penempatan universiti sebelum dan selepas belajar sendiri dalam aplikasi; ditempah syarikatPurata kira-kira 34 jam menghasilkan peningkatan setara satu semester pertama universiti, dengan perbezaan sangat besar dalam berapa banyak setiap orang benar-benar belajar
Loewen dll. (2019)Kajian bebas selama satu semester dengan pelajar universiti yang belajar bahasa Turki dari kosong dalam aplikasi yang samaKemajuan boleh diukur dalam membaca dan mendengar, sangat sedikit pergerakan dalam pertuturan, dan penurunan mendadak penggunaan sepanjang semester
Rachels dan Rockinson-Szapkiw (2018)Aplikasi bahasa Sepanyol bergamifikasi berbanding pengajaran bersemuka di sekolah rendah; mengukur pencapaian dan efikasi kendiriTiada perbezaan bererti dalam pencapaian, dengan efikasi kendiri lebih rendah dalam kumpulan aplikasi: hasil sama, keyakinan kurang
Golonka dll. (2014)Tinjauan seluruh landskap teknologi pembelajaran bahasa, disusun mengikut jenis teknologi dan kekuatan buktiBanyak keghairahan dan sedikit bukti ketat bahawa mana-mana teknologi tertentu mengatasi pengajaran biasa; penggunaan yang paling disokong adalah sempit dan khusus
Burston (2015)Dua dekad projek pembelajaran bahasa melalui telefon, dibedah mengikut apa yang benar-benar ditanggung oleh hasil yang diterbitkanHampir semua projek sangat singkat dan sangat kecil, jadi penemuan positifnya menggambarkan minggu-minggu kebaharuan, bukan satu semester penuh

Tiada satu pun kajian ini menguji aplikasi ini, dan tiada satu pun mengukur kefasihan. Yang diukur ialah skor ujian penempatan, kemahiran reseptif, dan pencapaian sekolah selama beberapa minggu atau satu semester. Ambil keputusan bagi kategori ini sebagai “melakukan sesuatu yang nyata, pada permulaan dan pada pengecaman dahulu”, dan anggap tidak bersandar setiap angka yang menjanjikan perbualan daripada ketikan pada skrin.

Di sebalik “aplikasi itu berkesan” bergerak tiga dakwaan berbeza

Ketiga-tiganya bersandar pada bukti yang sama sekali berbeza, maka orang yang sama boleh dengan wajar menganggap aplikasi berguna sekali gus menganggap iklannya karut. Hanya yang pertama disokong dengan baik.

  • Yang disokong: kemajuan permulaan yang boleh diukur, kebanyakannya reseptif. Setiap kajian di atas menemui sesuatu. Skor ujian penempatan bergerak, membaca dan mendengar bergerak, dan perbendaharaan kata ialah bahagian yang paling boleh dipercayai pergerakannya: komponen inilah yang paling bertindak balas terhadap ingatan berjarak, satu-satunya perkara yang perisian lakukan lebih baik daripada bilik darjah.
  • Yang dibesar-besarkan: aplikasi menggantikan kursus. Rachels dan Rockinson-Szapkiw (2018) menemui seri dengan pengajaran bersemuka, bukan keunggulan, dan Loewen bersama rakan-rakannya menemui tepat jurang pertuturan yang menjadi sebab kewujudan bilik darjah. Empat helai Nation (2007) menjelaskan bentuknya: input, output, pembelajaran bahasa secara sengaja, dan pembangunan kefasihan ialah kerja yang berbeza, dan aplikasi pilihan jawapan kuat dalam tepat satu daripadanya.
  • Yang palsu: fasih dalam lima belas minit sehari. Tiada kajian dalam literatur ini yang mengukur kefasihan, jadi tiada satu pun menyokong janji kefasihan. Dengan sepuluh minit sehari, 34 jam daripada penemuan paling terkenal itu mengambil kira-kira tujuh bulan — dan kiraan itu mengandaikan anda tidak terlepas satu hari pun, yang justeru dileraikan oleh bahagian seterusnya.

Pendedahan tanpa ingatan sudah menjadi dakwaan keempat, dengan datanya sendiri: adakah pembelajaran pasif berkesan?

Apa yang sebenarnya menentukan sama ada aplikasi menjadi untuk anda

Enam perkara, setiap satu diambil daripada penyelidikan dan bukan daripada senarai ciri, disusun mengikut sekuat mana ia menggerakkan hasil. Yang pertama menghimpit semua yang lain, dan itu tidak selesa bagi sesiapa yang menjual lima yang tinggal.

Enam faktor yang menentukan sama ada aplikasi bahasa membuahkan hasil, bukti bagi setiap satu, dan bentuk praktikalnya
Yang menentukanKata dataRupanya
Sama ada sesi itu berlaku langsungNielson (2011): kakitangan persekutuan dengan lesen, masa belajar berbayar, dan sokongan tutor pun kebanyakannya berhenti awal, dan hanya minoriti mencapai jumlah bermaknaKegagalannya bukan pelajaran yang buruk, tetapi pelajaran yang tidak pernah dibuka: jika sokongan dan masa berbayar sudah memadai, kajian itu akan berakhir lain
Sama ada anda mengingat atau mengecamRoediger dan Karpicke (2006): diuji atas bahan menghasilkan pengekalan jangka panjang lebih baik daripada membaca semula bahan yang sama dalam masa yang samaMemilih kotak yang betul daripada empat jauh lebih mudah daripada menghasilkan perkataannya, dan latihan mudah membeli lebih sedikit; jenis latihan lebih penting daripada aplikasinya
Sama ada latihan itu berjarakCepeda dll. (2006), sintesis 254 kajian: kira-kira 47% ingatan dengan latihan berjarak berbanding 37% dengan latihan sama secara berturut-turutSepuluh minit selama enam hari mengalahkan sejam pada hari Ahad, dan aplikasi yang muncul setiap hari menang pada paksi ini sebelum kandungannya dibandingkan pun
Sama ada setiap perkataan mendapat cukup pertemuanNation dan Wang (1999): sesuatu perkataan biasanya perlukan 8 hingga 12 pertemuan berjarak untuk kekalSiri yang menyajikan bahan baharu setiap hari tidak pernah menyelesaikan apa-apa; yang kekal ialah perkataan yang kepulangannya dijadualkan
Sama ada perkataan itu berbaloi dengan pertemuan tersebutNation (2006): 3000 keluarga perkataan pertama merangkumi kira-kira 95% perbualan harian, selepas itu liputannya mendatar dengan mendadakSusunan mengikut kekerapan ialah hampir keseluruhan pulangan tahun pertama: itulah sebabnya pelajaran bertema berisi nama haiwan terasa produktif dan terukur buruk
Dari mana datangnya minitReviews.org (2026): orang dewasa di AS melaporkan menjeling telefon kira-kira 186 kali sehari, lebih kurang 11.6 kali sejam ketika jagaRancangan yang perlukan slot baharu dalam sehari bersaing dengan segala yang lain di dalamnya; rancangan yang menumpang tabiat sedia ada tidak bersaing

Hanya baris kedua hingga kelima menyentuh kualiti perisian, dan itulah yang sudah lama diselesaikan oleh hampir keseluruhan kategori ini. Baris pertama dan keenam menyentuh penghantaran, dan di situlah hasilnya ditentukan: itulah sebabnya perbandingan kaedah berkali-kali berakhir seri.

Pemboleh ubah yang tidak diukur ulasan

Perbandingan aplikasi ditulis tentang ciri: sebagus mana pengecaman pertuturannya, seberharga mana nota tatabahasanya, bagaimana barisan ulangannya dibina. Itu perbezaan yang nyata, dan ia kecil. Perbezaan yang tidak kecil ialah antara orang yang menjalani empat puluh sesi dan orang yang menjalani empat, dan tiada ulasan boleh memberitahu anda yang mana satu anda nanti, kerana itu bukan sifat aplikasi.

Itulah sebabnya literatur keberkesanan berkali-kali memberikan hasil yang mendatar. Golonka dan rakan-rakannya (2014) mencari teknologi dengan bukti kelebihan yang kukuh dan kebanyakannya hanya menemui keghairahan; Burston (2015) mendapati dua dekad projek telefon kebanyakannya terdiri daripada kajian berdurasi beberapa minggu. Apabila tempohnya pendek dan masa yang dicurahkan berbeza satu orde magnitud antara peserta, perbezaan kaedah hampir tiada ruang untuk muncul. Sementara itu Nielson (2011) menyusun apa yang sepatutnya menjadi kes terbaik bagi perisian belajar sendiri — sukarelawan, lesen, masa terlindung, tutor — dan melihat majoriti berhenti. Ketekalan bukan faktor lembut di sisi faktor-faktor keras. Ia justeru faktor kerasnya.

Ini merumuskan semula soalan yang sebenarnya dimaksudkan orang. Versi jujurnya: adakah aplikasi ini menghasilkan cukup sesi pada hari-hari yang berselerak, supaya kesan jarak dan ingatan sempat terkumpul? Mana-mana teknik di halaman ini bernilai sifar pada aplikasi yang anda berhenti buka pada bulan Mac, dan teknik biasa-biasa pun terkumpul pada aplikasi yang tidak pernah perlu anda putuskan untuk dibuka. Langkah yang produktif bukan memburu latihan yang lebih baik. Ia memukul langkah tempat kerugian benar-benar berlaku.

Berapa kos berhenti, dalam unit penyelidikan

“Jadilah tekal” ialah nasihat yang tidak boleh diapa-apakan. Berikut perkara yang sama dengan angka: empat perkara konkrit yang berhenti berlaku apabila sesi berhenti, setiap satu pernah diukur seseorang.

Perhatikan: tiga daripada empat bukan tentang anda akan belajar lebih sedikit. Ketiga-tiganya tentang kehilangan bahan yang sudah pun dibayar.

Apa yang hilang apabila sesi berhenti, dengan saiz terukur bagi setiap kehilangan
Yang hilangBuktiSaiz terukur
Kelebihan jarakCepeda dll. (2006), sintesis 254 kajian latihan berjarakKira-kira 47% berbanding 37% — jurang yang hanya diperoleh dengan kembali pada hari lain
Pertemuan yang masih kurang bagi sesuatu perkataanNation dan Wang (1999), tentang berapa kali perkataan perlu ditemui supaya kekalKira-kira 8–12 pertemuan berjarak: perkataan yang ditinggalkan pada pertemuan keempat bukan satu pertiga dipelajari — ia lenyap
Segala yang separuh jalanMurre dan Dros (2015), replikasi lengkung lupa EbbinghausKehilangan awal yang curam tanpa ulangan: barisan yang anda berhenti kerjakan rapuh paling cepat pada hari-hari pertama, kemudian perlahan
Kursus yang tamatNielson (2011), belajar sendiri di tempat kerja dengan lesen, masa, dan sokonganMajoriti berhenti awal: hasil paling lazim bagi perisian belajar sendiri ialah kursus yang tidak habis, bukan kursus yang buruk

Ini bukan seruan berdisiplin. Ini seruan untuk menyusun perkara supaya lebih sedikit keputusan berdiri antara anda dan ulangan — soal reka bentuk, dan boleh diselesaikan. Apa yang berlaku kepada sesuatu perkataan di celah-celahnya ada di halaman mengapa saya lupa perkataan.

Membuang langkah tempat kerugian berlaku

Jika hasil ditentukan oleh ketekalan, soal reka bentuk yang berguna bukanlah bagaimana menjadikan pelajaran lebih baik. Soalnya ialah bagaimana membuat ulangan berlaku tanpa sesiapa memutuskan untuk mula. LearnScreen dibina di sekitar satu idea itu; inilah mekanismenya, tanpa hiasan:

1

Tiada apa-apa untuk dimulakan

Screen Time API Apple membenarkan penyekatan aplikasi yang anda pilih sendiri. Apabila anda membuka salah satunya, kad perbendaharaan kata muncul menggantikan suapan. Telefon dijeling kira-kira 186 kali sehari (Reviews.org, 2026), jadi ulangan menumpang tabiat sedia ada dan bukannya meminta slot baharu dalam sehari.

2

Setiap kad ialah percubaan mengingat

Jawapan tersembunyi sehingga anda menyentuhnya: kad itu ujian, bukan bacaan — tepat arah tempat Roediger dan Karpicke (2006) menemui pengekalan jangka panjang yang lebih baik. Penghantaran di latar menambah bilangan percubaan; ia tidak mengubah nilai satu percubaan.

3

Jadual menentukan apa yang kembali

Barisan Leitner mengembalikan perkataan yang tersilap lebih awal dan menolak perkataan yang sudah dikenali secara geometri, supaya 8–12 pertemuan yang diperlukan sesuatu perkataan (Nation dan Wang, 1999) tersebar merentas hari dan bukannya berhimpit dalam satu duduk.

  • Dosnya anda yang tentukan. Perkataan setiap giliran antara 3 hingga 20, begitu juga kekerapan sekatan itu kembali. Dengan tetapan lalai, jadinya kira-kira 25 percubaan mengingat sehari, lebih kurang dua setengah minit berkecai: cukup sedikit untuk tidak membatalkan mana-mana rancangan lain.
  • Ini bukan kursus dan tidak berpura-pura menjadi kursus. Ini kerja perbendaharaan kata yang disengajakan, satu daripada empat helai Nation (2007). Bertutur, membaca, dan mendengar ialah kerja yang tidak dilakukannya, dan tempatnya yang jujur ada di bawah semua itu: perbendaharaan kata aktif dan pasif.
  • Senarai kekerapan atau perkataan anda sendiri. Set siap sedia bermula dari tempat liputan paling murah (Nation, 2006), dan apa sahaja yang anda tambah secara manual atau tampal sekali gus masuk ke barisan yang sama: berapa perkataan diperlukan.
  • Berfungsi tanpa rangkaian, tanpa akaun. Kad dan sekatan berfungsi luar talian selepas pemasangan; sandaran iCloud ditulis ke pangkalan data peribadi anda sendiri, bukan ke pelayan kami, dan tiada tempat untuk mendaftar.

Di mana perkataan
muncul

Empat skrin aplikasi: kad skrin kunci, jawapan dengan contoh ayat, senarai perkataan, dan kemajuan.

Aplikasi yang disekat memaparkan kad perbendaharaan kata pada skrin kunci menggantikan suapan Jawapan terbuka pada kad: terjemahan dan contoh ayat yang mengandungi perkataan itu Senarai perkataan dengan tema siap sedia bersebelahan perkataan yang ditambah sendiri oleh pengguna Skrin kemajuan: berapa perkataan yang naik dalam barisan ulangan berjarak

Bacaan seterusnya

Soalan lazim

Adakah aplikasi belajar bahasa benar-benar berkesan?
Ya, untuk kemajuan permulaan yang boleh diukur, terutamanya dalam membaca dan mendengar. Angka yang paling banyak dipetik: kira-kira 34 jam belajar dalam aplikasi menghasilkan peningkatan pada ujian penempatan yang setara satu semester pertama bahasa Sepanyol di universiti, dalam kajian yang ditempah syarikat itu sendiri (Vesselinov dan Grego, 2012). Kajian bebas selama satu semester dengan orang yang belajar bahasa Turki dalam aplikasi yang sama menemui kemajuan reseptif yang nyata dan hampir tiada pergerakan dalam pertuturan (Loewen dll., 2019), manakala perbandingan terkawal dengan pengajaran bersemuka tidak menemui perbezaan pencapaian yang bererti dan menemui efikasi kendiri lebih rendah dalam kumpulan aplikasi (Rachels dan Rockinson-Szapkiw, 2018). Tiada apa dalam literatur ini menyokong janji kefasihan, dan tiada satu pun daripadanya terpakai pada sesi yang tidak pernah berlaku.
Adakah satu aplikasi cukup untuk menguasai bahasa?
Satu tidak cukup, dan batas itu bersifat struktur, bukan kecacatan produk tertentu. Model empat helai Nation (2007) berhujah bahawa kursus memerlukan input berfokus makna, output berfokus makna, pembelajaran bahasa secara sengaja, dan pembangunan kefasihan dalam bahagian yang lebih kurang sama. Aplikasi pilihan jawapan sangat baik dalam pembelajaran yang disengajakan dan memadai dalam input; ia lemah dalam output, itulah sebabnya Loewen dan rakan-rakannya (2019) mengukur kemajuan dalam membaca dan mendengar dan hampir tiada dalam pertuturan. Peranannya yang realistik ialah enjin perbendaharaan kata dan tatabahasa di bawah latihan perbualan yang anda dapat dari tempat lain.
Mengapa perbandingan aplikasi selalu berakhir seri?
Kerana perbezaan antara kaedah adalah kecil berbanding perbezaan dalam berapa banyak yang benar-benar dilakukan orang. Tinjauan teknologi bahasa berkali-kali menemui bukti yang nipis bagi mana-mana teknologi tertentu dan reka bentuk kajian yang pendek (Golonka dll., 2014), dan analisis Burston (2015) terhadap dua dekad projek telefon menunjukkan kebanyakannya berlangsung berminggu-minggu, bukan bersemester-semester. Apabila tempohnya pendek dan masa yang dicurahkan sangat berbeza antara peserta, kesan kaedah tenggelam. Kesimpulan praktikalnya: aplikasi yang akan anda buka lebih baik daripada aplikasi yang skornya sedikit lebih tinggi dalam ujian.
Berapa jam dalam aplikasi setara dengan satu semester kelas?
Kira-kira 34 jam, menurut satu ujian penempatan, dalam satu kajian bahasa Sepanyol yang ditempah syarikat (Vesselinov dan Grego, 2012) — dan angka itu perlu dilayan dengan berhati-hati. Ia mengukur kemajuan pada ujian penempatan, bukan keupayaan mengekalkan perbualan; ia diperoleh daripada mereka yang bertahan hingga akhir; dan dibayar oleh syarikat yang produknya dinilai. Anggap ia bukti bahawa kategori ini melakukan sesuatu, bukan kadar tukaran, dan kiralah: dengan sepuluh minit sehari, 34 jam bermakna kira-kira tujuh bulan.
Apa yang membezakan mereka yang berjaya dengan aplikasi daripada yang berhenti?
Sama ada sesi itu berlaku. Nielson (2011) memberi kakitangan persekutuan perisian bahasa dengan masa berbayar dan sokongan tutor, dan walaupun dalam persekitaran yang luar biasa menyokong itu majoriti berhenti awal, manakala hanya minoriti mencapai jumlah bermakna. Penemuan itu tentang model penghantaran, bukan tentang perisiannya: belajar sendiri menuntut anda memutuskan untuk mula setiap hari, dan di situlah kebocorannya berlaku. Segala yang lain di halaman ini datang selepasnya.
Adakah ulangan pasif atau di latar dikira sebagai menggunakan aplikasi?
Dikira jika percubaan mengingat berlaku. Satu pendedahan mengajar dengan perlahan, dan yang membuahkan hasil ialah kesan pengujian: Roediger dan Karpicke (2006) menemui bahawa diuji mengekalkan lebih baik daripada membaca semula, dan Cepeda serta rakan-rakannya (2006) merentas 254 kajian meletakkan latihan berjarak pada kira-kira 47% ingatan berbanding 37% bagi latihan berturut-turut. Penghantaran di latar mengubah bilangan percubaan, bukan nilai satu percubaan. Kad yang anda leret lepas bernilai jauh lebih kecil daripada kad yang anda cuba jawab.

Sumber

  1. Vesselinov, R., & Grego, J. (2012). Duolingo Effectiveness Study. City University of New York / University of South Carolina. Commissioned by Duolingo.
  2. Loewen, S., Crowther, D., Isbell, D. R., Kim, K. M., Maloney, J., Miller, Z. F., & Rawal, H. (2019). Mobile-assisted language learning: A Duolingo case study. ReCALL, 31(3), 293–311.
  3. Rachels, J. R., & Rockinson-Szapkiw, A. J. (2018). The effects of a mobile gamification app on elementary students’ Spanish achievement and self-efficacy. Computer Assisted Language Learning, 31(1–2), 72–89.
  4. Nielson, K. B. (2011). Self-study with language learning software in the workplace: What happens? Language Learning & Technology, 15(3), 110–129.
  5. Golonka, E. M., Bowles, A. R., Frank, V. M., Richardson, D. L., & Freynik, S. (2014). Technologies for foreign language learning: A review of technology types and their effectiveness. Computer Assisted Language Learning, 27(1), 70–105.
  6. Burston, J. (2015). Twenty years of MALL project implementation: A meta-analysis of learning outcomes. ReCALL, 27(1), 4–20.
  7. Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380.
  8. Roediger, H. L., & Karpicke, J. D. (2006). Test-enhanced learning: Taking memory tests improves long-term retention. Psychological Science, 17(3), 249–255.
  9. Nation, I. S. P., & Wang, K. (1999). Graded readers and vocabulary. Reading in a Foreign Language, 12(2), 355–380.
  10. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  11. Nation, I. S. P. (2007). The four strands. Innovation in Language Learning and Teaching, 1(1), 2–13.
  12. Murre, J. M. J., & Dros, J. (2015). Replication and analysis of Ebbinghaus’ forgetting curve. PLOS ONE, 10(7), e0120644.
  13. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

Ini kajian-kajian kecil. Sampelnya antara satu dua kelas hingga beberapa ratus orang, tempohnya dari beberapa minggu hingga satu semester, dan yang diukur ialah ujian penempatan serta bateri kemahiran, bukan perbualan sebenar. Salah satunya dibayar oleh syarikat yang produknya dinilai, dan itu dinyatakan di tempat ia dipetik. LearnScreen belum pernah melalui kajian keberkesanan dan halaman ini tidak mendakwa sebaliknya; angka-angka tentang aplikasi ini ialah aritmetik daripada tetapan lalai dan percubaan mengingat berdurasi kira-kira dua puluh saat, bukan data penggunaan yang terukur.

Betulkan langkah yang menentukan hasil

Jika kajian mengatakan ketekalan mengalahkan kaedah, ubatnya bukan pelajaran yang lebih baik, tetapi ulangan yang berlaku tanpa keputusan. LearnScreen meletakkannya dalam telefon yang anda memang akan buka, dan tidak meminta satu minit baharu pun.

Muat turun di App Store