मजकुराकडे जा
शब्दसंग्रह संशोधन

एखादी भाषा बोलण्यासाठी
किती शब्द लागतात?

साधारण २,०००–३,००० शब्दकुळे रोजच्या संभाषणाचा सुमारे ९५% भाग व्यापतात — संभाषण चालू ठेवण्यासाठी एवढे पुरेसे आहे. कष्टाशिवाय समजणे मात्र महाग पडते: बोलल्या जाणाऱ्या भाषेसाठी ६,०००–७,००० आणि कादंबऱ्या व वृत्तपत्रांसाठी ८,०००–९,००० कुळे (Nation, 2006). मातृभाषिकांना याच्या कैक पट शब्द येतात, आणि म्हणूनच उपयोगी प्रश्न "किती शब्द आहेत" हा नसून पहिली काही हजार कोणती आहेत — आणि प्रत्यक्षात ती किती वेगाने वाढवता येतात — हा आहे.

संपूर्ण संदर्भ पानाच्या तळाशी

आयफोनवरील शब्दपत्रक, जे एखाद्या शब्दाचा अर्थ आठवायला सांगते

महत्त्वाचे आहे व्याप्ती, शब्दसंग्रहाचा आकार नव्हे

संशोधन तुम्ही अमूर्तपणे किती शब्द जाणता हे विचारत नाही; ते विचारते की एखाद्या मजकुरातील किंवा संभाषणातील किती टक्के शब्द तुम्हाला आधीच माहीत आहेत — म्हणजेच शाब्दिक व्याप्ती. हाच दृष्टिकोन आकड्यांना उपयोगी बनवतो, कारण शब्दांची वारंवारता कमालीची असमान असते: अतिशय सामान्य शब्दांचा छोटासा गाभा जवळपास सगळे काम करतो.

Nation (2006) नुसार सर्वाधिक वापरली जाणारी १,००० शब्दकुळे बोलल्या जाणाऱ्या भाषेच्या सुमारे ८०% भरतात. त्यानंतरचे प्रत्येक हजार कमी परतावा देते. ही एकाच वेळी चांगली आणि वाईट बातमी आहे: पहिली २,००० कुळे तुम्ही शिकाल त्यातील सर्वाधिक फायदेशीर गोष्ट आहेत, तर ९५% वरून ९८% व्याप्तीपर्यंत चढण्यासाठी आणखी काही हजार लागतात.

शब्दकुळांमधील शब्दसंग्रहाचा आकार, त्याला अनुरूप शाब्दिक व्याप्ती आणि व्यवहारातील अर्थ
ज्ञात कुळेव्याप्ती (अंदाजे)अनुभव कसा असतो
१,०००बोलण्याच्या ~८०%सोप्या संभाषणाचा मथितार्थ; दर पाचांतील एक शब्द अपरिचित
२,०००–३,०००बोलण्याच्या ~९५%संभाषण चालवता येते; रिकाम्या जागा संदर्भावरून ओळखता येतात
६,०००–७,०००बोलण्याच्या ~९८%चित्रपट, पॉडकास्ट आणि वेगवान बोलणे — सतत ताण न घेता
८,०००–९,०००लेखनाच्या ~९८%शब्दकोशाशिवाय कादंबऱ्या आणि वृत्तपत्रे
~१७,००० मूळ शब्दमातृभाषिक पल्लाशिकलेला प्रौढ (Goulden, Nation & Read, 1990)

व्याप्तीचे आकडे Nation (2006) आणि Adolphs & Schmitt (2003) यांच्याकडून; मातृभाषिकांचा अंदाज Goulden, Nation & Read (1990) यांच्याकडून. मोजमाप इंग्रजीवर झाले: वक्राचा आकार इतर भाषांतही तसाच दिसतो, नेमके आकडे नाहीत.

"एक शब्द" म्हणजे नेमके काय मोजतो?

वरील सर्व आकडे शब्दकुळांमध्ये आहेत, शब्दरूपांत नाहीत. एक कुळ म्हणजे मूळ शब्द अधिक त्याची रूपे आणि नियमित साधित शब्द: इंग्रजीत help, helps, helped, helping, helper, helpful, unhelpful हे एक कुळ, सात नव्हे. असे मोजण्याचे कारण म्हणजे मूळ व प्रत्यय माहीत असले की उरलेले बहुतांशी ओळखता येते.

  • ३,००० कुळे म्हणजे ३,००० शब्दांहून कितीतरी अधिक. भाषेनुसार दोन ते चार पट अधिक वेगळी रूपे. जाहिरातींतले "५,००० शब्द शिका" आणि संशोधनातली मोजणी क्वचितच एकच एकक असतात.
  • अधिक रूपे असणाऱ्या भाषा कच्चा आकडा फुगवतात. मराठी, रशियन, फिनिश आणि कोरियन एका कुळाला अनेक रूपांत पसरवतात; ठराविक व्याप्तीसाठी लागणाऱ्या कुळांची संख्या तुलनात्मक राहते, पण तुम्हाला भेटणारी रूपे नाहीत.
  • ग्रहणशील आणि उत्पादक शब्दसंग्रह वेगळे असतात. CEFR आणि व्याप्तीचे आकडे तुम्ही जे ओळखता ते मोजतात. बोलताना तुम्ही स्वतः जे निर्माण करता ते नेहमीच कमी असते.

संबंधित: एक कुळ वाढवण्याचा खर्च — एखादा शब्द लक्षात राहण्यासाठी किती वेळा पाहावा लागतो (इंग्रजीत).

प्रत्येक CEFR स्तरावर किती शब्द?

CEFR तुम्ही काय करू शकता हे सांगते, तुम्हाला किती शब्द येतात हे नाही: स्तरानुसार अधिकृत मोजणी अस्तित्वात नाही. मोजमापे मात्र आहेत. Milton (2010) यांनी प्रत्येक स्तरावरील इंग्रजी शिकणाऱ्यांची चाचणी घेऊन सोबतचे शब्दसंग्रह-आकार प्रकाशित केले. हे मोठ्या विखुरणीसह निरीक्षिलेले सरासरी आहेत, प्रवेशअटी नाहीत.

CEFR स्तरानुसार मोजलेला ग्रहणशील शब्दसंग्रह (शब्दकुळे)
CEFR स्तरकुळे (मोजलेली)सहसा कशासाठी पुरते
A1~१,५०० पेक्षा कमीठराविक वाक्प्रचार, ओळख, तातडीच्या गरजा
A2~१,५००–२,५००रोजचे व्यवहार: दुकाने, पत्ता विचारणे, छोटी बातचीत
B1~२,७५०–३,२५०परिचित विषयांवर संभाषण; मदतीशिवाय प्रवास
B2~३,२५०–३,७५०चर्चा आणि युक्तिवाद; प्रयत्नाने बहुतेक माध्यमे
C1~३,७५०–४,५००शैक्षणिक व व्यावसायिक वापर; अध्याहृत अर्थ
C2~४,५००–५,०००+जवळपास पूर्ण आकलन; सूक्ष्मता आणि भाषाशैली

Milton (2010), परकीय भाषा म्हणून इंग्रजी शिकणाऱ्यांचा ग्रहणशील शब्दसंग्रह. साधन ५,००० शब्दांच्या पट्ट्यापर्यंतच जाते, त्यामुळे C1 आणि C2 दबले जातात: C2 वक्त्याचा खरा शब्दसंग्रह तक्त्याच्या मर्यादेपेक्षा मोठा असतो.

"समजण्याची" पातळी ९५% नव्हे, ९८% का

९५% ऐकायला जवळजवळ पूर्ण वाटते, पण तसे नाही: याचा अर्थ दर वीसांत एक अपरिचित शब्द, म्हणजे कादंबरीच्या प्रत्येक ओळीत साधारण एक. Hu आणि Nation (2000) यांनी कथासाहित्यातील अपरिचित शब्दांची घनता बदलून हे थेट तपासले. ८०% व्याप्तीवर मदतीशिवाय पुरेशा आकलनापर्यंत जवळपास कोणीच पोहोचले नाही; ९५% वर फक्त अल्पसंख्य; आणि ९८% हा तो बिंदू होता जिथे बहुतेकांना स्वबळावर जमले.

त्यानंतर Schmitt, Jiang आणि Grabe (2011) यांनी शैक्षणिक मजकुरांवर ६६१ शिकणाऱ्यांची चाचणी घेतली आणि व्याप्ती व आकलन यांतील नाते मूलतः रेषीय असल्याचे आढळले — कोणतीही दरी नाही, जादूई उंबरठाही नाही. व्याप्तीचा प्रत्येक टक्का प्रमाणात आकलन विकत घेतो. म्हणून ९८% हा नियोजनासाठीचा व्यावहारिक आकडा आहे, कळ नव्हे.

व्यावहारिक अर्थ: २,०००–३,००० कुळांवर तुम्ही संभाषण करू शकता, आणि पुढचे प्रत्येक हजार भाषा अधिक शांत करते — कमी रिकाम्या जागा, कमी अंदाज, कमी थकवा.

३,००० शब्दांना किती वेळ लागेल?

ध्येय ठरले की कालावधी हे केवळ भागाकाराचे गणित उरते — आणि तो ठरवतो वेग, म्हणजे नेमकी तीच राशी जिचा अंदाज बहुतेक योजना चुकवतात. वाचताना भेटलेल्या शब्दाला रुजायला साधारण ८–१२ भेटी लागतात, आणि त्या भेटी अनेक दिवसांत विखुरलेल्या नसतील तर टिकत नाहीत.

म्हणून "रोज किती शब्द" म्हणजे तुम्ही किती पाहता ते नव्हे, तर किती शब्द आपले उजळणी-चक्र पूर्ण करतात ते. चार प्रामाणिक वेगांवरचे गणित:

दररोज शिकलेल्या शब्दांच्या चार वेगांवर विविध ध्येयांपर्यंत लागणारा वेळ
रोज नवे शब्दवर्षाला+१,२५० पर्यंत (A2→B1)शून्यातून ३,००० पर्यंत
३६५सुमारे ३ वर्षे ५ महिनेसुमारे ८ वर्षे ३ महिने
७३०सुमारे १ वर्ष ८ महिनेसुमारे ४ वर्षे १ महिना
१,०९५सुमारे १ वर्ष २ महिनेसुमारे २ वर्षे ९ महिने
१,८२५सुमारे ८ महिनेसुमारे १ वर्ष ८ महिने

शून्य सुट्ट्या आणि शून्य मागे पडणे गृहीत धरून केलेला निव्वळ भागाकार — आणि तुटतेही नेमके हेच गृहीतक. तीन वर्षे रोज तीन शब्द म्हणजे कठीण दिवस नव्हे, तर सलग १,०९५ दिवस जेव्हा तुम्हाला ते करायचे आठवले.

रोजचे थोडे शब्द
प्रत्यक्षात कुठून येऊ शकतात

अडथळा कधीच ध्येय नसतो, सातत्य असते — आणि सातत्य इच्छाशक्तीकडून घेण्यापेक्षा आधीच असलेल्या सवयीकडून घेणे स्वस्त पडते. Reviews.org च्या २०२६ च्या सर्वेक्षणात (अमेरिकेतील सुमारे १,००० प्रौढ) आढळले की लोक दिवसातून १८६ वेळा फोनकडे पाहतात. पुन्हापुन्हा येणाऱ्या क्षणांचा हाच सर्वात मोठा साठा बहुतेकांकडे आहे.

1

उजळणीला सवयीशी जोडा

LearnScreen तुम्ही निवडलेली ॲप्स — Instagram, TikTok, X, गेम्स — ॲपलच्या Screen Time API द्वारे अडवते. अडवणूक ऑपरेटिंग सिस्टीमच्या पातळीवर चालते, त्यामुळे VPN किंवा DNS ची कोणतीही युक्ती तिला चुकवू शकत नाही.

2

प्रत्येक वेळी उघडणे हा आठवण्याचा प्रयत्न व्हावा

ॲपऐवजी शब्दपत्रक येते. उत्तर दिल्यावर ॲप ठरावीक वेळेसाठी उघडते. हे सक्रिय स्मरण आहे — अंतरानंतरही टिकणारी भेट — नजर फिरवून पाहिलेली शब्दयादी नव्हे.

3

शब्दाची निवड वेळापत्रकाने करावी

लाइटनर पद्धतीचे अंतराळ-उजळणीचे वेळापत्रक तुम्ही काय पाहाल हे ठरवते. चुकलेले शब्द लवकर परततात, आत्मसात झालेले दूर सरकतात. संशोधन ज्या अंतराची मागणी करते ते तुम्ही हिशेब न ठेवताही घडते.

  • १८ विषयांत १,०८० हून अधिक निवडक शब्द — मूलभूत, रोजचे जीवन, प्रवास, अन्न, काम, अंक आणि बरेच काही: म्हणजे साधारण तीच वारंवारता-पट्टी जी वरील व्याप्ती-तक्त्यात सर्वाधिक भार उचलते.
  • शिकण्यासाठी ११ भाषा — इंग्रजी, जर्मन, स्पॅनिश, फ्रेंच, इटालियन, जपानी, कोरियन, पोलिश, ब्राझिलियन पोर्तुगीज, रशियन आणि मँडरिन चिनी.
  • तुमचे स्वतःचे शब्दही — अनुवाद, उच्चार आणि उदाहरण वाक्यासह कोणताही शब्द जोडा; तो त्याच फेरीत सामील होतो.
  • ऑफलाइन, खात्याशिवाय. इन्स्टॉलनंतर पत्रके आणि अडवणूक नेटवर्कशिवाय चालतात. नोंदणी, ईमेल किंवा पासवर्ड नाही; iCloud बॅकअप तुमचाच खासगी डेटाबेस वापरतो.

एका वेळी एक शब्द,
प्रत्येकी काही सेकंद

तीन हजार शब्द ही मोठी बेरीज आहे, जी अत्यंत छोट्या घटनांतून तयार होते.

अडवलेल्या ॲपच्या जागी आलेले शब्दपत्रक, जे अनुवाद विचारते अडवण्यासाठी ॲप्स व श्रेणी निवडणे, जेणेकरून प्रत्येक उघडण्यावर उजळणी सुरू होते शब्दसंग्रह उभारण्यासाठी उपलब्ध अकरा भाषा प्रगती स्क्रीन, ज्यात पुरेशी उजळणी जमवलेले शब्द दिसतात

पुढे वाचा

नेहमीचे प्रश्न

एखादी भाषा बोलण्यासाठी किती शब्द माहीत असावेत?
रोजच्या संभाषणासाठी साधारण २,०००–३,००० शब्दकुळे. Adolphs आणि Schmitt (2003) यांना आढळले की सर्वाधिक वापरली जाणारी २,०००–३,००० कुळे रोजच्या बोलल्या जाणाऱ्या इंग्रजीच्या सुमारे ९५% भरतात, तर Nation (2006) फक्त पहिली १,००० कुळेच बोलण्याच्या सुमारे ८०% मानतात. संभाषणात सहभागी होण्यासाठी हे पुरेसे आहे, सर्वकाही समजण्यासाठी नाही.
अस्खलित होण्यासाठी किती शब्द लागतात?
"अस्खलित" ने काय व्यापावे यावर ते अवलंबून आहे. Nation (2006) यांनी बोलण्याच्या ९८% व्याप्तीसाठी ६,०००–७,००० कुळे आणि कादंबऱ्या व वृत्तपत्रांसारख्या लिखित मजकुरासाठी ८,०००–९,००० यांचा अंदाज दिला. शिकलेल्या मातृभाषिक इंग्रजी वक्त्यांना सुमारे १७,००० मूळ शब्द येतात (Goulden, Nation & Read, 1990) — अस्खलित परभाषिकाचा शब्दसंग्रह त्याचा एक अंशच असतो.
शब्दकुळ म्हणजे काय आणि शब्द का मोजत नाहीत?
शब्दकुळ म्हणजे मूळ शब्द अधिक त्याची रूपे व नियमित साधित शब्द — help, helps, helper, helpful मिळून एक कुळ. संशोधन असे मोजते कारण एक सदस्य शिकल्यावर बाकीचे बहुतांशी ओळखता येतात. म्हणून ३,००० कुळे ३,००० पेक्षा कितीतरी अधिक वेगळ्या रूपांइतकी असतात.
प्रत्येक CEFR स्तराला किती शब्द लागतात?
Milton (2010) यांनी इंग्रजी शिकणाऱ्यांचे मोजमाप करून साधारण असे नोंदवले: A1 १,५०० कुळांहून कमी, A2 १,५००–२,५००, B1 २,७५०–३,२५०, B2 ३,२५०–३,७५०, C1 ३,७५०–४,५००, C2 ४,५००–५,०००. हे मोठ्या व्यक्तिगत फरकांसह निरीक्षिलेले ग्रहणशील शब्दसंग्रह आहेत, आणि चाचणी ५,००० च्या पट्ट्यावर थांबते, त्यामुळे वरचे स्तर दबलेले दिसतात. CEFR स्वतः कोणतीही अधिकृत मोजणी ठरवत नाही.
३,००० शब्द शिकायला किती वेळ लागतो?
रोज एक नवा शब्द या वेगाने सुमारे आठ वर्षे; रोज तीन या वेगाने सुमारे दोन वर्षे नऊ महिने; रोज पाच या वेगाने एक वर्ष आठ महिने. कालावधी वेग ठरवतो, आणि वेगाला मर्यादा घालते ती म्हणजे अंतराने आठवण्याचे किती प्रयत्न तुम्ही खरोखर पूर्ण करता — वाचताना भेटलेल्या प्रत्येक शब्दासाठी साधारण ८–१२ भेटी.
अभ्यासाच्या बैठकांशिवाय शब्दसंग्रह उभारता येतो का?
होय, जर उजळणी तुम्ही आधीपासून पुन्हापुन्हा करत असलेल्या गोष्टीशी जोडली गेली तर. Reviews.org च्या २०२६ च्या सर्वेक्षणात (अमेरिकेतील सुमारे १,००० प्रौढ) दिवसाला १८६ वेळा फोन पाहण्याची नोंद आहे. LearnScreen ॲपलच्या Screen Time API द्वारे निवडलेली ॲप्स अडवते आणि उघडताना पत्रक दाखवते, त्यामुळे आठवण्याचे प्रयत्न त्याच फोन-वापरात साठतात जो आधीपासून सुरूच होता.

संदर्भ

  1. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  2. Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438.
  3. Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
  4. Schmitt, N., Jiang, X., & Grabe, W. (2011). The percentage of words known in a text and reading comprehension. Modern Language Journal, 95(1), 26–43.
  5. Goulden, R., Nation, P., & Read, J. (1990). How large can a receptive vocabulary be? Applied Linguistics, 11(4), 341–363.
  6. Milton, J. (2010). The development of vocabulary breadth across the CEFR levels. EuroSLA Monographs 1, 211–232.
  7. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

शेवटची तपासणी: २८ जुलै २०२६.

पहिल्या दोन हजारांपासून
सुरुवात करा

खाते नाही. ऑफलाइन चालते. पुढच्या वेळी तुम्ही अडवलेले ॲप उघडाल, तेव्हा तुम्ही एक शब्द जवळ असाल.

iOS साठी डाउनलोड करा