सामग्री पर जाएँ
शब्दावली पर शोध

कोई भाषा बोलने के लिए
कितने शब्द चाहिए?

लगभग 2,000–3,000 शब्द-परिवार रोज़मर्रा की बातचीत का करीब 95% हिस्सा ढक लेते हैं — बातचीत चलाते रहने के लिए इतना काफ़ी है। बिना मेहनत समझना महँगा पड़ता है: बोली जाने वाली भाषा के लिए 6,000–7,000 और उपन्यास व अख़बार के लिए 8,000–9,000 परिवार (Nation, 2006)। मातृभाषी इससे कई गुना जानते हैं, और ठीक इसीलिए काम का सवाल यह नहीं कि शब्द कितने हैं, बल्कि यह कि शुरुआती कुछ हज़ार कौन-से हैं — और उन्हें व्यावहारिक रूप से कितनी तेज़ी से जोड़ा जा सकता है।

पूरे स्रोत पृष्ठ के अंत में

आईफ़ोन पर शब्द-कार्ड जो किसी शब्द का अर्थ याद करने को कहता है

मायने कवरेज रखता है, शब्दावली का आकार नहीं

शोध यह नहीं पूछता कि आप अमूर्त रूप से कितने शब्द जानते हैं, बल्कि यह कि किसी दिए हुए पाठ या बातचीत के शब्दों में से कितने प्रतिशत आप पहले से जानते हैं — यानी शाब्दिक कवरेज। यही दृष्टिकोण आँकड़ों को उपयोगी बनाता है, क्योंकि शब्दों की आवृत्ति बेहद असमान है: बहुत आम शब्दों का एक छोटा-सा केंद्र लगभग सारा काम कर देता है।

Nation (2006) के अनुसार सबसे अधिक प्रयुक्त 1,000 शब्द-परिवार बोली जाने वाली भाषा का करीब 80% बनाते हैं। इसके बाद हर अगला हज़ार कम प्रतिफल देता है। यह एक साथ अच्छी और बुरी ख़बर है: पहले 2,000 परिवार वह सबसे लाभदायक चीज़ हैं जो आप कभी सीखेंगे, जबकि 95% से 98% कवरेज तक चढ़ने में कई हज़ार और लगते हैं।

शब्द-परिवारों में शब्दावली का आकार, तदनुरूप शाब्दिक कवरेज और व्यवहार में उसका अर्थ
ज्ञात परिवारकवरेज (लगभग)अनुभव कैसा रहता है
1,000बोलचाल का ~80%सरल बातचीत का मूल भाव; हर पाँच में एक शब्द अनजाना
2,000–3,000बोलचाल का ~95%बातचीत चला लेते हैं; रिक्त स्थान संदर्भ से अनुमान लग जाते हैं
6,000–7,000बोलचाल का ~98%फ़िल्में, पॉडकास्ट और तेज़ बोलना — लगातार ज़ोर लगाए बिना
8,000–9,000लेखन का ~98%बिना शब्दकोश उपन्यास और अख़बार
~17,000 मूल शब्दमातृभाषी दायराशिक्षित वयस्क (Goulden, Nation & Read, 1990)

कवरेज के आँकड़े Nation (2006) तथा Adolphs & Schmitt (2003) से; मातृभाषी अनुमान Goulden, Nation & Read (1990) से। माप अंग्रेज़ी पर हुआ: वक्र का आकार दूसरी भाषाओं में भी दोहराया जाता है, सटीक संख्याएँ नहीं।

"एक शब्द" किसे गिना जाता है?

ऊपर के सभी आँकड़े शब्द-परिवारों में हैं, शब्द-रूपों में नहीं। एक परिवार यानी मूल शब्द के साथ उसके रूपांतर और नियमित व्युत्पन्न: अंग्रेज़ी में help, helps, helped, helping, helper, helpful, unhelpful एक परिवार है, सात नहीं। ऐसा इसलिए गिना जाता है क्योंकि मूल और प्रत्यय पता होने पर बाक़ी काफ़ी हद तक अनुमेय हो जाता है।

  • 3,000 परिवार 3,000 शब्दों से कहीं ज़्यादा हैं। भाषा के अनुसार दो से चार गुना अलग-अलग रूप। विज्ञापनों का "5,000 शब्द सीखें" और शोध की गिनती लगभग कभी एक ही इकाई नहीं होते।
  • अधिक रूपांतर वाली भाषाएँ कच्ची संख्या को फुला देती हैं। हिन्दी, रूसी, फ़िनिश और कोरियाई एक परिवार को कई रूपों में फैला देती हैं; किसी तय कवरेज के लिए ज़रूरी परिवारों की संख्या तुलनीय रहती है, पर आपको मिलने वाले रूप नहीं।
  • ग्रहणशील और उत्पादक शब्दावली अलग-अलग हैं। CEFR और कवरेज के आँकड़े वही मापते हैं जिसे आप पहचान लेते हैं। बोलते समय आप ख़ुद जो बना पाते हैं, वह हमेशा कम होता है।

संबंधित: एक परिवार जोड़ने की लागत — किसी शब्द को याद रखने के लिए कितनी बार देखना पड़ता है (अंग्रेज़ी में)।

हर CEFR स्तर पर कितने शब्द?

CEFR यह बताता है कि आप क्या कर सकते हैं, न कि आप कितने शब्द जानते हैं: प्रति स्तर कोई आधिकारिक गिनती नहीं है। मापें ज़रूर मौजूद हैं। Milton (2010) ने हर स्तर पर अंग्रेज़ी सीखने वालों की जाँच की और साथ चलने वाले शब्दावली-आकार प्रकाशित किए। ये व्यापक बिखराव वाले प्रेक्षित औसत हैं, प्रवेश-शर्तें नहीं।

CEFR स्तर के अनुसार मापी गई ग्रहणशील शब्दावली (शब्द-परिवार)
CEFR स्तरपरिवार (मापे गए)आमतौर पर किसके लिए काफ़ी
A1~1,500 से कमबंधे-बँधाए वाक्यांश, परिचय, तात्कालिक ज़रूरतें
A2~1,500–2,500रोज़मर्रा: दुकानें, रास्ता पूछना, छोटी बातचीत
B1~2,750–3,250परिचित विषयों पर बातचीत; बिना मदद यात्रा
B2~3,250–3,750बहस और तर्क; मेहनत से अधिकांश मीडिया
C1~3,750–4,500शैक्षणिक और पेशेवर उपयोग; निहित अर्थ
C2~4,500–5,000+लगभग पूरी समझ; बारीकी और शैली-स्तर

Milton (2010), विदेशी भाषा के रूप में अंग्रेज़ी सीखने वालों की ग्रहणशील शब्दावली। उपकरण 5,000 शब्दों की पट्टी तक ही जाता है, इसलिए C1 और C2 दब जाते हैं: C2 वक्ता की वास्तविक शब्दावली तालिका की सीमा से बड़ी है।

"समझ" की कसौटी 95% नहीं, 98% क्यों है

95% लगभग पूरा लगता है, पर है नहीं: इसका मतलब है हर बीस में एक अनजाना शब्द, यानी उपन्यास की हर पंक्ति में करीब एक। Hu और Nation (2000) ने साहित्यिक पाठ में अनजाने शब्दों का घनत्व बदलकर इसे सीधे जाँचा। 80% कवरेज पर बिना सहायता पर्याप्त समझ तक व्यावहारिक रूप से कोई नहीं पहुँचा; 95% पर केवल अल्पसंख्यक; और 98% वह बिंदु था जहाँ अधिकांश लोग अपने बल पर सफल हुए।

इसके बाद Schmitt, Jiang और Grabe (2011) ने शैक्षणिक पाठों पर 661 शिक्षार्थियों की जाँच की और पाया कि कवरेज और समझ का संबंध मूलतः रैखिक है — न कोई खाई, न कोई जादुई सीमा। कवरेज का हर प्रतिशत बिंदु उसी अनुपात में समझ ख़रीदता है। इसलिए 98% योजना बनाने का व्यावहारिक आँकड़ा है, कोई स्विच नहीं।

व्यावहारिक अर्थ: 2,000–3,000 परिवारों पर आप बातचीत कर लेते हैं, और उसके बाद हर हज़ार भाषा को और शांत बना देता है — कम रिक्त स्थान, कम अनुमान, कम थकान।

3,000 शब्दों में कितना समय लगेगा?

लक्ष्य तय होते ही अवधि एक भाग की गणना भर रह जाती है — और तय गति करती है, यानी ठीक वही राशि जिसका अनुमान अधिकांश योजनाएँ ग़लत लगाती हैं। पढ़ते समय मिले शब्द को टिकने के लिए करीब 8–12 मुलाक़ातें चाहिए, और उन मुलाक़ातों का कई दिनों में फैला होना ज़रूरी है वरना वे बचती नहीं।

इसलिए "रोज़ कितने शब्द" का अर्थ यह नहीं कि आप कितने देखते हैं, बल्कि यह कि कितने अपना दोहराव-चक्र पूरा करते हैं। चार ईमानदार गतियों पर गणित:

प्रतिदिन सीखे गए शब्दों की चार गतियों पर विभिन्न लक्ष्यों तक पहुँचने का समय
रोज़ नए शब्दसालाना+1,250 तक (A2→B1)शून्य से 3,000 तक
1365लगभग 3 साल 5 माहलगभग 8 साल 3 माह
2730लगभग 1 साल 8 माहलगभग 4 साल 1 माह
31,095लगभग 1 साल 2 माहलगभग 2 साल 9 माह
51,825लगभग 8 माहलगभग 1 साल 8 माह

यह शून्य छुट्टी और शून्य पीछे हटने की मान्यता पर सीधा भाग है — और टूटती भी यही मान्यता है। तीन साल तक रोज़ तीन शब्द कोई कठिन दिन नहीं, बल्कि लगातार 1,095 दिन हैं जब आपको याद रहा कि यह करना है।

रोज़ के चंद शब्द
असल में कहाँ से आ सकते हैं

अड़चन कभी लक्ष्य नहीं होती, नियमितता होती है — और नियमितता इच्छाशक्ति से ख़रीदने के बजाय पहले से मौजूद आदत से ख़रीदना सस्ता पड़ता है। Reviews.org के 2026 सर्वेक्षण (अमेरिका के लगभग 1,000 वयस्क) में पाया गया कि लोग दिन में 186 बार फ़ोन देखते हैं। दोहराए जाने वाले क्षणों का यही सबसे बड़ा भंडार अधिकांश लोगों के पास है।

1

दोहराव को किसी आदत से जोड़ें

LearnScreen आपके चुने हुए ऐप — Instagram, TikTok, X, गेम — को ऐपल के Screen Time API से ब्लॉक करता है। ब्लॉक ऑपरेटिंग सिस्टम के स्तर पर चलता है, इसलिए VPN या DNS की कोई चाल उसे नहीं चकमा दे सकती।

2

हर बार खोलना याद करने की कोशिश बने

ऐप की जगह एक शब्द-कार्ड आता है। उत्तर देते ही ऐप एक तय अवधि के लिए खुल जाता है। यह सक्रिय स्मरण है — वह किस्म की मुलाक़ात जो अंतराल के बाद भी टिकती है — न कि सरसरी नज़र से देखी गई शब्द-सूची।

3

शब्द का चुनाव कार्यक्रम करे

लाइटनर शैली का अंतराल-दोहराव कार्यक्रम तय करता है कि आप क्या देखेंगे। ग़लत हुए शब्द जल्दी लौटते हैं, याद हो चुके दूर खिसकते जाते हैं। शोध जिस अंतराल की माँग करता है, वह आपके हिसाब रखे बिना पूरा होता है।

  • 18 विषयों में 1,080 से अधिक चुने हुए शब्द — बुनियादी बातें, रोज़मर्रा जीवन, यात्रा, भोजन, काम, अंक और अन्य: यानी लगभग वही आवृत्ति-पट्टी जो ऊपर की कवरेज तालिका में सबसे भारी काम करती है।
  • 11 सीखने योग्य भाषाएँ — अंग्रेज़ी, जर्मन, स्पेनिश, फ़्रेंच, इतालवी, जापानी, कोरियाई, पोलिश, ब्राज़ीली पुर्तगाली, रूसी और मैंडरिन चीनी।
  • आपके अपने शब्द भी — अनुवाद, उच्चारण और उदाहरण वाक्य के साथ कोई भी शब्द जोड़ें; वह उसी चक्र में शामिल हो जाता है।
  • ऑफ़लाइन, बिना खाते के। इंस्टॉल के बाद कार्ड और ब्लॉक बिना नेटवर्क चलते हैं। न पंजीकरण, न ईमेल, न पासवर्ड; iCloud बैकअप आपके अपने निजी डेटाबेस का उपयोग करता है।

एक बार में एक शब्द,
हर बार चंद सेकंड

तीन हज़ार शब्द एक बड़ा जोड़ है जो बेहद छोटी-छोटी घटनाओं से बनता है।

ब्लॉक किए गए ऐप की जगह आया शब्द-कार्ड जो अनुवाद पूछता है ब्लॉक करने के लिए ऐप और श्रेणियाँ चुनना ताकि हर बार खोलने पर दोहराव शुरू हो शब्दावली बनाने के लिए उपलब्ध ग्यारह भाषाएँ प्रगति स्क्रीन जिसमें पर्याप्त दोहराव जुटा चुके शब्द दिखते हैं

आगे पढ़ें

अक्सर पूछे जाने वाले प्रश्न

कोई भाषा बोलने के लिए कितने शब्द जानने चाहिए?
रोज़मर्रा की बातचीत के लिए लगभग 2,000–3,000 शब्द-परिवार। Adolphs और Schmitt (2003) ने पाया कि सबसे आम 2,000–3,000 परिवार रोज़मर्रा की बोली जाने वाली अंग्रेज़ी का करीब 95% बनाते हैं, और Nation (2006) केवल पहले 1,000 को ही बोलचाल का करीब 80% मानते हैं। बातचीत में शामिल होने के लिए यह काफ़ी है, सब कुछ समझने के लिए नहीं।
धाराप्रवाह होने के लिए कितने शब्द चाहिए?
यह इस पर निर्भर है कि "धाराप्रवाह" को क्या-क्या सँभालना है। Nation (2006) ने बोलचाल के 98% कवरेज के लिए 6,000–7,000 परिवार और उपन्यास व अख़बार जैसे लिखित पाठ के लिए 8,000–9,000 का अनुमान लगाया। शिक्षित मातृभाषी अंग्रेज़ी वक्ता करीब 17,000 मूल शब्द जानते हैं (Goulden, Nation & Read, 1990) — धाराप्रवाह ग़ैर-मातृभाषी की शब्दावली उसका एक अंश भर है।
शब्द-परिवार क्या है और शब्द क्यों न गिने जाएँ?
शब्द-परिवार मूल शब्द के साथ उसके रूपांतर और नियमित व्युत्पन्न होते हैं — help, helps, helper, helpful मिलकर एक परिवार बनाते हैं। शोध इसी तरह गिनता है क्योंकि एक सदस्य सीख लेने पर बाक़ी काफ़ी हद तक अनुमेय हो जाते हैं। इसलिए 3,000 परिवार 3,000 से कहीं अधिक अलग-अलग रूपों के बराबर होते हैं।
हर CEFR स्तर के लिए कितने शब्द ज़रूरी हैं?
Milton (2010) ने अंग्रेज़ी सीखने वालों को मापा और लगभग यह बताया: A1 1,500 परिवारों से कम, A2 1,500–2,500, B1 2,750–3,250, B2 3,250–3,750, C1 3,750–4,500, C2 4,500–5,000। ये बड़े व्यक्तिगत अंतर वाली प्रेक्षित ग्रहणशील शब्दावलियाँ हैं, और परीक्षण 5,000 की पट्टी पर रुक जाता है, इसलिए ऊपरी स्तर दबे हुए लगते हैं। CEFR स्वयं कोई आधिकारिक गिनती तय नहीं करता।
3,000 शब्द सीखने में कितना समय लगता है?
रोज़ एक नए शब्द से करीब आठ साल; रोज़ तीन से करीब दो साल नौ महीने; रोज़ पाँच से एक साल आठ महीने। अवधि गति तय करती है, और गति इस बात से सीमित होती है कि आप अंतराल पर याद करने की कितनी कोशिशें वाक़ई पूरी करते हैं — पढ़ते समय मिले हर शब्द के लिए करीब 8–12 मुलाक़ातें।
क्या पढ़ाई की बैठकों के बिना शब्दावली बनाई जा सकती है?
हाँ, बशर्ते दोहराव किसी ऐसी चीज़ से जुड़ जाए जिसे आप वैसे भी दोहराते हैं। Reviews.org के 2026 सर्वेक्षण (अमेरिका के लगभग 1,000 वयस्क) में दिन में 186 बार फ़ोन देखने की बात सामने आई। LearnScreen ऐपल के Screen Time API से चुने हुए ऐप ब्लॉक करता है और खोलने पर कार्ड दिखाता है, इसलिए याद करने की कोशिशें उसी फ़ोन-उपयोग के भीतर जमा होती हैं जो पहले से चल रहा था।

स्रोत

  1. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  2. Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438.
  3. Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
  4. Schmitt, N., Jiang, X., & Grabe, W. (2011). The percentage of words known in a text and reading comprehension. Modern Language Journal, 95(1), 26–43.
  5. Goulden, R., Nation, P., & Read, J. (1990). How large can a receptive vocabulary be? Applied Linguistics, 11(4), 341–363.
  6. Milton, J. (2010). The development of vocabulary breadth across the CEFR levels. EuroSLA Monographs 1, 211–232.
  7. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

अंतिम समीक्षा: 28 जुलाई 2026।

पहले दो हज़ार से
शुरुआत करें

कोई खाता नहीं। ऑफ़लाइन चलता है। अगली बार जब आप कोई ब्लॉक किया ऐप खोलेंगे, वह एक शब्द और नज़दीक होगा।

iOS के लिए डाउनलोड करें