مواد پر جائیں
ذخیرۂ الفاظ پر تحقیق

کوئی زبان بولنے کے لیے
کتنے الفاظ چاہییں؟

تقریباً 2,000–3,000 لفظی خاندان روزمرہ گفتگو کا قریباً 95% احاطہ کر لیتے ہیں — یعنی گفتگو چلانے کے لیے اتنا کافی ہے۔ بغیر زور لگائے سمجھنا مہنگا پڑتا ہے: بولی جانے والی زبان کے لیے 6,000–7,000 اور ناولوں اور اخبارات کے لیے 8,000–9,000 خاندان (Nation, 2006)۔ مادری بولنے والے اس سے کئی گنا جانتے ہیں، اور اسی لیے کارآمد سوال یہ نہیں کہ الفاظ کتنے ہیں، بلکہ یہ کہ ابتدائی چند ہزار کون سے ہیں اور انہیں حقیقتاً کس رفتار سے بڑھایا جا سکتا ہے۔

مکمل حوالہ جات صفحے کے آخر میں

آئی فون پر لفظی کارڈ جو کسی لفظ کا مطلب یاد کرنے کو کہتا ہے

اہم چیز احاطہ ہے، ذخیرۂ الفاظ کا حجم نہیں

تحقیق یہ نہیں پوچھتی کہ آپ مجرد طور پر کتنے الفاظ جانتے ہیں، بلکہ یہ کہ کسی مخصوص متن یا گفتگو کے الفاظ میں سے کتنے فیصد آپ پہلے سے جانتے ہیں — یعنی لغوی احاطہ۔ یہی زاویہ اعداد کو قابلِ استعمال بناتا ہے، کیونکہ الفاظ کی تعدد شدید غیر متوازن ہے: بہت عام الفاظ کا ایک چھوٹا سا مرکزی گروہ تقریباً سارا کام کر دیتا ہے۔

Nation (2006) کے مطابق سب سے زیادہ استعمال ہونے والے 1,000 لفظی خاندان بولی جانے والی زبان کا تقریباً 80% بنتے ہیں۔ اس کے بعد ہر اگلا ہزار کم فائدہ دیتا ہے۔ یہ بیک وقت اچھی اور بری خبر ہے: ابتدائی 2,000 خاندان وہ سب سے منافع بخش چیز ہیں جو آپ کبھی سیکھیں گے، جبکہ 95% سے 98% احاطے تک پہنچنے پر مزید کئی ہزار خرچ ہوتے ہیں۔

لفظی خاندانوں میں ذخیرۂ الفاظ، متعلقہ لغوی احاطہ اور عملی طور پر اس کا مطلب
معلوم خانداناحاطہ (تقریباً)عملی تجربہ
1,000گفتگو کا ~80%سادہ گفتگو کا مجموعی مفہوم؛ ہر پانچ میں سے ایک لفظ اجنبی
2,000–3,000گفتگو کا ~95%گفتگو چلا لیتے ہیں؛ خلا سیاق سے سمجھ آ جاتا ہے
6,000–7,000گفتگو کا ~98%فلمیں، پوڈکاسٹ اور تیز گفتگو مسلسل محنت کے بغیر
8,000–9,000تحریر کا ~98%بغیر لغت ناول اور اخبار
~17,000 بنیادی الفاظمادری حدودتعلیم یافتہ بالغ (Goulden, Nation & Read, 1990)

احاطے کے اعداد Nation (2006) اور Adolphs & Schmitt (2003) سے؛ مادری بولنے والوں کا تخمینہ Goulden, Nation & Read (1990) سے۔ پیمائش انگریزی پر ہوئی: منحنی کی شکل دوسری زبانوں میں بھی دہرائی جاتی ہے، درست اعداد نہیں۔

"ایک لفظ" کیا شمار ہوتا ہے؟

اوپر کے تمام اعداد لفظی خاندانوں میں ہیں، لفظی صورتوں میں نہیں۔ ایک خاندان بنیادی لفظ کے ساتھ اس کی گردانیں اور باقاعدہ مشتقات ہوتے ہیں: انگریزی میں help, helps, helped, helping, helper, helpful, unhelpful ایک خاندان ہے، سات نہیں۔ اس طرح گنتی اس لیے ہوتی ہے کہ جڑ اور لاحقہ معلوم ہو جائے تو باقی زیادہ تر قابلِ پیش گوئی ہو جاتا ہے۔

  • 3,000 خاندان 3,000 الفاظ سے کہیں زیادہ ہیں۔ زبان کے مطابق دو سے چار گنا زیادہ الگ صورتیں۔ اشتہارات کا "5,000 الفاظ سیکھیں" اور تحقیق کی گنتی شاذ ہی ایک ہی اکائی ہوتے ہیں۔
  • زیادہ گردان والی زبانیں خام عدد کو بڑھا دیتی ہیں۔ اردو، روسی، فینش اور کوریائی ایک خاندان کو بہت سی صورتوں میں پھیلا دیتی ہیں؛ کسی مقررہ احاطے کے لیے درکار خاندانوں کی تعداد قابلِ موازنہ رہتی ہے، مگر آپ کو ملنے والی صورتیں نہیں۔
  • قبولی اور پیداواری ذخیرۂ الفاظ الگ چیزیں ہیں۔ CEFR اور احاطے کے اعداد وہ ناپتے ہیں جو آپ پہچانتے ہیں۔ بولتے وقت آپ جو خود بناتے ہیں، وہ ہمیشہ کم ہوتا ہے۔

متعلقہ: ایک خاندان بڑھانے کی قیمت — کوئی لفظ یاد رکھنے کے لیے کتنی بار دیکھنا پڑتا ہے (انگریزی میں)۔

ہر CEFR سطح پر کتنے الفاظ؟

CEFR یہ بیان کرتا ہے کہ آپ کیا کر سکتے ہیں، یہ نہیں کہ کتنے الفاظ جانتے ہیں: سطح کے حساب سے کوئی سرکاری گنتی موجود نہیں۔ البتہ پیمائشیں موجود ہیں۔ Milton (2010) نے ہر سطح پر انگریزی سیکھنے والوں کو جانچا اور ان کے ساتھ آنے والے ذخیرۂ الفاظ کے حجم شائع کیے۔ یہ بڑے بکھراؤ والے مشاہداتی اوسط ہیں، داخلے کی شرائط نہیں۔

CEFR سطح کے مطابق ناپا گیا قبولی ذخیرۂ الفاظ (لفظی خاندان)
CEFR سطحخاندان (ناپے گئے)عموماً کس کے لیے کافی
A1~1,500 سے کمبندھے ٹکے جملے، تعارف، فوری ضروریات
A2~1,500–2,500روزمرہ: دکانیں، راستہ پوچھنا، مختصر بات چیت
B1~2,750–3,250مانوس موضوعات پر گفتگو؛ بغیر مدد سفر
B2~3,250–3,750بحث اور دلیل؛ زیادہ تر میڈیا محنت سے
C1~3,750–4,500تعلیمی و پیشہ ورانہ استعمال؛ ضمنی مفہوم
C2~4,500–5,000+تقریباً مکمل فہم؛ باریکی اور اسلوب

Milton (2010)، انگریزی بطور غیر ملکی زبان سیکھنے والوں کا قبولی ذخیرۂ الفاظ۔ آلۂ پیمائش 5,000 الفاظ کے درجے تک جاتا ہے، اس لیے C1 اور C2 دب جاتے ہیں: C2 بولنے والے کا حقیقی ذخیرہ جدول کی دکھائی گئی حد سے زیادہ ہے۔

"سمجھنے" کا معیار 95% نہیں، 98% کیوں ہے

95% تقریباً مکمل لگتا ہے، مگر ہے نہیں: اس کا مطلب ہے ہر بیس میں سے ایک لفظ اجنبی، یعنی ناول کی ہر سطر میں تقریباً ایک۔ Hu اور Nation (2000) نے ادبی متن میں اجنبی الفاظ کی کثافت بدل کر اسے براہِ راست جانچا۔ 80% احاطے پر عملاً کوئی بھی بغیر مدد کافی فہم تک نہ پہنچا؛ 95% پر صرف اقلیت؛ اور 98% وہ نقطہ تھا جہاں اکثریت خود سے کامیاب ہوئی۔

اس کے بعد Schmitt، Jiang اور Grabe (2011) نے 661 سیکھنے والوں کو تعلیمی متون پر جانچا اور پایا کہ احاطے اور فہم کا تعلق بنیادی طور پر خطی ہے — نہ کوئی کھائی، نہ کوئی جادوئی حد۔ احاطے کا ہر فیصد اسی تناسب سے فہم خریدتا ہے۔ 98% منصوبہ بندی کا ایک عملی عدد ہے، کوئی سوئچ نہیں۔

عملی مطلب: 2,000–3,000 خاندانوں کے ساتھ آپ گفتگو کر لیتے ہیں، اور اس کے بعد ہر ہزار زبان کو مزید خاموش کر دیتا ہے — کم خلا، کم اندازے، کم تھکن۔

3,000 الفاظ میں کتنا وقت لگے گا؟

ہدف طے ہو جائے تو مدت ایک تقسیم کا سوال بن جاتی ہے — اور فیصلہ رفتار کرتی ہے، یعنی بالکل وہی مقدار جس کا اندازہ زیادہ تر منصوبے غلط لگاتے ہیں۔ پڑھتے ہوئے ملنے والے لفظ کو جمنے کے لیے تقریباً 8–12 ملاقاتیں درکار ہوتی ہیں، اور ان ملاقاتوں کا مختلف دنوں پر پھیلا ہونا ضروری ہے ورنہ وہ باقی نہیں رہتیں۔

یعنی "روزانہ کتنے الفاظ" کا مطلب یہ نہیں کہ آپ کتنے دیکھتے ہیں، بلکہ یہ کہ کتنے اپنی دہرائی کا دور مکمل کرتے ہیں۔ چار ایماندار رفتاروں کے ساتھ حساب:

روزانہ سیکھے گئے الفاظ کی چار رفتاروں پر مختلف اہداف تک پہنچنے کا وقت
روزانہ نئے الفاظسالانہ+1,250 تک (A2→B1)صفر سے 3,000 تک
1365تقریباً 3 سال 5 ماہتقریباً 8 سال 3 ماہ
2730تقریباً 1 سال 8 ماہتقریباً 4 سال 1 ماہ
31,095تقریباً 1 سال 2 ماہتقریباً 2 سال 9 ماہ
51,825تقریباً 8 ماہتقریباً 1 سال 8 ماہ

یہ سادہ تقسیم ہے، اس مفروضے پر کہ کوئی چھٹی نہیں اور کوئی پیچھے ہٹنا نہیں — اور ٹوٹتا بھی یہی مفروضہ ہے۔ تین سال تک روزانہ تین الفاظ کوئی مشکل دن نہیں، بلکہ مسلسل 1,095 دن ہیں جن میں آپ کو یاد رہے کہ یہ کرنا ہے۔

روزانہ چند الفاظ
حقیقت میں کہاں سے آ سکتے ہیں

رکاوٹ کبھی ہدف نہیں ہوتی، تسلسل ہوتی ہے — اور تسلسل قوتِ ارادی سے خریدنے کی بجائے پہلے سے موجود عادت سے خریدنا سستا پڑتا ہے۔ Reviews.org کے 2026 کے سروے (تقریباً 1,000 امریکی بالغ) کے مطابق لوگ دن میں 186 بار فون دیکھتے ہیں۔ زیادہ تر لوگوں کے پاس دہرائے جانے والے لمحوں کا یہی سب سے بڑا ذخیرہ ہے۔

1

دہرائی کو کسی عادت سے جوڑیں

LearnScreen آپ کی منتخب کردہ ایپس — Instagram، TikTok، X، گیمز — کو ایپل کے Screen Time API کے ذریعے بلاک کرتا ہے۔ بلاک آپریٹنگ سسٹم کی سطح پر چلتا ہے، اس لیے کوئی VPN یا DNS چال اسے نہیں چکما دے سکتی۔

2

ہر بار کھولنا ایک یاد دہانی کی کوشش بنے

ایپ کی جگہ ایک لفظی کارڈ آتا ہے۔ جواب دیں تو ایپ ایک مقررہ وقت کے لیے کھل جاتی ہے۔ یہ فعال بازیافت ہے — وہ قسم کی ملاقات جو وقفے کے بعد بھی قائم رہتی ہے — نہ کہ سرسری دیکھی گئی فہرست۔

3

لفظ کا انتخاب شیڈول کرے

لائٹنر طرز کا وقفہ دار دہرائی کا شیڈول طے کرتا ہے کہ آپ کیا دیکھیں گے۔ جن الفاظ میں غلطی ہوئی وہ جلد لوٹتے ہیں، جو یاد ہیں وہ دور ہٹتے جاتے ہیں۔ تحقیق جس وقفے کا تقاضا کرتی ہے، وہ آپ کے حساب رکھے بغیر ہو جاتا ہے۔

  • 18 موضوعات میں 1,080 سے زائد منتخب الفاظ — بنیادی باتیں، روزمرہ زندگی، سفر، کھانا، کام، اعداد وغیرہ: یعنی تقریباً وہی تعدد کی پٹی جو احاطے کے جدول میں سب سے بھاری کام کرتی ہے۔
  • 11 سیکھنے والی زبانیں — انگریزی، جرمن، ہسپانوی، فرانسیسی، اطالوی، جاپانی، کوریائی، پولش، برازیلی پرتگالی، روسی اور مینڈارن چینی۔
  • آپ کے اپنے الفاظ بھی — کوئی بھی لفظ ترجمے، تلفظ اور مثال کے جملے کے ساتھ شامل کریں؛ وہ اسی چکر میں آ جاتا ہے۔
  • آف لائن، بغیر اکاؤنٹ۔ انسٹال کے بعد کارڈ اور بلاک بغیر نیٹ ورک کے کام کرتے ہیں۔ نہ رجسٹریشن، نہ ای میل، نہ پاس ورڈ؛ iCloud بیک اپ آپ کے اپنے نجی ڈیٹابیس میں ہوتا ہے۔

ایک وقت میں ایک لفظ،
ہر ایک چند سیکنڈ

تین ہزار الفاظ ایک بڑا مجموعہ ہے جو نہایت مختصر لمحوں سے بنتا ہے۔

بلاک شدہ ایپ کی جگہ آنے والا لفظی کارڈ جو ترجمہ پوچھتا ہے بلاک کرنے کے لیے ایپس اور زمرے چننا تاکہ ہر بار کھولنے پر دہرائی شروع ہو ذخیرۂ الفاظ بنانے کے لیے دستیاب گیارہ زبانیں پیش رفت کی اسکرین جس میں وہ الفاظ ہیں جنہوں نے کافی دہرائیاں جمع کر لیں

مزید پڑھیں

اکثر پوچھے گئے سوالات

کوئی زبان بولنے کے لیے کتنے الفاظ جاننا ضروری ہے؟
روزمرہ گفتگو کے لیے تقریباً 2,000–3,000 لفظی خاندان۔ Adolphs اور Schmitt (2003) نے پایا کہ سب سے عام 2,000–3,000 خاندان روزمرہ بولی جانے والی انگریزی کا تقریباً 95% بنتے ہیں، اور Nation (2006) صرف پہلے 1,000 کو بولی جانے والی زبان کا تقریباً 80% قرار دیتے ہیں۔ گفتگو میں شریک ہونے کے لیے کافی ہے، سب کچھ سمجھنے کے لیے نہیں۔
روانی کے لیے کتنے الفاظ چاہییں؟
یہ اس پر منحصر ہے کہ روانی کو کیا کچھ سنبھالنا ہے۔ Nation (2006) نے بولی جانے والی زبان کے 98% احاطے کے لیے 6,000–7,000 خاندان اور ناول و اخبار جیسی تحریر کے لیے 8,000–9,000 کا تخمینہ لگایا۔ تعلیم یافتہ مادری انگریزی بولنے والے تقریباً 17,000 بنیادی الفاظ جانتے ہیں (Goulden, Nation & Read, 1990) — روانی رکھنے والے غیر مادری بولنے والے کا ذخیرہ اس کا ایک حصہ ہی ہوتا ہے۔
لفظی خاندان کیا ہے اور الفاظ کیوں نہ گنے جائیں؟
لفظی خاندان بنیادی لفظ کے ساتھ اس کی گردانیں اور باقاعدہ مشتقات ہوتے ہیں — help, helps, helper, helpful ایک ہی خاندان بناتے ہیں۔ تحقیق اس طرح گنتی ہے کیونکہ ایک رکن سیکھ لینے سے باقی بڑی حد تک قابلِ پیش گوئی ہو جاتے ہیں۔ اسی لیے 3,000 خاندان 3,000 سے کہیں زیادہ الگ صورتوں کے برابر ہوتے ہیں۔
ہر CEFR سطح کے لیے کتنے الفاظ درکار ہیں؟
Milton (2010) نے انگریزی سیکھنے والوں کو ناپا اور تقریباً یہ بتایا: A1 1,500 خاندان سے کم، A2 1,500–2,500، B1 2,750–3,250، B2 3,250–3,750، C1 3,750–4,500، C2 4,500–5,000۔ یہ بڑے انفرادی فرق والے مشاہداتی قبولی ذخیرے ہیں، اور امتحان 5,000 کے درجے پر رک جاتا ہے، اس لیے بلند سطحیں دبی ہوئی لگتی ہیں۔ CEFR خود کوئی سرکاری گنتی مقرر نہیں کرتا۔
3,000 الفاظ سیکھنے میں کتنا وقت لگتا ہے؟
روزانہ ایک نئے لفظ سے تقریباً آٹھ سال؛ روزانہ تین سے تقریباً دو سال نو ماہ؛ روزانہ پانچ سے ایک سال آٹھ ماہ۔ مدت رفتار طے کرتی ہے، اور رفتار کو یہ محدود کرتا ہے کہ آپ وقفے کے ساتھ یاد کرنے کی کتنی کوششیں واقعی مکمل کرتے ہیں — پڑھتے ہوئے ملنے والے ہر لفظ کے لیے تقریباً 8–12 ملاقاتیں۔
کیا پڑھائی کی نشستوں کے بغیر ذخیرۂ الفاظ بنایا جا سکتا ہے؟
ہاں، اگر دہرائیاں کسی ایسی چیز سے جڑ جائیں جو آپ ویسے بھی دہراتے ہیں۔ Reviews.org کے 2026 کے سروے (تقریباً 1,000 امریکی بالغ) کے مطابق دن میں 186 بار فون دیکھا جاتا ہے۔ LearnScreen ایپل کے Screen Time API سے منتخب ایپس بلاک کرتا ہے اور کھولنے پر کارڈ دکھاتا ہے، چنانچہ یاد کرنے کی کوششیں اسی فون کے استعمال کے اندر جمع ہوتی ہیں جو آپ پہلے ہی کر رہے تھے۔

حوالہ جات

  1. Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  2. Adolphs, S., & Schmitt, N. (2003). Lexical coverage of spoken discourse. Applied Linguistics, 24(4), 425–438.
  3. Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
  4. Schmitt, N., Jiang, X., & Grabe, W. (2011). The percentage of words known in a text and reading comprehension. Modern Language Journal, 95(1), 26–43.
  5. Goulden, R., Nation, P., & Read, J. (1990). How large can a receptive vocabulary be? Applied Linguistics, 11(4), 341–363.
  6. Milton, J. (2010). The development of vocabulary breadth across the CEFR levels. EuroSLA Monographs 1, 211–232.
  7. Reviews.org (2026). Cell Phone Usage Stats. Survey of ~1,000 US adults, fielded Q4 2025. Report

آخری نظرثانی: 28 جولائی 2026۔

پہلے دو ہزار سے
آغاز کریں

کوئی اکاؤنٹ نہیں۔ آف لائن کام کرتا ہے۔ اگلی بار جب آپ بلاک شدہ ایپ کھولیں گے، ایک لفظ قریب ہوں گے۔

iOS کے لیے ڈاؤن لوڈ کریں