Слова, які важать найбільше — чому частотність вирішує, що вчити першим
Тисяча правильно обраних слів несе більшість повсякденної мови. Порядок, у якому ви вчите слова, важить більше за їхню кількість. Ось арифметика і як нею користуватись.
У кожній мові сотні тисяч слів. Ніхто не знає їх усіх, включно з носіями, і нікому це не потрібно. Учневі потрібні правильні кілька тисяч — і які саме, не питання смаку. Це пораховано.
Арифметика частотності
Візьміть будь-який великий масив текстів — газети, розмови, субтитри — і порахуйте, як часто трапляється кожне слово. Результат завжди однієї форми: жменька слів, що вживаються постійно, і довгий хвіст рідкісних.
В англійській 100 найчастіших слів складають приблизно половину всього написаного. Найчастіша 1 000 родин слів покриває близько 80 відсотків звичайного тексту; 2 000 — десь 85–90 відсотків повсякденної розмови. Далі кожна наступна тисяча додає лише відсоток-два.
Та сама крива тримається для німецької, іспанської, грузинської, корейської — числа трохи зсуваються, форма ні. Це закон Ципфа, і для учня він означає одне: перші дві тисячі слів варті більше, ніж наступні двадцять тисяч разом.
Як відчувається «покриття»
Вісімдесят відсотків покриття не означає, що ви розумієте 80 відсотків сказаного. Сенс часто сидить у рідших словах: можна знати кожне слово в «___ був ___ через ___» і все одно нічого не зрозуміти.
Але це означає, що в речення є каркас, за який можна триматись. Ви знаєте, де дієслово, що з чим робиться, приблизно добре це чи погано. З цього каркаса можна вгадати пропущене слово, спитати про нього або подивитись — а подивитись одне слово в реченні, яке ви загалом розумієте, це і є спосіб, яким словниковий запас росте сам.
При 40 відсотках покриття каркаса немає. Кожне речення — шум, і нічого не тримається.
Неправильний порядок дорого коштує
Більшість підручників і розмовників починають з тем: «В аеропорту», «Кольори», «Родина». Дещо з цього частотне — мати, вода, добрий. Багато що — ні. Стрічка видачі багажу, бірюзовий і небіж — цілком реальні слова, які ви зустрінете кілька разів на рік, і кожне з них учиться так само довго, як тому що, яке ви зустрінете п’ятдесят разів на день.
Вчити за темами здається впорядкованим. Вчити за частотністю — те, що справді скорочує час до моменту, коли ви зможете стежити за розмовою.
Як Mullawo впорядковує колоду
Кожне слово у словнику Mullawo має частотний ранг, узятий з великих корпусів повсякденної англійської і застосований до його перекладів усіма 30 мовами. Нові картки роздаються в цьому порядку: перша сотня, яку ви побачите, — це слова, які ви зустрінете за першу сотню хвилин живої мови.
Дві речі навмисно пом’якшують чисте ранжування:
- Безкоштовний набір відібраний вручну, а не топ-50 за рангом. Найчастіші слова будь-якої мови — the, of, and — справжні, корисні й безнадійні як перші картки. Стартова колода — п’ятдесят конкретних частих слів: вода, дім, їсти, добрий.
- Омоніми розділені. Train іменник і train дієслово — дві картки з двома рангами, бо це два слова в кожній мові, яку ви вчите.
Що з цим робити
- Довіряйте порядку. Бажання перескочити до слів, які потрібні вам — з роботи, з хобі, — сильне і в перший місяць здебільшого хибне. Додайте їх як власні слова, якщо хочете, але дайте частотній колоді йти.
- Не пропускайте нудні. Також, ще, вже, поки — слова, які тримають речення вкупі; вони нудні як картки і безцінні в мові.
- Рахуйте покриття, а не картки. Тисяча частих слів — рубіж зі змістом: тепер ви стежите за каркасом більшості речень. Тисяча випадкових слів — просто число.