Слова, которые важнее всего — почему частотность решает, что учить первым
Тысяча правильно выбранных слов несёт большую часть повседневной речи. Порядок, в котором вы учите слова, важнее их количества. Вот арифметика и как ею пользоваться.
В каждом языке сотни тысяч слов. Никто не знает их все, включая носителей, и никому это не нужно. Ученику нужны правильные несколько тысяч — и какие именно, не вопрос вкуса. Это посчитано.
Арифметика частотности
Возьмите любой большой массив текстов — газеты, разговоры, субтитры — и посчитайте, как часто встречается каждое слово. Результат всегда одной формы: горстка слов, употребляемых постоянно, и длинный хвост редких.
В английском 100 самых частых слов составляют примерно половину всего написанного. Самая частая 1 000 семейств слов покрывает около 80 процентов обычного текста; 2 000 — примерно 85–90 процентов повседневной речи. Дальше каждая следующая тысяча добавляет лишь процент-два.
Та же кривая держится для немецкого, испанского, грузинского, корейского — числа немного сдвигаются, форма нет. Это закон Ципфа, и для ученика он означает одно: первые две тысячи слов стоят больше, чем следующие двадцать тысяч вместе взятые.
Как ощущается «покрытие»
Восемьдесят процентов покрытия не значит, что вы понимаете 80 процентов сказанного. Смысл часто сидит в более редких словах: можно знать каждое слово в «___ был ___ из-за ___» и всё равно ничего не понять.
Но это значит, что у предложения есть каркас, за который можно держаться. Вы знаете, где глагол, что с чем делается, примерно хорошо это или плохо. Из этого каркаса можно угадать пропущенное слово, спросить о нём или посмотреть — а посмотреть одно слово в предложении, которое вы в целом понимаете, и есть способ, которым словарный запас растёт сам.
При 40 процентах покрытия каркаса нет. Каждое предложение — шум, и ничего не держится.
Неправильный порядок дорого обходится
Большинство учебников и разговорников начинают с тем: «В аэропорту», «Цвета», «Семья». Кое-что из этого частотно — мать, вода, хороший. Многое — нет. Лента выдачи багажа, бирюзовый и племянник — вполне реальные слова, которые вы встретите несколько раз в год, и каждое из них учится так же долго, как потому что, которое вы встретите пятьдесят раз в день.
Учить по темам кажется упорядоченным. Учить по частотности — то, что действительно сокращает время до момента, когда вы сможете следить за разговором.
Как Mullawo упорядочивает колоду
Каждое слово в словаре Mullawo имеет частотный ранг, взятый из больших корпусов повседневного английского и применённый к его переводам на все 30 языков. Новые карточки раздаются в этом порядке: первая сотня, которую вы увидите, — это слова, которые вы встретите за первую сотню минут живой речи.
Две вещи намеренно смягчают чистое ранжирование:
- Бесплатный набор отобран вручную, а не топ-50 по рангу. Самые частые слова любого языка — the, of, and — настоящие, полезные и безнадёжные как первые карточки. Стартовая колода — пятьдесят конкретных частых слов: вода, дом, есть, хороший.
- Омонимы разделены. Train существительное и train глагол — две карточки с двумя рангами, потому что это два слова в каждом языке, который вы учите.
Что с этим делать
- Доверяйте порядку. Желание перескочить к словам, которые нужны вам — с работы, из хобби, — сильное и в первый месяц по большей части ошибочное. Добавьте их как свои слова, если хотите, но дайте частотной колоде идти.
- Не пропускайте скучные. Также, ещё, уже, пока — слова, которые держат предложения вместе; они скучны как карточки и бесценны в речи.
- Считайте покрытие, а не карточки. Тысяча частых слов — рубеж со смыслом: теперь вы следите за каркасом большинства предложений. Тысяча случайных слов — просто число.