가장 중요한 단어들 — 왜 빈도가 무엇을 먼저 배울지 정하는가
잘 고른 천 단어가 일상 대화의 대부분을 담습니다. 단어를 배우는 순서가 개수보다 중요합니다. 그 산수와 활용법입니다.
모든 언어에는 수십만 개의 단어가 있습니다. 원어민을 포함해 아무도 전부를 알지 못하고, 알 필요도 없습니다. 학습자에게 필요한 것은 올바른 몇천 개입니다 — 그리고 어떤 것이 올바른지는 취향의 문제가 아닙니다. 세어져 있습니다.
빈도의 산수
큰 텍스트 모음 — 신문, 대화, 자막 — 을 가져다 각 단어가 몇 번 나오는지 셉니다. 결과는 늘 같은 모양입니다. 끊임없이 쓰이는 한 줌의 단어, 그 뒤로 드문 단어들의 긴 꼬리.
영어에서 가장 빈번한 100단어는 쓰인 모든 것의 대략 절반입니다. 가장 빈번한 1000 단어족은 보통 텍스트의 약 80퍼센트를, 2000은 일상 대화의 85~90퍼센트를 덮습니다. 그 뒤로는 천 개를 더할 때마다 겨우 한두 포인트가 더해집니다.
같은 곡선이 독일어, 스페인어, 조지아어, 한국어에도 적용됩니다 — 숫자는 조금 움직이지만 모양은 그대로입니다. 지프의 법칙이고, 학습자에게 이것은 한 가지를 말합니다. 첫 이천 단어는 다음 이만 단어를 합친 것보다 가치가 있다.
"커버율"은 어떻게 느껴지는가
80퍼센트 커버율은 사람들이 말하는 것의 80퍼센트를 이해한다는 뜻이 아닙니다. 의미는 종종 더 드문 단어에 들어 있습니다. "___가 ___에게 ___당했다"의 모든 단어를 알면서도 여전히 길을 잃을 수 있습니다.
하지만 문장에 붙잡을 뼈대가 있다는 뜻입니다. 동사가 어디 있는지, 무엇이 무엇에 행해지는지, 대략 좋은 일인지 나쁜 일인지 압니다. 그 뼈대에서 빠진 단어를 추측하거나, 묻거나, 찾아볼 수 있습니다 — 그리고 나머지는 이해하는 문장 속 단어 하나를 찾아보는 것이 어휘가 저절로 자라는 방식입니다.
40퍼센트 커버율에서는 뼈대가 없습니다. 모든 문장이 잡음이고, 아무것도 붙지 않습니다.
잘못된 순서는 비쌉니다
대부분의 교재와 회화집은 주제로 시작합니다. "공항에서", "색깔", "가족". 그중 일부는 빈번합니다 — 어머니, 물, 좋은. 많은 것은 아닙니다. 수하물 컨베이어, 청록색, 조카는 1년에 몇 번 마주칠 엄연히 실재하는 단어이며, 각각 하루에 쉰 번 마주칠 왜냐하면만큼의 학습 시간을 잡아먹습니다.
주제별 학습은 정돈되어 보입니다. 빈도별 학습이야말로 대화를 따라갈 수 있게 되기까지의 시간을 실제로 줄입니다.
Mullawo는 덱을 어떻게 정렬하는가
Mullawo 사전의 모든 단어에는 빈도 순위가 있습니다. 대규모 일상 영어 말뭉치에서 가져와 30개 언어 전부의 번역어에 적용한 것입니다. 새 카드는 그 순서로 배분됩니다. 처음 보는 백 장은 실제 대화의 첫 백 분 안에 마주칠 단어들입니다.
순수 순위를 의도적으로 완화한 부분이 두 가지 있습니다.
- 무료 세트는 손으로 골랐습니다. 순위 상위 50이 아닙니다. 어떤 언어든 가장 빈번한 단어는 the, of, and — 실재하고 유용하지만 첫 플래시카드로는 가망이 없습니다. 시작 덱은 구체적이고 빈번한 쉰 단어입니다. 물, 집, 먹다, 좋은.
- 동음이의어는 나뉘어 있습니다. 명사 train과 동사 train은 두 순위를 가진 두 장의 카드입니다. 배우는 모든 언어에서 두 단어이기 때문입니다.
어떻게 할 것인가
- 순서를 믿으세요. 당신이 원하는 단어 — 일에서, 취미에서 쓰는 — 로 건너뛰고 싶은 충동은 강하고, 첫 달에는 대개 틀립니다. 원하면 사용자 단어로 추가하되, 빈도 덱은 계속 돌아가게 두세요.
- 지루한 단어를 건너뛰지 마세요. 또한, 아직, 이미, 여전히는 문장을 붙들어 주는 단어입니다. 카드로는 지루하고 말할 때는 값을 매길 수 없습니다.
- 카드가 아니라 커버율을 세세요. 빈번한 천 단어는 의미 있는 이정표입니다. 이제 대부분 문장의 뼈대를 따라갑니다. 무작위 천 단어는 그저 숫자입니다.