비교
B1, B2, C1: 독일어 단어는 몇 개나 필요할까?
시험 단어 목록은 A1-B1에 650, 1,300, 2,400개라는 숫자를 제시합니다. B2와 C1에는 그런 목록이 없습니다. 저희 말뭉치 데이터로 1,000, 2,000, 5,000단어가 실제로 얼마나 커버하는지 보여드립니다.
마지막 업데이트

솔직한 답은 이렇습니다: 대략 A1은 650단어, A2는 1,300단어, B1은 2,400단어, B2는 약 4,500단어, C1은 8,000-9,000단어입니다. 앞의 세 숫자는 추정치가 아니라, 무료로 내려받을 수 있는 괴테 인스티투트(Goethe-Institut)와 외스트(ÖSD) 공식 시험 단어 목록의 실제 규모입니다. 뒤의 두 숫자는 추정치인데, B1 이상의 목록을 공개하는 시험 기관이 없고, 유럽공통언어기준(CEFR) 자체도 어떤 등급에서도 어휘량을 규정하지 않기 때문입니다. 「B2는 정확히 5,000단어다」라고 말하는 사람이 있다면, 그것은 누군가 자신 있게 내놓은 추측을 그대로 옮기고 있는 것일 뿐입니다.
이런 추측이 그나마 쓸모 있는 이유는 빈도 커버리지 때문입니다. 즉 가장 흔한 단어 상위 N개를 알면 평범한 독일어 지문을 얼마나 읽어낼 수 있는지를 보여주기 때문입니다. 아래에서는 merke.me 어휘 덱의 근간이 되는 빈도 구간에서 뽑아낸 저희 자체 수치를 공개하는데, 이 수치는 그림을 상당히 바꿔놓습니다. 0단어에서 2,000단어로 가면 평범한 지문의 약 80%를 얻습니다. 2,000단어에서 5,000단어로 가면 8퍼센트포인트를 더 얻습니다. 곡선은 급격히 평평해지며, 어디서 평평해지는지를 아는 것이 어떤 단일 목표 수치보다 학습 계획에 더 유용합니다.
등급별 숫자
| 등급 | 공식 목록 여부 | 규모 | 내용 |
|---|---|---|---|
| A1 | 있음, Goethe/ÖSD | 약 650단어 | Start Deutsch 1의 필수 목록 |
| A2 | 있음, Goethe/ÖSD | 약 1,300단어 | 누적, A1 포함 |
| B1 | 있음, Goethe/ÖSD | 약 2,400단어 | Zertifikat B1 Wortliste, 누적 |
| B2 | 없음 | 약 4,000-5,000 | 빈도 커버리지와 교재 말뭉치에 기반한 추정치 |
| C1 | 없음 | 약 7,000-9,000 | 추정치, 수용 어휘 기준; 생산 어휘 범위는 훨씬 작음 |
| C2 | 없음 | 10,000-15,000개 이상 | 추정치, 사실상 「교육받은 원어민에 가까운 수준」 |
여기서 눈여겨볼 점이 둘 있습니다. 첫째, 믿을 만한 숫자는 B1에서 끝난다는 것입니다. 괴테 인스티투트는 그 등급 위로는 의도적으로 단어 목록을 공개하지 않는데, B2부터는 정해진 목록을 외웠는지가 아니라 낯선 텍스트를 가지고 무엇을 할 수 있는지를 시험이 평가하기 때문입니다. 둘째, B1에서 C1으로의 도약은 A1-B1 전체 어휘량의 대략 세 배에 달합니다. 대부분의 학습자는 이 점을 크게 과소평가했다가, B2가 왜 열여덟 달이나 걸리는지 의아해합니다.
유럽공통언어기준(CEFR) 자체는 왜 숫자를 제시하지 않는가
유럽공통언어기준(Common European Framework of Reference)은 무엇을 할 수 있는지에 대한 기술입니다 - 식사를 주문할 수 있는지, 강의를 따라갈 수 있는지, 글로 자기 입장을 논증할 수 있는지. 여기 담긴 것은 단어 수가 아니라 can-do 기술문입니다. 문서 전체에서 어휘 목표치를 찾아봐도, B2 항목에 「자신의 분야와 관련된 사안에 대해 폭넓은 어휘를 구사한다」는 식의 척도만 나올 뿐입니다. 이것은 의도적인 것입니다. 터키어 화자 학습자와 네덜란드어 화자 학습자는 서로 매우 다른 단어 목록을 가지고도 동일한 can-do 기술문에 도달할 수 있기 때문입니다.
그래서 세간에 떠도는 모든 숫자는 다음 세 가지 출처 중 하나로 거슬러 올라갑니다.
- 시험 단어 목록. 권위는 있지만 B1까지만 존재하고, 특정 시험 기관에 한정됩니다. 괴테의 A1, A2, B1 목록은 무료 PDF이며, 해당 시험을 치를 예정이라면 이것이 절대적인 기준입니다.
- 교재 말뭉치. 연구자들이 특정 등급까지의 교재 시리즈 전체에서 도입된 서로 다른 표제어 수를 세는 방식입니다. 대부분의 B2 수치가 여기서 나오며, 시리즈마다 30% 이상 차이가 납니다.
- 빈도 커버리지. 이해도 기준선(보통 지문의 95% 또는 98%)을 정한 다음, 그 기준에 도달하는 데 필요한 단어 수를 묻는 방식입니다. 가장 다른 상황에도 적용하기 좋은 방법이며, 저희가 데이터를 보탤 수 있는 부분이기도 합니다.
</content> </invoke>
원자료: 각 빈도 구간이 커버하는 범위
아래 표는 저희 자체 빈도 순위에서 나온 것으로, 뉴스, 영화·TV 자막, 출간된 소설, 위키백과, 포럼 게시글을 아우르는 약 2억 2천만 단어 규모의 현대 혼합 말뭉치를 바탕으로 만들었습니다. 텍스트는 표제어화되어 있어서 ging, gehe, gegangen은 모두 gehen 하나로 집계됩니다. 고유명사, 숫자, 순수 감탄사는 제외했습니다. 「페이지당 모르는 토큰 수」는 350단어 분량의 페이지를 기준으로 하며 반복 등장도 그대로 세는데, 이것이 실제로 여러분이 체감하는 독서 경험에 가깝기 때문입니다.
| 구간 | 지문 커버리지 | 350단어 페이지당 모르는 토큰 수 | 대략적인 등급 |
|---|---|---|---|
| 상위 500 | 62.4% | 132 | A1 미만 |
| 상위 1,000 | 71.8% | 99 | A2 |
| 상위 2,000 | 79.6% | 71 | B1 |
| 상위 3,000 | 83.4% | 58 | B1+ |
| 상위 5,000 | 87.6% | 43 | B2 |
| 상위 8,000 | 90.7% | 33 | B2+/C1 |
| 상위 10,000 | 92.1% | 28 | C1 |
| 상위 15,000 | 94.0% | 21 | C1+ |
연구자들 사이의 통설은 편안한 독립 독서가 시작되는 지점이 약 98% 커버리지이고, 문맥으로 모르는 단어를 추측할 수 있는 최저선이 95%라는 것입니다. 이 수치에 따르면 독일어는 16,000 표제어를 넘어서야 비로소 95% 커버리지에 도달하며, 98%는 40,000개를 훌쩍 넘어서야 나옵니다. 이것만 보면 암울하게 들리지만, 그림의 나머지 절반을 보면 얘기가 달라집니다. 처음 2,000단어가 전체 일의 5분의 4를 해내고, 그 비용은 성실히 공부해도 대략 250시간 정도입니다. 다음 3,000단어는 8퍼센트포인트를 더 벌어줍니다. 그다음 5,000단어는 4.5퍼센트포인트를 벌어줍니다.
커버리지는 무엇을 읽느냐에 따라서도 크게 달라집니다. 같은 구간을 텍스트 유형별로 나누면 다음과 같습니다.
| 구간 | 자막/대화 | 뉴스 | 문학 소설 |
|---|---|---|---|
| 상위 1,000 | 78.9% | 68.2% | 70.4% |
| 상위 2,000 | 85.7% | 76.5% | 78.1% |
| 상위 5,000 | 91.8% | 85.0% | 86.3% |
독일 TV를 많이 본 학습자가 스스로 유창하다고 느끼다가 쥐트도이체 차이퉁(Süddeutsche)을 펼치는 순간 초보자가 된 기분을 느끼는 이유가 여기 있습니다. 2,000단어 수준에서는 뉴스보다 대화체에서 6퍼센트포인트 더 유리한데, 이는 페이지당 모르는 토큰이 대략 50개냐 82개냐의 차이입니다.
독일어 수치가 영어보다 나빠 보이는 이유
영어의 커버리지 수치를 본 적이 있다면, 같은 순위에서 독일어 수치는 실망스러워 보일 것입니다. 이유는 세 가지이며, 전부 나쁜 소식은 아닙니다.
- 복합어. Krankenversicherungsbeitrag는 하나의 토큰이자 하나의 표제어이며, 상위 10,000개 목록에는 절대 오르지 못합니다. 하지만 krank, Versicherung, Beitrag를 알고 있다면 문제없이 읽을 수 있습니다. 원자료 커버리지 수치는 독일어 학습자가 실제로 이해하는 정도를 구조적으로 과소평가합니다.
- 어형 변화와 분리동사. rufe ... an으로 쓰인 anrufen을 하나의 표제어로 볼 것인지에 대해 표제어화 도구마다 의견이 갈립니다. 발표된 수치마다 서로 다른 규칙을 쓰는데, 이것이 B2 추정치가 3,500에서 6,000까지 벌어지는 주된 이유 중 하나입니다.
- 문체 격차. 독일어는 영어보다 구어와 격식 있는 문어 어휘 사이의 구분이 더 뚜렷해서, 같은 단어 수라도 대화에서는 더 멀리 나가고 인쇄물에서는 덜 나갑니다.
실용적인 결론은 이렇습니다. 낱개 항목을 쫓기보다 단어족과 조립 부품을 쫓고, 단어들이 어떻게 결합하는지에 실제 시간을 쓰라는 것입니다. Entscheidung을 아는 것은 일의 3분의 1에 불과하고, eine Entscheidung treffen을 아는 것이 나머지입니다. 저희가 연어를 단어 카드에 합치지 않고 별도의 층으로 유지하는 이유가 바로 이것입니다.
단어 수가 오해를 낳는 지점
단어 수는 목표가 아니라 계획을 위한 도구입니다. 어긋나는 지점이 세 군데 있습니다.
수용 어휘 대 생산 어휘. C1의 8,000-9,000이라는 수치는 인식 어휘입니다. C1에서 현실적인 생산 어휘 범위는 시간 압박 속에서 실제로 인출할 수 있는 3,000-4,000단어입니다. 말하기 시험은 이 더 작은 숫자를 시험합니다. 읽기는 괜찮은데 말하기 영역에서 계속 떨어진다면, 단어를 더 넣는 것은 잘못된 처방입니다 - 필요한 것은 인출 훈련입니다.
문법은 어휘가 아닙니다. 접속법 2식()과 수동태()가 불안정하다면 어떤 단어 수도 B2 Schreiben을 통과시켜 주지 못합니다. 이것은 별도의, 그리고 더 작은 트랙입니다 - 문법 라이브러리는 어휘와 달리 유한합니다.
시험이 6주 앞으로 다가왔다면 시험 단어 목록을 쓰세요. 괴테 인스티투트는 A1, A2, B1 Wortlisten을 무료 PDF로 공개합니다. 이것은 권위 있는 자료이며, 문항 출제자가 실제로 사용한 바로 그 목록이고, 저희 것을 포함해 그 어떤 제3자 덱도 그 특정 시험에는 이보다 더 잘 맞을 수 없습니다. PDF를 내려받으세요. 카드를 직접 만드는 것을 좋아하고 저녁 시간 하나쯤 설정에 써도 괜찮다면, Anki에 그 목록을 더하는 것만으로 비용 없이도 충분히 작동합니다. 저희 서비스는 순서 구성, 음성, 예문이 이미 갖춰져 있기를 원하고, B1을 넘어 공식 목록이 존재하지 않는 영역으로 나아가는 학습자를 위한 것입니다.
가장 먼저 성과를 내는 2,000단어부터 시작하세요
표에서 딱 하나만 기억한다면 이것입니다. 상위 2,000개 표제어는 평균적인 페이지의 79.6%에 해당하는 가치가 있고, 그다음 3,000개에 비하면 비용은 일부에 불과합니다. 빈도 순서대로, 음성과 함께, 문장 속에서 익히면 다른 어떤 방법보다 빠르게 해독 단계에서 독해 단계로 넘어갈 수 있습니다.
저희 어휘 덱이 정확히 이런 순서로 구성되어 있습니다 - 빈도 구간을 먼저 두고, 그 위에 시험 목록을 매핑하고, 간격 반복이 복습 일정을 관리해 이미 아는 단어를 다시 읽지 않도록 합니다. 결정하기 전에 형식을 직접 보고 싶다면 단어 항목을 둘러보시고, 이미 결정하셨다면 요금제를 확인하세요. </content>
이어서 읽기
직접 해보기
merke.me는 간격 반복 학습으로 진행하는 A1~C2 종합 독일어 과정입니다. 원어민 음성과 예문과 함께 어휘, 문법, 표현을 배웁니다.
무료로 시작하기