logo

5 Häufigkeitswortlisten: So prüfen Lehrkräfte die Textabdeckung

·von WordByWord Team
14 Min. Lesezeit
5 Häufigkeitswortlisten: So prüfen Lehrkräfte die Textabdeckung

Eine Häufigkeitswortliste ist eine aus einem Korpus abgeleitete Rangfolge von Wörtern, die zeigt, welcher Wortschatz mit dem geringsten Aufwand die größte Textabdeckung bringt. Statt zu raten, welche Wörter wichtig sind, lernen Sie die, die in echter Schrift- und Sprechsprache am häufigsten vorkommen. Kanonische Listen wie die NGSL und die Academic Word List machen aus dieser Rangfolge etwas, das Sie tatsächlich herunterladen und nutzen können, und welche davon passt, hängt von Ihrem Niveau, Ihren Zielen und der Art der Texte ab, die Sie lesen.


Kurz gefasst:

  • Die NGSL beansprucht eine Abdeckung von über 92 % allgemeinsprachlicher englischer Texte, während AWL und NAWL eine allgemeine Liste ergänzen und nicht ersetzen sollten.
  • Prüfen Sie vor dem Download, ob eine Liste Korpus, Zähleinheit, getestete Abdeckung, Revisionsdatum und Lizenz nennt; veraltete oder regional unpassende Quellen können in die Irre führen.
  • Testen Sie Kandidatenlisten an einem Abschnitt Ihres Zielmaterials und prüfen Sie die Abdeckung innerhalb der ersten 1.000, 2.000 oder 3.000 Einträge, bevor Sie sich festlegen.
  • Häufigkeitsrankings übersehen Idiome, Phrasal Verbs, Wortbedeutungen und Register, deshalb sollten Sie Bedeutungen und typische Kombinationen im Wörterbuch oder beim echten Lesen prüfen.
  • Eine Studie ergab, dass die Kombination von Häufigkeit, semantischen Verknüpfungen und dem Urteil der Lehrkraft kürzere Listen mit 11 bis 18 % mehr Abdeckung in vergleichbaren Tests lieferte.

WordByWord
Wortschatz aus dem aufbauen, was Sie lesen
Prüfen Sie, wie viel von einem Artikel Sie bereits verstehen, und speichern Sie unbekannte Wörter aus Ihrer Lektüre für die Wiederholung mit Spaced Repetition.

Inhalt

Wie Häufigkeitswortlisten funktionieren

Eine Häufigkeitsliste ordnet Wörter danach, wie oft sie in einem Korpus vorkommen, einer großen Sammlung echter Texte oder Sprachaufnahmen. Zwei verwandte Konzepte schärfen diese Rangfolge: die Streubreite, die misst, in wie vielen verschiedenen Texten oder Genres ein Wort erscheint, und die Verteilung, die prüft, ob sich die Vorkommen eines Wortes in einer Quelle häufen oder gleichmäßig verteilen. Ein Wort, das oft, aber nur in einem Roman vorkommt, ist weniger nützlich als eines, das mäßig oft in Hunderten von Quellen auftaucht.

Listenersteller müssen außerdem entscheiden, was als „ein Wort“ zählt. Ein Token ist ein einzelnes Vorkommen im Text; ein Type ist eine eindeutige Schreibweise. Ein Lemma fasst flektierte Formen (run, runs, running) unter einem Stichwort zusammen, während eine Wortfamilie noch weiter geht und auch abgeleitete Formen (run, runner, runaway) zusammenfasst.

Diese Entscheidung verändert, was in der endgültigen Liste steht:

  • Lemmabasiertes Zählen behandelt „runs“ und „running“ als denselben Eintrag wie „run“ und erhöht dessen Gesamthäufigkeit.
  • Familienbasiertes Zählen zieht abgeleitete Wörter wie „runner“ hinzu, was den Rang der Familie noch weiter nach oben schieben kann.
  • Zählen nach Oberflächenformen hält jede Flexion getrennt, was häufige grammatische Varianten in der Liste nach unten drückt, selbst wenn das Grundwort extrem häufig ist.

Zwei Listen aus demselben Korpus können Wörter je nach verwendeter Einheit unterschiedlich einstufen, deshalb lohnt sich ein Blick in die Dokumentation einer Liste, bevor Sie ihren Rangfolgen vertrauen.

Kanonische öffentliche Listen und typische Einsatzfälle

Mehrere öffentliche Listen decken die meisten Lern- und Unterrichtssituationen ab:

  1. New General Service List (NGSL): eine moderne Aktualisierung von Wests ursprünglicher Service List, gebaut für eine breite Abdeckung des Alltagsenglischen; die New General Service List soll laut Angabe über 92 % der meisten allgemeinsprachlichen englischen Texte abdecken.
  2. General Service List (GSL): Michael Wests ursprüngliche Liste von 1953. Sie ist historisch bedeutsam und taucht noch in älteren Lehrbüchern auf, doch ihr Quellkorpus liegt vor dem heutigen Sprachgebrauch, deshalb eignet sie sich eher als Hintergrund denn als primäres Lernwerkzeug.
  3. Academic Word List (AWL) und New Academic Word List (NAWL): Beide zielen auf den Wortschatz, der fachübergreifend in akademischen Texten vorkommt. Keine von beiden ist eine eigenständige Lernliste: Kombinieren Sie sie mit einer allgemeinen Liste wie der NGSL, damit Sie neben akademischen auch alltägliche Wörter abdecken.
  4. Dolch-Sichtwörter und Fry-Wörter: kurze, klassische Listen für sehr junge oder beginnende Leser in englischsprachigen Klassen. Sie basieren auf hochfrequenten Funktionswörtern und häufigen Substantiven, nicht auf Abdeckungsstatistiken eines Korpus, und passen daher schlecht zu erwachsenen oder akademischen Lernenden.
  5. Häufigkeitslisten von Wiktionary und verwandte Korpusprojekte: von der Community gepflegte Häufigkeitsdaten aus Quellen wie Filmuntertiteln und Webtexten, nützlich, wenn Sie Häufigkeiten für eine Sprache oder einen Bereich brauchen, den die großen akademischen Listen nicht abdecken.

Das NGSL-Projekt stellt außerdem Begleitlisten bereit, die nach derselben Methode erstellt wurden: die New Academic Word List für akademischen Wortschatz, eine Business Service List für Englisch im Beruf und eine Liste für die TOEFL-Vorbereitung. Dass alle auf vergleichbarer Methodik beruhen, erleichtert das Kombinieren, ohne sich um unterschiedliche Zähleinheiten sorgen zu müssen.

Wie Listen erstellt und geprüft werden und welche Vertrauenssignale zählen

Eine vertrauenswürdige Häufigkeitsliste dokumentiert drei Dinge: den Korpus, aus dem sie stammt, die verwendete Zähleinheit und die beanspruchte Abdeckung. Die Zusammensetzung des Korpus ist wichtig, weil eine Liste aus reinen Nachrichtentexten Wörter anders einstuft als eine aus gesprochener Konversation oder Belletristik. Starke Listen mischen schriftliche und mündliche Quellen und nennen den etablierten Korpus, aus dem sie schöpfen, etwa das British National Corpus (BNC), das Corpus of Contemporary American English (COCA) oder das Cambridge English Corpus.

Eine dokumentierte Abdeckungsschwelle sagt Ihnen, wie weit eine Liste in Richtung Verständnis trägt. Nations Forschung zu Wortschatz und Abdeckung verknüpft bestimmte Abdeckungsprozente mit bestimmten Anforderungen beim Lesen und Hören und stellt fest, dass sowohl die Korpuswahl als auch die Zähleinheit die resultierende Größenschätzung verschieben.

Prüfen Sie diese Signale, bevor Sie einer Liste vertrauen:

  • Ein benannter, beschriebener Korpus, nicht nur „Millionen von Wörtern“ ohne Quelle.
  • Eine angegebene Zähleinheit (Lemma, Familie oder Oberflächenform), die durchgehend konsequent verwendet wird.
  • Ein Abdeckungsprozentsatz, der an einen definierten Testkorpus gebunden ist, keine vage Behauptung.
  • Ein Veröffentlichungs- oder Revisionsdatum, denn Korpora, die älter als ein paar Jahrzehnte sind, übersehen neueren gängigen Sprachgebrauch.

Zu den häufigen Fallen gehören Listen aus britischen Quellen, die unkritisch auf Lernende des amerikanischen Englisch angewendet werden, veraltete Korpora ohne aktuellen Wortschatz und Downloads ganz ohne Methodenhinweise. Eine Replikationsstudie auf Cambridge Core benennt genau diese Art von Korpusdiskrepanz als wiederkehrendes Problem der Wortschatzforschung.

Die richtige Liste wählen und im Unterricht oder Selbststudium nutzen

Die Wahl einer Liste gelingt am besten als kurzer, wiederholbarer Prozess statt als einmaliger Download.

  1. Legen Sie Zieltext und Ziel fest. Leseverständnis, akademisches Schreiben und flüssiges Sprechen greifen auf unterschiedlichen Wortschatz zurück, deshalb kann eine für das eine optimierte Liste beim anderen schwächer abschneiden.
  2. Machen Sie eine schnelle Abdeckungsprüfung. Nehmen Sie eine Probe des Materials, das Sie tatsächlich verstehen wollen, und sehen Sie nach, wie viele seiner Wörter unter den ersten 1.000, 2.000 oder 3.000 Einträgen Ihrer Kandidatenliste vorkommen. Tools für solche Vergleiche, etwa das Programm Range aus häufigkeitsbasierten Textstudien, automatisieren die Zählung, oder Sie zählen bei einem kurzen Abschnitt von Hand.
  3. Kürzen Sie die Liste auf eine brauchbare Größe. Streichen Sie Einträge, die für Ihr Ziel irrelevant sind, und ergänzen Sie fachspezifische Begriffe, die der allgemeinen Liste fehlen, besonders technischen oder fachbezogenen Wortschatz.

Für das Selbststudium kombinieren Sie Ihre gekürzte Liste mit extensivem Lesen in der Zielsprache, damit die Wörter in natürlichem Kontext wieder auftauchen, und planen Sie die Wiederholung mit Spaced Repetition statt in einer einzigen Paukstunde.

Für den Unterricht teilen Sie eine gekürzte Liste in lektionsgroße Portionen, greifen dieselben Wörter in mehreren Stunden und Tests wieder auf und verfolgen, welche Wörter jeder Schüler tatsächlich beherrscht und nicht nur kennengelernt hat.

Tipp: Testen Sie eine Kandidatenliste an einer echten Probe Ihres Zielmaterials, bevor Sie sich festlegen; eine Liste mit hoher allgemeiner Abdeckung kann in einem bestimmten Genre oder Fachgebiet trotzdem enttäuschen.

Wo Sie Listen herunterladen und mit einfachen Tools die Abdeckung prüfen

Die Seiten des NGSL-Projekts bieten direkte Downloads der NGSL und ihrer Begleitlisten einschließlich NAWL sowie eine Dokumentation des Quellkorpus. Downloads der Academic Word List sowie der Dolch- und Fry-Listen kursieren auf verschiedenen Bildungsseiten, deshalb sollten Sie jeden Download anhand der obigen Vertrauenssignale prüfen, bevor Sie sich darauf verlassen.

Für breitere oder mehrsprachige Anforderungen:

  • Die Seiten mit Häufigkeitslisten von Wiktionary bieten Zählungen nach Oberflächenformen, Lemmata und Wortfamilien für viele Sprachen.
  • Die Leipziger Korpora und auf OpenSubtitles basierende Häufigkeitssammlungen bieten herunterladbare Zählungen außerhalb der großen Listen für den Englischunterricht.
  • Leichtgewichtige Tools wie Range oder die Open-Source-Bibliothek wordfreq erlauben den Vergleich eines Textes mit einer Grundwortliste ohne Spezialsoftware; für kurze Abschnitte reicht eine Tabellenkalkulation.

Bevor Sie eine heruntergeladene Liste verwenden, vergewissern Sie sich, dass sie Korpus, Lizenz und Zähleinheit angibt.

Wo Häufigkeitslisten an ihre Grenzen stoßen

Häufigkeitszahlen sagen Ihnen, wie oft ein Wort vorkommt, nicht, was es im Kontext bedeutet, und diese Lücke zeigt sich am stärksten bei Idiomen und Mehrwortausdrücken. „Kick“, „bucket“ und „the“ sind einzeln häufige Wörter, doch „kick the bucket“ bedeutet etwas, das eine wortweise Häufigkeitszählung nicht erfassen kann. Dasselbe Problem tritt bei Phrasal Verbs, Kollokationen und festen Wendungen auf: Eine auf einzelnen Tokens aufgebaute Liste stuft „take“, „break“ und „down“ hoch ein, ohne je „take a break“ oder „break down“ als Einheiten zu markieren, die Lernende zusammen erkennen müssen.

Polysemie schafft ein verwandtes Problem. „Bank“ rangiert in einem allgemeinen Korpus hoch, doch wer Finanzen studiert, braucht die Bedeutung Geldinstitut, während jemand, der Reiseberichte liest, das Flussufer braucht. Eine Häufigkeitsliste gibt Ihnen das Wort, ohne zu sagen, welche Bedeutung in Ihrem Material dominiert, deshalb müssen Sie prüfen, ob die Bedeutung passt, bevor Sie Lernzeit darauf verwenden.

Auch Register und Tonfall sind für Häufigkeitszählungen unsichtbar. Ein Wort kann insgesamt häufig, aber in formellen Texten unangebracht sein oder umgekehrt, und keine rohe Häufigkeitszahl unterscheidet zwischen beidem.

Nichts davon macht Häufigkeitslisten nutzlos, aber es bedeutet, dass sie am besten als erster Filter funktionieren und nicht als endgültige Antwort. Nutzen Sie eine Häufigkeitsliste, um zu entscheiden, was Sie zuerst nachschlagen und lernen, und bestätigen Sie dann Bedeutung, Register und typische Kollokationen im Wörterbuch oder beim echten Lesen, bevor Sie ein Wort als gemeistert betrachten.

Häufigkeitslisten im Vergleich zu thematischen und semantischen Ansätzen

Häufigkeitslisten optimieren eine Sache: die statistische Abdeckung von Fließtext. Thematische Vokabellisten gruppieren Wörter dagegen nach Thema wie Reisen, Essen oder Beruf, unabhängig davon, wie oft jedes Wort in einem allgemeinen Korpus vorkommt. Semantische Cluster gruppieren Wörter nach Bedeutungsbeziehungen statt nach Häufigkeit oder Thema, was Lernenden helfen kann, um ein Wort herum ein Begriffsnetz aufzubauen, statt es isoliert auswendig zu lernen.

Jeder Ansatz löst ein anderes Problem. Eine Häufigkeitsliste bringt den höchsten statistischen Ertrag pro gelerntem Wort und ist damit effizient für allgemeine Verständnisziele. Eine thematische Liste ist bei der reinen Effizienz schwächer, aber stärker bei der Situationsbereitschaft: Wenn Sie reisen, ist „boarding pass“ wichtiger, als sein Häufigkeitsrang vermuten lässt, weil Sie es in einem bestimmten, entscheidenden Moment brauchen. Semantisches Clustern unterstützt das Behalten, indem es neue Wörter mit bereits bekannten verknüpft, und kann das Abrufen selbst bei Wörtern erleichtern, die in einer reinen Häufigkeitszählung nicht hoch rangieren würden.

Die Forschung zur korpusgestützten Listenerstellung legt nahe, dass die stärksten Listen diese Ansätze verbinden, statt sich für einen zu entscheiden. Die Kombination von roher Häufigkeit mit Vernetzung, also damit, wie ein Wort mit anderen zusammenhängt, die eine Lernende oder ein Lernender bereits kennt, und dem Urteil der Lehrkraft über die Unterrichtsrelevanz ergab Listen, die kürzer waren als ältere rein häufigkeitsbasierte Listen und dennoch 11 bis 18 % mehr Abdeckung in vergleichbaren Testkorpora lieferten. In der Praxis heißt das: Eine Häufigkeitsliste bildet ein starkes Rückgrat, doch thematische oder semantische Gruppierungen rund um Ihre konkreten Ziele können die Ergebnisse gegenüber jeder Methode für sich oft verbessern.

Häufigkeitslisten im Vergleich zu thematischen und semantischen Ansätzen: Übersichtsdiagramm

Häufigkeitslisten mit persönlichem Lernen verbinden

Eine Häufigkeitsliste sagt Ihnen, was im Englischen insgesamt statistisch lernenswert ist, aber nichts darüber, was Sie persönlich schon wissen oder brauchen. Der stärkste Lernansatz beginnt mit einer Häufigkeitsliste zum Setzen von Prioritäten und personalisiert von dort aus anhand Ihrer eigenen Lektüre, Interessen und Lücken.

Praktisch sieht das wie ein mehrschichtiges System aus. Beginnen Sie mit einer gekürzten Häufigkeitsliste als Grundziel. Ergänzen Sie Wörter, denen Sie tatsächlich in Material begegnen, das Sie selbst lesen oder ansehen, denn sie bringen Kontext und Motivation mit, die ein generischer Listeneintrag nicht hat. Entfernen Sie Wörter, die Sie bereits gut kennen, auch wenn sie in der Quellliste hoch rangieren, damit Ihre verbleibende Lernzeit in echte Lücken fließt statt in die Wiederholung gemeisterten Wortschatzes.

Häufige Wörter zu einem persönlichen Lernset verfeinert

Spaced-Repetition-Planung passt gut zu einem solchen persönlichen Set, weil sie den Wiederholungszeitpunkt daran anpasst, wie gut Sie jedes Wort kennen, statt jeden Eintrag gleich zu behandeln. Ein Wort, das Sie vor einem Jahr gelernt haben und noch sofort abrufen, braucht weit weniger Wiederholungszeit als eines, das Sie immer wieder vergessen, und ein System, das diesen Unterschied erfasst, spart gegenüber flacher, ungeplanter Wiederholung erheblich Lernzeit.

Die Kombination zählt, weil reines Häufigkeitslernen abstrakt wirken kann: Eine Liste mit 2.000 Wörtern ohne Bezug zu irgendetwas, das Sie lesen, ist schwer durchzuhalten. Die Personalisierung rund um echte Inhalte hält die Wörter an etwas gebunden, das Sie wirklich zu Ende bringen wollen, und das zählt für das langfristige Behalten meist mehr als theoretische Abdeckungsprozente.

Listen setzen Prioritäten, Lesen schafft Flüssigkeit

Häufigkeitslisten sind ein Werkzeug zum Priorisieren, kein Lehrplan. Sie sagen Ihnen, welche 2.000 oder 3.000 Wörter den besten Ertrag bringen, doch eine Liste in einer Tabelle hat noch niemandem eine Sprache beigebracht. Die eigentliche Arbeit passiert, wenn diese Wörter in etwas wieder auftauchen, das Sie tatsächlich lesen oder ansehen, denn wiederholte, bedeutungsvolle Begegnungen machen aus einem Listeneintrag ein Wort, nach dem Sie greifen, ohne nachzudenken.

Die Listen in diesem Leitfaden funktionieren am besten als Filter, den Sie vor dem Lesen anwenden, nicht als Ersatz für das Lesen selbst. Kombinieren Sie eine gekürzte Häufigkeitsliste mit Inhalten, die Sie ohnehin lesen würden, und lassen Sie die bereits priorisierten Wörter ganz natürlich auftauchen.

— WordByWord-Team

Häufigkeitsrelevante Wörter in dem lernen, was Sie ohnehin lesen

Wir haben unsere Chrome-Erweiterung und Web-App gebaut, um das Denken in Häufigkeitslisten direkt in Ihr alltägliches Surfen zu holen. Der Spotlight-Modus hebt unbekannte Wörter auf jeder Seite, in jedem PDF oder YouTube-Video hervor, sodass priorisierte Wörter aus einer Häufigkeitsliste in dem Moment auffallen, in dem sie in echten Inhalten erscheinen, und eine Prüfung des Verständnisniveaus sagt Ihnen vorab, welchen Anteil eines Textes Sie bereits kennen, bevor Sie sich ans Lesen machen.

WordByWord

  • Sammeln Sie die wichtigen Wörter in Ihrem eigenen Set: von Hand angelegt, per KI aus einer Eingabe erzeugt oder als CSV-Datei aus Anki, Quizlet, einer Tabelle oder einer Häufigkeitsliste importiert, der Sie bereits vertrauen.
  • Wiederholen Sie diese Wörter mit Karteikarten und acht Trainingsmodi, darunter Tippen und Hören, nach Spaced Repetition geplant, sodass gemeisterte Wörter automatisch aus den Hervorhebungen verschwinden.

Starten Sie mit unserem Tarif Free Forever und wechseln Sie für 5,99 $ im Monat zu Premium, wann immer Sie die monatlichen Obergrenzen für KI-Trainings und KI-Generierung aufheben möchten.

FAQ

Welche englischen Wörter sind nach Häufigkeit die häufigsten?

Die häufigsten englischen Wörter sind überwiegend Funktionswörter: „the“, „be“, „to“, „of“ und „and“ dominieren die Spitze fast jeder korpusbasierten Liste unabhängig vom Genre. Inhaltswörter wie „time“, „person“ und „year“ folgen in allgemeinen Korpora wie COCA und BNC meist dicht dahinter.

Was ist das zweithäufigste Wort im Englischen?

In den meisten großen englischen Korpora rangiert „be“ (in seinen verschiedenen Formen) als zweithäufigstes Wort, direkt hinter „the“. Die genaue Reihenfolge kann sich zwischen Korpora leicht verschieben, je nachdem, ob gesprochene oder geschriebene Texte die Stichprobe dominieren.

Gibt es eine Liste seltener Wörter?

Seltene Wörter sind typischerweise spezialisierte, technische oder ungewöhnliche Begriffe, die in einem korpusbasierten Ranking weit unten stehen, etwa Nischenvokabular aus der Wissenschaft oder veraltete Wörter. Statt einer einzigen festen Liste können Sie sich eine erstellen, indem Sie bei einer beliebigen Häufigkeitsliste die Ränge jenseits der ersten 5.000 bis 10.000 Einträge betrachten, denn was als „selten“ gilt, hängt von Korpus und Grenzwert ab.

Gibt es ein englisches Häufigkeitswörterbuch?

Ja, mehrere häufigkeitsbasierte Ressourcen funktionieren wie Wörterbücher, darunter die New General Service List mit ihren Begleitlisten sowie offene Häufigkeitsdaten auf Wiktionary. Diese Ressourcen ordnen Wörter nach Korpushäufigkeit, statt sie alphabetisch zu definieren, deshalb funktionieren sie am besten neben einem normalen Wörterbuch und nicht an seiner Stelle.

Quellen

Feature anfragen

Was sollen wir ergänzen oder reparieren? Wir lesen jede Nachricht und schenken dir etwas für die Idee.

0 / 4000