Extra Player Games

Quellen

Stand: 14.08.2026.

Kurzfassung

Die deutschen Wörter in Wortrad stehen dort nicht zufällig: dahinter liegen Häufigkeitsdaten, und die sind nicht von uns. Diese Seite nennt, woher sie kommen, unter welchen Lizenzen sie stehen und was wir an ihnen verändert haben.

Zwei der Lizenzen verlangen diese Nennung, eine Quelle bittet bloß darum. Wir nennen alle — auch die, bei denen wir es nicht müssen.

Zu bestätigen ist hier nichts. Eine Namensnennung ist keine Einwilligung: kein Häkchen, kein Dialog, keine Abfrage. Wenn du etwas erlauben oder widerrufen willst, ist das die Datenschutzerklärung und nicht diese Seite.

Wortrad: die Wortlisten

Das Spiel bringt seine Wörter als fertige Dateien mit und lädt zum Spielen nichts nach. Entstanden sind diese Dateien auf einem Entwicklungsrechner, in mehreren Schritten, aus den folgenden Quellen.

Wortfrequenzen: wordfreq

Welche deutschen Wörter geläufig sind und welche kaum jemand kennt, wissen wir aus wordfreq. Ohne diese Daten gäbe es das Spiel nicht in dieser Form — die Geläufigkeit entscheidet, welche Wörter auf das Rad kommen und welche nur als Bonus zählen.

Werk
wordfreq, Fassung 3.1.1
Urheberin
Robyn Speer
Adresse des Werks
github.com/rspeer/wordfreq
Lizenz der Daten
Creative Commons Attribution-ShareAlike 4.0 International (CC BY-SA 4.0), creativecommons.org
Lizenz des Programmcodes
Apache License 2.0. Sie betrifft das Werkzeug, mit dem wir die Daten ausgelesen haben, und nicht die Daten selbst.

Dem Paket liegt zu den Frequenzdaten kein eigener Copyright-Hinweis bei — geprüft an der installierten Fassung 3.1.1. Wir geben deshalb Urheberin und Werk an und schreiben keinen Hinweis dazu, den die Lizenzgeberin den Daten nicht beigegeben hat.

Die Daten kommen ohne Gewährleistung. Was das genau bedeutet, steht in Abschnitt 5 des Lizenztexts.

Was wir daran verändert haben

Die Lizenz verlangt, Änderungen kenntlich zu machen. Wir haben nicht wenig geändert — aus 633.824 Einträgen der deutschen Liste sind 15.438 Spielwörter geworden:

  • Nur Wörter mit einer Zipf-Häufigkeit von 2,5 oder höher sind übernommen worden.
  • Nur drei bis sieben Buchstaben, und nur A bis Z sowie Ä, Ö und Ü. Kein ß — beim Großschreiben wird daraus SS, und aus „Straße" wäre ein Wort „STRASSE" geworden — das ist die schweizerische Schreibung, nicht die, mit der hier gespielt wird.
  • Alles großgeschrieben und Unicode-normalisiert; Doppelte sind zusammengeführt, wobei der höhere Häufigkeitswert gewinnt.
  • 37 Wörter sind an der Blockliste weiter unten gescheitert und entfernt.
  • Die verbliebenen 30.275 Wörter sind einzeln durchgesehen. Geblieben ist nur, was ein echtes deutsches Wort in gebräuchlicher Form und familientauglich ist — keine Eigennamen, keine Abkürzungen, keine Tippfehler.
  • Der Häufigkeitswert von wordfreq ist danach verworfen und durch eine eigene Geläufigkeitsnote von 1 bis 5 ersetzt.
  • Dazugekommen ist eine eigene Liste von 41 Austriazismen — MARILLE, JAUSE, OBERS, KIPFERL und ähnliche. 24 davon lagen unter der Häufigkeitsschwelle und hätten sonst gefehlt; die übrigen 17 waren in den Frequenzdaten vorhanden und sind hier nur sicher als Austriazismus markiert.

Die Korpora hinter wordfreq

wordfreq zählt nicht selbst, sondern führt mehrere Textsammlungen zusammen. Für Deutsch sind das Wikipedia, Untertitel, Nachrichten, Bücher, Webtexte, Reddit und Twitter. Drei davon haben eigene Bedingungen, und die stehen hier:

SUBTLEX

Untertitel-Häufigkeiten von Marc Brysbaert und Kolleginnen und Kollegen, entstanden am Center for Reading Research der Universität Gent (crr.ugent.be). SUBTLEX ist frei verfügbare Daten, und das soll klar bleiben.

Für Deutsch: Brysbaert, M., Buchmeier, M., Conrad, M., Jacobs, A. M., Bölte, J., & Böhl, A. (2011). The word frequency effect: A review of recent developments and implications for the choice of frequency estimates in German. Experimental Psychology 58, 412–424.

OpenSubtitles
Das OpenSubtitles-Korpus aus der OPUS-Sammlung des Language Technology Teams der Universität Helsinki (opus.nlpl.eu). Die Nutzung ist an eine Namensnennung geknüpft, und das ist diese hier.
Google Books Ngrams
Der Google Books Ngram Viewer als Quelle der Buch-Häufigkeiten (Datenstand 2012). In den Unterlagen von wordfreq ist ein Quellenhinweis als erbeten vermerkt; die Bedingungen des Datensatzes haben wir nicht selbst geprüft. Wir geben den Hinweis.

Die weiteren Sammlungen — darunter Wikipedia, das Leeds Internet Corpus des Centre for Translation Studies der University of Leeds und ParaCrawl — stehen selbst unter Creative-Commons-Lizenzen und stellen keine Bedingungen, die über sie hinausgehen.

Die Blockliste gegen Schimpfwörter

Ein Wortspiel für die Familie darf bestimmte Wörter nicht auf das Rad legen. Den ersten Filter dagegen liefert eine fertige Liste:

Werk
„List of Dirty, Naughty, Obscene, and Otherwise Bad Words", deutsche Liste
Copyright
© 2012–2020 Shutterstock, Inc.
Adresse des Werks
github.com/LDNOOBW
Lizenz
Creative Commons Attribution 4.0 International (CC BY 4.0), creativecommons.org
Verwendete Fassung
abgerufen am 22.07.2026, 66 Einträge

Verändert haben wir die Liste nicht. Beim Einlesen normalisieren wir die Einträge — Unicode-Normalform und Großschreibung — damit ein Eintrag mit ß auch die SS-Schreibung trifft. Danach fliegt jedes Wort aus unserer Liste, das genau einem Eintrag entspricht; Wortteile zählen nicht.

Die Blockliste steckt nicht im Spiel. Sie läuft nur beim Erzeugen der Wortlisten, und was sie trifft, ist danach gerade nicht mehr drin.

Auch diese Liste kommt ohne Gewährleistung; siehe Abschnitt 5 des Lizenztexts.

Unsere abgeleiteten Listen

Die aus wordfreq abgeleiteten Wortlisten dieses Spiels stehen ihrerseits unter CC BY-SA 4.0 (creativecommons.org). Wer sie weiterverwendet, behält die Namensnennung bei und stellt abgeleitete Datenwerke unter dieselbe Lizenz.

Die Austriazismen-Ergänzung haben wir selbst geschrieben. Sie ist kein Ableitungswerk der Frequenzdaten und müsste diese Lizenz nicht tragen — wir stellen sie trotzdem unter dieselbe.

Das gilt für die Wortdaten, und nur für sie. Nicht für die Rätsel, nicht für die Auswahl und den Aufbau der Level, nicht für die Grafik, die Klänge und die Software. Was dazu gilt, steht in den Nutzungsbedingungen.

Klänge, Musik und Schriften

Die Klänge in den Spielen sind selbst erzeugt, die Hintergrundmusik des Wortspiels steht unter CC0. Beides ist im Impressum unter „Urheberrecht" genannt, und dort bleibt es auch — eine Angabe an zwei Stellen zu pflegen geht auf Dauer schief.

Diese Website benutzt zwei Schriften, und beide stehen unter der SIL Open Font License 1.1:

Bungee
Copyright 2023 The Bungee Project Authors, github.com/djrrb/Bungee
Atkinson Hyperlegible
Copyright 2020 Braille Institute of America, Inc.

Die Schriftdateien liegen auf unserem eigenen Server und werden von dort ausgeliefert — von fremden Servern lädt diese Seite nichts. Weil wir sie damit weitergeben, gehören Copyright-Hinweis und Lizenz hierher und nicht nur in ein Verzeichnis.

Wer wir sind, steht im Impressum. Wie wir mit Daten umgehen, in der Datenschutzerklärung.