Quellen und Lizenzen
Die Spiele nutzen Daten aus freien Quellen. Hier steht, woher sie kommen und unter welcher Lizenz sie stehen.
- fastText: Wortvektoren (cc.de.300, cc.en.300)CC BY-SA 3.0
Wort-Radar: Wie nah zwei Wörter beieinander liegen. Im Spiel steckt eine verkleinerte Fassung (weniger Dimensionen, gerundete Werte).
- wordfreqCC BY-SA 4.0
Wort-Raten, Galgenmännchen, Wort-Radar: Wie häufig ein Wort vorkommt. Die Daten stammen unter anderem aus OpenSubtitles.
Wortlisten: Hinweis, ob ein Wort in einem Wörterbuch steht.
Sperrlisten: Diese Wörter erscheinen nie im Stream.
- NLTK names corpusKantrowitz, 1991
Englische Wortlisten: Vornamen werden nicht als Lösungswort gewählt.
fastText: E. Grave, P. Bojanowski, P. Gupta, A. Joulin, T. Mikolov, Learning Word Vectors for 157 Languages, LREC 2018.
Aus diesen Quellen abgeleitete Wortlisten und Vektordateien geben wir unter denselben Bedingungen (CC BY-SA) weiter, soweit die Quellen das verlangen.
Die Quizfragen und alle Texte der Seite sind für dieses Projekt geschrieben.