Anmelden (DTAQ) DWDS     dlexDB     CLARIN-D

Wortwolke – Lemmata, Nomen

Tuckermann, Peter: Eine Christliche Predigt/ Gethan den 26. Septembris/ als die Leich des Weyland ... Fürsten vnd Herrn/ Herrn Julij Augusti/ Hertzogen zu Braunschweig vnd Lüneburg/ etc. Apten zu Michelnstein/ Thumbprobsten des Stiffts S. Blasij zu Braunschweig/ Anhero gen Wulffenbüttel gebracht/ vnd in der Fürstlichen Schloßkirchen nieder gesetzt. Wolfenbüttel, 1617.

Diese Wortwolke basiert auf dem automatischen Lemmatisierungsverfahren historischer Texte (CAB), das im DTA für die Textsuche angewandt wird. Die Lemmatisierung fasst sowohl Transliterationen (also bspw. ſ → s) als auch grammatische Formen (Teil, Theil, Theile, Theiles, ...) zusammen. Die Wortidentifikation (Tokenisierung) erfolgt mittels DTA-Tokwrap. Die Fontgröße der einzelnen Lemmata in der Wortwolke ist proportional zu deren Frequenz im Dokument. Lemmata, die im Dokument weniger als dreimal vorkommen, werden nicht dargestellt. Es werden nur diejenigen Lemmata dargestellt, die vom Part-of-Speech-Tagger als Substantiv (Klasse NN) klassifiziert werden.