Dichtung und Datensatz. ML-Klassifizierung und promptbasierte Poesie
22 Pages
Open Access
Journal:
literatur für leser:innen
Volume 48
Issue 2
Publication Year 2025
pp. 95 - 116
Summary
In diesem Aufsatz werden menschen- und maschinengemachte Lyrik mit Methoden des Maschinellen Lernens (ML) verglichen. Als Datengrundlage dienen ein modifizierter Datensatz des Deutschen Lyrik Korpus (DLK) und KI-generierte Gedichte aus dem Lehrprojekt Sturm und Stromkreis. Dabei wird zuerst untersucht, wie zuverlässig sich die Datensätze bestimmten Labels (hier: Romantik und Realismus) zuordnen lassen. Anschließend wird geprüft, wie erfolgreich die genutzten ML-Modelle zwischen KI-Lyrik und menschengemachten Gedichten unterscheiden können. Die Ergebnisse zeigen, dass die KI-generierten Texte deutlich präziser zugeordnet werden können als historische Dichtung. Außerdem erreichen die Modelle bei der Unterscheidung zwischen DLK und KI-Texten eine Treffsicherheit von 95 Prozent. Die Analyse der dabei am stärksten gewichteten Merkmale deutet auf eine Poetik der KI hin, die sich durch thematische Konventionalität, syntaktische Vereinfachung und stilistische Uniformität auszeichnet.
Details
- Pages
- 22
- DOI
- 10.3726/lfl.2025.02.03
- Open Access
- CC-BY
- Publication date
- 2026 (August)
- Keywords
- Digital Humanities Distant Reading Epochenklassifikation KI-Lyrik Maschinelles Lernen
- Product Safety
- Peter Lang Group AG