Loading...

Dichtung und Datensatz. ML-Klassifizierung und promptbasierte Poesie

by Fabian Wilhelmi (Author)
22 Pages
Open Access
Journal: literatur für leser:innen Volume 48 Issue 2 Publication Year 2025 pp. 95 - 116

Summary

In diesem Aufsatz werden menschen- und maschinengemachte Lyrik mit Methoden des Maschinellen Lernens (ML) verglichen. Als Datengrundlage dienen ein modifizierter Datensatz des Deutschen Lyrik Korpus (DLK) und KI-generierte Gedichte aus dem Lehrprojekt Sturm und Stromkreis. Dabei wird zuerst untersucht, wie zuverlässig sich die Datensätze bestimmten Labels (hier: Romantik und Realismus) zuordnen lassen. Anschließend wird geprüft, wie erfolgreich die genutzten ML-Modelle zwischen KI-Lyrik und menschengemachten Gedichten unterscheiden können. Die Ergebnisse zeigen, dass die KI-generierten Texte deutlich präziser zugeordnet werden können als historische Dichtung. Außerdem erreichen die Modelle bei der Unterscheidung zwischen DLK und KI-Texten eine Treffsicherheit von 95 Prozent. Die Analyse der dabei am stärksten gewichteten Merkmale deutet auf eine Poetik der KI hin, die sich durch thematische Konventionalität, syntaktische Vereinfachung und stilistische Uniformität auszeichnet.

Details

Pages
22
DOI
10.3726/lfl.2025.02.03
Open Access
CC-BY
Publication date
2026 (August)
Keywords
Digital Humanities Distant Reading Epochenklassifikation KI-Lyrik Maschinelles Lernen
Product Safety
Peter Lang Group AG

Biographical notes

Fabian Wilhelmi (Author)

Previous

Title: Dichtung und Datensatz. ML-Klassifizierung und promptbasierte Poesie