Die exemplarische Analyse dient nicht nur der weiteren Erforschung der literarischen Sappho-Rezeption im deutschsprachigen Raum, sondern auch der Prüfung eines bislang unerprobten methodologischen Zugangs zu literarischen Rezeptionsgeschichten in den Digital Humanities.
Die den Verzeichnissen und damit auch der Analyse zugrundeliegenden Rezeptionszeugnisse wurden im Zuge einer mehrjährigen Dokumentationsarbeit recherchiert – unter anderem in den deutschen, österreichischen und schweizerischen Nationalbibliographien, in Zeitungs- und Zeitschriftendatenbanken wie ANNO und dem Deutschen Zeitungsportal, in digitalen Textkorpora wie TextGrid und dem Projekt Gutenberg sowie in Fanfiction-Portalen wie dem Archive of Our Own und der wissenschaftlichen Sekundärliteratur; ergänzt wurde das Material durch Hinweise aus dem persönlichen und fachlichen Umfeld.
Die gefundenen Texte wurden zunächst mit grundlegenden bibliographischen Angaben – Entstehungs- und Publikationsjahr, Titel, Autor_in(nen), Gattung, Publikationsort, Verlag sowie ggf. einem Link zu einem Digitalisat – in einer Excel-Tabelle erfasst. Mithilfe von OpenRefine wurde die Tabelle anschließend semiautomatisch mit Wikidata verknüpft, um Personen, Werke, Orte und Verlage über eindeutige Identifikatoren (QIDs) zu erschließen. Ein eigens entwickeltes Python-Skript überführte die Tabelle schließlich in die auf GitHub öffentlich zugänglichen XML/TEI-Dateien, die die Grundlage für das hier vorliegende Analysekorpus bilden.
Alle analysierten Rezeptionszeugnisse wurden demselben Korpus entnommen: dem Band Sappho. Texte zur literarischen Rezeption im deutschsprachigen Raum (2023), der die Rezeptionszeugnisse – abgesehen von den Texten von Huber, Schrott und Schwarz – in der Form ihres Erstdrucks vorlegt.
Analysiert wurden außerdem alle in Andreas Bagordos zweisprachiger Ausgabe auf Basis der textkritischen Edition von Eva-Maria Voigt (Patmos 2009) enthaltenen Sappho-Fragmente (vgl. das Menü »Texte« > »Sappho-Fragmente«) sowie 99 exemplarische Rezeptionszeugnisse, die typische Rezeptionsmuster veranschaulichen. Dazu zählen etwa die wiederkehrende Thematisierung der Sappho-Phaon-Legende und die Darstellung Sapphos als große Dichterin oder als homoerotisch Begehrende. Berücksichtigt wurden Texte verschiedener Gattungen (Lyrik, Prosa, Drama sowie Sonstiges, z. B. Comics) und unterschiedlicher Bekanntheit – nicht nur Werke kanonisierter Autor_innen, sondern auch solche weniger bekannter Schreibender, vom 16. bis zum 21. Jahrhundert.
Berücksichtigt wurden Motive, Themen, Stoffe, rhetorische Topoi, Figuren sowie Personen-, Orts- und Werkreferenzen und Zitate. Auf der Grundlage dieser Phänomene wurden intertextuelle Beziehungen zwischen den Rezeptionszeugnissen und den Sappho-Fragmenten sowie zwischen den Rezeptionszeugnissen untereinander festgestellt.
Bevor die Phänomene in dieses Datenmodell überführt werden konnten, mussten sie aus den Texten herausgearbeitet werden. Die 99 Rezeptionszeugnisse lagen durch die Arbeit an der Sappho-Anthologie bereits im Volltext vor, die 197 Sappho-Fragmente wurden mittels Optical Character Recognition (OCR) maschinenlesbar gemacht. Die eigentliche Interpretationsarbeit erfolgte in mehreren aufeinanderfolgenden close reading-Durchgängen: Die Texte wurden mehrfach gelesen, wobei mit jedem Durchgang weitere Annotationen ergänzt bzw. bereits gesetzte kontrolliert und präzisiert wurden.
Annotiert wurde mit einem individuellen XML-Tagset: motiv,
thema, stoff und
topos markierten Motive, Themen, biographische Stoffvarianten
und rhetorische Topoi, werk Werkreferenzen (bei Zitaten und
Paraphrasen ergänzt um das Attribut art="passage"),
person mit den Attributen art="real",
art="fictional" und art="type" reale
Personen, fiktive Figuren und Personentypen sowie ort mit
art="real" bzw. art="fictional" reale
und fiktive Orte. Ließ sich ein Phänomen nicht direkt am Wortlaut festmachen, wurde
es
über das Attribut type mit dem normalisierten Begriff versehen;
wo eine Verortung im Fließtext nicht möglich war – etwa bei manchen Stoffvarianten
und
Themen –, wurden Tags auch außerhalb des Textes gesetzt.
Zur laufenden Kontrolle der Annotation kamen zwei eigens entwickelte Python-Skripte zum Einsatz: Eines listete alle bereits vergebenen Tags mitsamt ihren Werten auf, das andere zeigte, welche davon bereits mehrfach verwendet worden waren – eine Vorarbeit, die zugleich die Grundlage für das SKOS-Vokabular (siehe unten) schuf. Für die abschließende Korrekturrunde wurde zudem eine statische HTML-Ansicht entwickelt, die für jeden Text den Volltext synoptisch neben einer Checkliste aller annotierten Phänomene darstellte.
Auf Grundlage der annotierten XML-Dokumente überführen sechs aufeinander aufbauende Python-Skripte die Daten in RDF-Tripel. Ein erstes Skript legt aus den Autor_innenangaben im Verzeichnis sämtlicher Rezeptionszeugnisse Personeninstanzen an und ergänzt sie, wo eine Wikidata-ID vorliegt, um biographische Grunddaten (Geburt, Tod, Geschlecht, Abbildung) sowie weitere Identifikatoren (DBpedia, GND, VIAF). Ein zweites Skript verarbeitet die bibliographischen Angaben zu den Rezeptionszeugnissen und erzeugt Werk- und, wo ein Publikationsdatum vorliegt, Manifestationsdaten samt Titeln, Publikationsorten und -daten sowie, sofern verfügbar, Cover-Abbildungen und weiteren Identifikatoren (u. a. eine Goodreads-Work-ID); ein drittes Skript überführt auf dieselbe Weise die 197 Sappho-Fragmente sowie Sapphos Gesamtwerk. Ein viertes Skript liest die annotierten XML-Dokumente aus und trägt Motive, Themen, Stoffe, Topoi, Werk-, Orts- und Personenreferenzen sowie Figuren in die entsprechenden Klassen des Datenmodells ein, abgeglichen mit dem SKOS-Vokabular (siehe unten). Ein fünftes Skript konstruiert daraus gerichtete intertextuelle Relationen – sowohl zwischen Sapphos Fragmenten und den Rezeptionszeugnissen als auch zwischen Rezeptionszeugnissen untereinander – und dokumentiert dabei die jeweiligen Belegstellen. Ein sechstes Skript führt schließlich alle zuvor erzeugten Dateien zu einem gemeinsamen Graphen zusammen (nach der Regel »last write wins«); der zusammengeführte Graph wird anschließend mit dem Java-basierten Reasoner HermiT verarbeitet. So entstanden über 400.000 Tripel, die sich durch das reasoning auf über 600.000 erweitern lassen.
Zur Repräsentation der Daten wurde eine eigene Ontologie entwickelt, die auf den bestehenden Ontologien CIDOC CRM, LRMoo und INTRO aufbaut und zusätzlich mit zahlreichen alignments zu weiteren Ontologien ausgestattet ist.
Wiederkehrende Rezeptionsphänomene sind zudem in einem
SKOS-Vokabular definiert.
Da sich produktiv-literarische Rezeptionsphänomene nicht abschließend vorab bestimmen
lassen, wurde das Vokabular induktiv aus dem Material selbst entwickelt: Alle Phänomene,
die in mindestens zwei annotierten Dokumenten auftraten – Werkreferenzen und
Stoffvarianten unabhängig von ihrer Häufigkeit –, wurden im webbasierten LOD-Editor
VocBench manuell strukturiert und
hierarchisiert. Intern wurden sie über hierarchische
(skos:broader/skos:narrower) und assoziative
(skos:related) Relationen verknüpft, extern wo möglich mit Wikidata
(skos:relatedMatch, skos:closeMatch,
skos:narrowMatch, skos:broadMatch). Insgesamt umfasst das
Vokabular 427 Konzepte und gut 5.000 Tripel; den größten Anteil bilden Motive und
Personen.
Die resultierenden Daten sind in einem GitHub-Repositorium offen zugänglich und können zudem über ein SPARQL-Interface auf dieser Webseite abgefragt werden. Exemplarische statistische Auswertungen finden sich hier; alle Daten lassen sich auch über eine Netzwerkvisualisierung erkunden.