Einleitung: Eine neue Linse in der Vergangenheit

Jahrhundertelang verließen sich Historiker auf eine begrenzte Anzahl von Primärquellen – Augenzeugenberichte, offizielle Dokumente und veröffentlichte Werke – um die emotionale Landschaft vergangener Epochen zu rekonstruieren. Diese Quellen sind zwar von unschätzbarem Wert, aber notwendigerweise selektiv und spiegeln oft die Ansichten einer kleinen, gebildeten Elite wider. Die überwiegende Mehrheit der historischen Stimmen – die Reaktionen der einfachen Bürger, die wechselnden Stimmungen einer Bevölkerung, die stillen Wellen der Zustimmung oder des Widerspruchs – blieben weitgehend unzugänglich. Das Aufkommen der digitalen Geisteswissenschaften und der computergestützten Textanalyse hat begonnen, dies zu ändern. Die Gefühlsanalyse oder Meinungsforschung bietet Historikern ein leistungsfähiges neues Werkzeug, um den emotionalen Ton in massiven Textsammlungen systematisch zu messen, und bietet ein quantitatives Rückgrat für das Verständnis der öffentlichen Meinung in der Vergangenheit. Durch das Training von Algorithmen zur Erkennung positiver, negativer oder neutraler Gefühle können Forscher verfolgen, wie sich kollektive Gefühle als Reaktion auf Kriege, wirtschaftliche Depressionen, politische Bewegungen und kulturelle Veränderungen entwickelten. Dieser Artikel untersucht die Methodik, Anwendungen, Herausforderungen und transformatives Potenzial der Verwendung von Gefühlsanalysen, um die emotionale Geschichte von Gesellschaften aufzudecken.

Was ist Sentimentanalyse? Ein technischer Primer

Im Kern ist die Sentimentanalyse ein Teilbereich der Verarbeitung natürlicher Sprache (Natural Language Processing, NLP), der computergestützte Methoden verwendet, um subjektive Informationen aus Texten zu identifizieren und zu extrahieren. Ziel ist es, die Polarität einer bestimmten Passage zu klassifizieren - ob sie eine positive, negative oder neutrale Stimmung ausdrückt - und oft die Intensität dieser Stimmung zu messen. Moderne Ansätze umfassen sowohl lexikonbasierte Methoden als auch maschinelle Lernmodelle.

Lexikonbasierte Ansätze

Traditionelle Sentimentanalyse beruht auf vorgefertigten Wörterbüchern von Wörtern, die mit emotionaler Wertigkeit kommentiert werden. Zum Beispiel könnte ein Wort wie "fröhlich" als +3 bewertet werden, während "Verzweiflung" als -3 bewertet werden könnte. Der Algorithmus zählt die Häufigkeit und Intensität dieser Wörter in einem Text und durchschnittlich sie, um eine Gesamtsentiment-Bewertung zu erzeugen. Populäre Lexikone sind AFINN, SentiWordNet und der General Inquirer. Für historische Forschung müssen Lexikone sorgfältig angepasst werden, da sich Wortbedeutungen und emotionale Konnotationen im Laufe der Zeit verschieben. Ein Begriff wie "schrecklich" im 18. Jahrhundert könnte "schrecklich" bedeuten und nicht "schrecklich". Forscher bauen oft domänenspezifische oder periodenspezifische Lexikone, um die Genauigkeit zu verbessern.

Machine Learning und Deep Learning

Fortgeschrittene Systeme trainieren Modelle auf großen Textkorpora, die manuell für Stimmung gekennzeichnet wurden. Diese Modelle lernen Muster zu erkennen, einschließlich Wortfolgen, syntaktische Strukturen und Kontext. Rezidivierende neuronale Netze (RNNs) und transformatorbasierte Architekturen wie BERT haben bei allgemeinen Stimmungsaufgaben eine hochmoderne Leistung erreicht. Für historische Texte ist die Feinabstimmung dieser Modelle auf periodengerechter Sprache - Erfassung von Verschiebungen in Grammatik, Vokabular und Idiom - ein aktiver Forschungsbereich. Hybridansätze, die Lexikone mit maschinellem Lernen kombinieren, bieten ein praktisches Gleichgewicht für Historiker, denen möglicherweise die Ressourcen fehlen, um benutzerdefinierte Deep-Learning-Modelle zu trainieren und werden oft für groß angelegte Studien verwendet.

Aufbau des historischen Corpus: Quellen von Textdaten

Qualität und Umfang einer Sentimentanalyse hängen entscheidend von den Daten ab. Historische Forscher stellen Datensätze aus einer Vielzahl digitalisierter Quellen zusammen, jede mit ihren eigenen Stärken und Grenzen.

Digitalisierte Zeitungen und Zeitschriften

Massive Sammlungen wie die Datenbank zur Chronik Amerikas aus der Library of Congress oder dem British Newspaper Archive bieten Millionen von Seiten, die Jahrhunderte überspannen. Zeitungen sind reich an redaktionellen Kommentaren, Briefen an den Herausgeber und berichteten Reden, was sie ideal für die Verfolgung des öffentlichen Diskurses macht. Sie repräsentieren jedoch die Ansichten von Verlagen und der gebildeten Öffentlichkeit, nicht unbedingt der gesamten Bevölkerung. OCR-Fehler (optische Zeichenerkennung) können Lärm verursachen, der eine sorgfältige Vorverarbeitung erfordert.

Persönliche Tagebücher und Briefe

Sammlungen persönlicher Schriften bieten ein intimeres Fenster in die Stimmung. Projekte wie die Tagebücher des Krieges oder die transkribierte Korrespondenz historischer Figuren ermöglichen es Forschern, individuelle emotionale Bahnen im Laufe der Zeit zu verfolgen. Diese Texte sind oft weniger formal und emotional direkter, was sie für die Gefühlsanalyse wertvoll macht. Der Kompromiss ist, dass sie weniger repräsentativ für die Öffentlichkeit sind und einen sorgfältigen Umgang mit eigenwilliger Sprache erfordern.

Politische Reden und Regierungsdokumente

Offizielle Aufzeichnungen, einschließlich Parlamentsdebatten, Präsidentschaftswahlen und diplomatischen Depeschen, bieten ein formales Register der Stimmung. Diese Texte sind hoch strukturiert und verwenden oft sorgfältig ausgearbeitete Sprache, um einen bestimmten Ton zu projizieren. Sentimentanalysen zu Reden können Veränderungen in der politischen Rhetorik aufdecken - zum Beispiel die steigende negative Stimmung in den Monaten vor einem Krieg. Das American Presidency Project und das Hansard Corpus sind häufig verwendete Quellen.

Andere Quellen: Broschüren, Romane und Social Media Archive

Pamphlete und Breitseiten waren der virale Inhalt früherer Jahrhunderte, oft gefüllt mit starken Meinungen. Romane und literarische Werke, während fiktiv, kulturelle Gefühle und moralische Paniken kodieren. In jüngerer Zeit bieten Archive früher sozialer Medien - wie Usenet-Posts aus den 1980er und 1990er Jahren - eine Brücke in das digitale Zeitalter. Die zunehmende Verfügbarkeit digitalisierter Texte durch Initiativen wie Google Books und HathiTrust erweitert weiterhin die Toolbox des Historikers.

Anwendungen: Fallstudien in der historischen Sentimentanalyse

Sentimentanalyse wurde auf eine wachsende Bandbreite historischer Fragen angewendet, was zu Erkenntnissen führte, die traditionelle qualitative Methoden ergänzen.

Verfolgung von Kriegsmoral und öffentlicher Angst

In der Studie des amerikanischen Bürgerkriegs haben Forscher Tausende von Tagebüchern und Briefen analysiert, indem sie Stimmungsschwankungen unter Soldaten und Zivilisten kartierten. Indem sie jeden Eintrag nach emotionaler Wertigkeit bewerteten, beobachteten sie, dass negative Stimmung nach großen Schlachten und in Zeiten wirtschaftlicher Not zunahm, während positive Stimmung mit Unionssiegen und Emanzipationsnachrichten korrelierte. Dieser quantitative Ansatz bestätigte Muster, die Historiker lange vermutet hatten, aber auch unerwartete regionale Variationen - zum Beispiel, dass Moral in der Heimatfront der Konföderierten oft einem anderen Rhythmus folgte als der von Soldaten.

Wirtschaftskrisen und soziale Unruhen

Die Weltwirtschaftskrise der 1930er Jahre hinterließ einen massiven Textfußabdruck in Zeitungen, Regierungsberichten und Briefen an das Weiße Haus. Eine Studie wendete eine Stimmungsanalyse auf Briefe an Präsident Franklin D. Roosevelt an und stellte fest, dass die negative Stimmung an Feiertagen und der Verabschiedung des Social Security Act ihren Höhepunkt erreichte - letzteres erzeugte Kontroversen. Die Forschung zeigte, wie sich die Stimmung von Verzweiflung zu vorsichtigem Optimismus verlagerte, als New Deal-Programme in Kraft traten. In ähnlicher Weise verfolgte die Analyse von Zeitungsredaktionen während der Panik von 1893 den Aufstieg populistischer Rhetorik und Anti-Einwanderungsstimmung.

Soziale Bewegungen und kultureller Wandel

Die Frauenwahlrechtsbewegung des frühen 20. Jahrhunderts kann durch die Linse der Stimmung in Zeitungen und Broschüren untersucht werden. Forscher haben kartographiert, wie die Stimmung für das Wahlrecht in Mainstream-Zeitungen nach großen Protesten und dem Eintritt der USA in den Ersten Weltkrieg zunahm, was die Beiträge der Frauen zu den Kriegsanstrengungen umrahmte. Sentimentanalysen zu den Schriften von Sufragisten selbst zeigen eine komplexe Mischung aus Frustration, Hoffnung und strategischer Wut. Die Methode ermöglicht auch vergleichende Studien über verschiedene Regionen und Perioden hinweg, die zeigen, wie sich der emotionale Tenor der Bewegung veränderte.

Langfristige Verschiebungen in der kulturellen Stimmung verfolgen

Vielleicht versuchen die ehrgeizigsten Anwendungen, die "Stimmung" einer ganzen Kulturperiode zu messen. Zum Beispiel haben Forscher Sentimentanalysen in Millionen von Büchern aus dem 19. und 20. Jahrhundert verwendet, um die Ebbe und Flut von Optimismus versus Pessimismus zu verfolgen. Diese Studien legen nahe, dass die viktorianische Ära einen bestimmten Sentiment-Zyklus hatte, mit Spitzen in Zeiten imperialer Expansion und Tiefen in wirtschaftlichen Depressionen. Während solche groß angelegten Analysen grobkörnig sind, bieten sie einen Panoramablick, der die eingehenden Studien einzelner Ereignisse ergänzt.

Methodische Herausforderungen und Best Practices

Die Anwendung der Sentimentanalyse auf historische Texte ist nicht einfach eine Frage der Ausführung eines modernen Algorithmus auf alten Daten. Historiker müssen sich mit einer Reihe einzigartiger Herausforderungen auseinandersetzen.

Sprachliche Veränderung und Kontext

Wortbedeutungen entwickeln sich. "Niedrig" bedeutete einst "dumm" oder "unwissend"; "albern" bedeutete ursprünglich "gesegnet" oder "glücklich". Sarkasmus, Ironie und Metapher sind notorisch schwierig für Algorithmen und historische Texte sind reich an ihnen. Ein Satz wie "Was für eine brillante Idee, das Schiff zu versenken" könnte von einem naiven Lexikon als positiv interpretiert werden. Forscher müssen Modelle in periodenspezifischer Sprache trainieren und oft menschliche Anmerkungen verwenden, um Ergebnisse zu validieren. Sie müssen auch genrespezifische Konventionen berücksichtigen - akademisches Schreiben unterscheidet sich in emotionalem Ton von einem persönlichen Tagebuch.

Stichprobenvorurteile und Repräsentativität

Die Texte, die überleben und digitalisiert werden, sind keine zufällige Stichprobe historischer Meinungen. Archive überrepräsentieren oft die Stimmen der Elite, der Literaten und der politisch Aktiven. Frauen, Minderheiten und Arme sind unterrepräsentiert. Sentimentanalysen können diese Vorurteile versehentlich verstärken, wenn der Datensatz nicht sorgfältig konstruiert wird. Forscher müssen Rechenmethoden mit traditioneller historischer Kritik kombinieren und fragen, wer den Text geschrieben hat, für wen und unter welchen Umständen.

Validierung und Ground Truth

Woher weiß man, dass der Algorithmus die Stimmung richtig misst? In modernen Anwendungen wird die Grundwahrheit durch menschliches Etikettieren hergestellt. Für historische Texte ist es oft unmöglich, Menschen aus der Zeit zu fragen, wie sie sich gefühlt haben. Forscher müssen andere historische Beweise wie Wahlergebnisse, Protestbeteiligung oder zeitgleiche Berichte verwenden, um Stimmungswerte zu validieren. Sie können sich auch auf mehrere unabhängige menschliche Kommentatoren verlassen, die in historischen Kontexten ausgebildet sind, um eine Teilmenge der Daten zu kennzeichnen.

Skalierung vs. Tiefe

Sentimentanalyse zeichnet sich durch Mustererkennung in Tausenden von Texten aus, aber sie übersieht oft die Subtilität einzelner Stimmen. Ein einzelner Tagebucheintrag mag zutiefst ambivalent sein, aber der Algorithmus kann ihn zu neutral mitteln. Die effektivsten Studien kombinieren quantitative Analyse mit genauer Lektüre repräsentativer Texte. Dieser Ansatz mit gemischten Methoden respektiert die Komplexität menschlicher Emotionen und nutzt gleichzeitig die Macht der Berechnung.

Die Zukunft der historischen Gefühlsanalyse

Mit dem Fortschritt der NLP-Technologie und der zunehmenden Verfügbarkeit von historischem Text in maschinenlesbarer Form ist das Feld für ein deutliches Wachstum bereit.

Mehrsprachige und kulturübergreifende Analyse

Die aktuelle Sentimentanalyse konzentriert sich stark auf Englisch. Die Ausweitung auf andere Sprachen - und, was noch schwieriger ist, auf tote Sprachen wie Latein oder mittelalterliches Englisch - wird neue Perspektiven für die globale historische Forschung eröffnen. Projekte wie Translatio entwickeln historische Sprachmodelle für alte und mittelalterliche Texte. Interkulturelle Studien könnten die öffentliche Meinung bei ähnlichen Ereignissen vergleichen - zum Beispiel, wie verschiedene Gesellschaften auf den Ausbruch des Ersten Weltkriegs reagierten.

Feinkorn-Emotionserkennung

Statt einer einfachen positiven/negativen Polarität können neue Modelle diskrete Emotionen wie Wut, Angst, Vertrauen, Überraschung und Freude erkennen. Dies ist besonders nützlich für die Geschichte, wo die emotionale Palette nuanciert ist. Wut könnte einer Revolution vorausgehen, während Angst eine Plage begleiten könnte. Feinkörnige Emotionsanalyse kann Historikern helfen, die Auslöser kollektiver Aktionen zu lokalisieren.

Zeitliche Dynamik und Ereigniserkennung

Sentiment-Zeitreihen können mit historischen Ereignissen korreliert werden, aber die Algorithmen selbst können auch helfen, Ereignisse zu identifizieren. Zum Beispiel könnte ein plötzlicher Anstieg der negativen Stimmung in einem Korpus eine unbemerkte Krise oder einen Wendepunkt signalisieren. Diese Ereigniserkennungsfunktion macht die Stimmungsanalyse zu einem Werkzeug für Entdeckungen, nicht nur für Messungen.

Integration mit anderen Datenquellen

Die reichsten historischen Erkenntnisse werden aus der Kombination von Stimmungsanalysen mit anderen Formen quantitativer Daten stammen - Wirtschaftsindikatoren, Wetteraufzeichnungen, demografische Statistiken. Die Verknüpfung von emotionalem Ton mit Erntepreisen oder Sterblichkeitsraten kann zum Beispiel zeigen, wie sich wirtschaftliche Not in die öffentliche Stimmung übersetzt. Der Aufstieg der Historical Data Initiative am NBER und ähnliche Projekte bietet die Infrastruktur für solche interdisziplinäre Arbeit.

Fazit: Verbessern des historischen Verständnisses

Sentimentanalyse wird niemals das Geschick des Historikers aus Interpretation, Kontext und Empathie ersetzen. Der Algorithmus weiß nicht, dass ein Seufzer der Erleichterung in einem Brief eines Soldaten am Vorabend der Schlacht ein anderes Gewicht hat als die von Politikern erfundene Begeisterung. Aber als Werkzeug für die Erkennung von Maßstäben und Mustern bietet er etwas, das kein einzelner Historiker erreichen kann: die Fähigkeit, die emotionalen Ströme einer ganzen Gesellschaft über Jahrzehnte hinweg zu verfolgen. Es zwingt uns, uns dem Aggregat zu stellen – nicht nur die außergewöhnlichen Stimmen, sondern das Murmeln der Menge zu sehen. Wenn wir es mit Strenge, historischer Sensibilität und einem klaren Verständnis seiner Grenzen verwenden, öffnet die Sentimentanalyse ein neues Fenster in die Vergangenheit. Es erlaubt uns, mit größerer Präzision zu fragen, wie sich die Menschen wirklich gefühlt haben – und diese Frage mit Beweisen zu beantworten, die aus Millionen zurückgelassenen Wörtern stammen.

Wenn dieses Feld reift, wird es wahrscheinlich zu einem Standardbestandteil des methodischen Werkzeugkastens des Historikers werden, der traditionelle Quellen und Erzählungen ergänzt. Das Ergebnis wird ein reicheres, strukturierteres Verständnis des emotionalen Lebens früherer Generationen sein - und vielleicht eine tiefere Wertschätzung der Rolle, die das Gefühl bei der Gestaltung der Geschichte selbst spielt.