Die Schnittstelle von Computational Social Science und Movement Studies

Quantitative Textanalyse hat sich als eine leistungsfähige Methodik herausgebildet, um zu verstehen, wie soziale Bewegungen ihre Identitäten konstruieren, Missstände artikulieren und Unterstützer mobilisieren. Durch die Umwandlung von Schriftsprache in strukturierte Daten können Forscher Muster aufdecken, die durch genaues Lesen allein unsichtbar bleiben würden. Dieser Ansatz liegt an der Schnittstelle von Computerlinguistik, Digital Humanities und politischer Soziologie und bietet einen strengen Rahmen für das Testen von Hypothesen über Rahmen, Agenda-Setup und ideologischen Wandel über Zeit und Raum.

Die grundlegende Prämisse ist einfach: Die Worte, die eine Bewegung wählt, sind nicht willkürlich. Wortfrequenzen, Kollokationen und thematische Cluster spiegeln bewusste strategische Entscheidungen darüber wider, wie man das Publikum anspricht, von Gegnern unterscheidet und den inneren Zusammenhalt aufrechterhält. Wenn man sie auf die grundlegenden Texte der Bewegungen – Manifeste – anwendet, bietet diese Methode ein systematisches Fenster in die rhetorische DNA kollektiver Aktionen. Für eine zugängliche Einführung in das breitere Feld siehe Rechenschaftssozialwissenschaft auf Wikipedia.

Warum Manifestos einzigartig für die quantitative Analyse geeignet sind

Manifeste werden an kritischen Stellen produziert – Bewegungsgründung, strategische Neuorientierung oder als Reaktion auf externe Ereignisse. Sie sind typischerweise prägnant, explizit überzeugend und sollen Kernprinzipien verbreiten. Diese Eigenschaften machen sie ideal für vergleichende Analysen: Das Genre ist relativ stabil über Bewegungen und Epochen hinweg, was sinnvolle Frequenzvergleiche ermöglicht. Im Gegensatz zu Reden oder Interviews werden Manifeste oft kollektiv entworfen und überarbeitet, was bedeutet, dass sie eine destillierte organisatorische Stimme darstellen und nicht eine individuelle Perspektive.

Darüber hinaus enthalten Manifeste oft eine klare Positionssprache – Erklärungen, wofür und dagegen die Bewegung ist. Das macht sie zu reichen Zielen für die Sentimentanalyse und die Rahmenerkennung. Zum Beispiel hat die Eröffnungszeile des Kommunistischen Manifests von 1848 über "Spekt" und "Kommunismus" einen kämpferischen Rahmen geschaffen, der jahrzehntelang bestanden hat. Durch die Kodierung von Dokumenten wie Datenpunkten können Forscher verfolgen, wie ähnliche rhetorische Strategien angenommen, modifiziert oder aufgegeben werden, wenn sich Bewegungen entwickeln.

Methodologisches Framework für die Textanalyse von Manifestos

1. Corpusaufbau und Kuratierung

Der Aufbau eines zuverlässigen Korpus ist die Grundlage jeder quantitativen Textanalyse. Für soziale Bewegungsmanifeste geht es darum, klare Einschlusskriterien zu definieren: Was ist ein Manifest? Offizielle Gründungserklärungen, Konventionsbeschlüsse und öffentliche Erklärungen sind Standard. Forscher müssen auch über zeitliche Grenzen, geographischen Umfang und ob interne Dokumente oder nur öffentliche aufgenommen werden sollen entscheiden. Metadatenaufzeichnung ist kritisch - Datum, Organisation, Autor(en), Produktionskontext.

Fehler im Korpusaufbau breiten sich in jede nachfolgende Analyse aus.

Digitale Archive wie NYPL Digital Collections oder die Sektionen für politische Dokumente des Internet Archives sind wertvolle Ausgangspunkte. Für zeitgenössische Bewegungen können Scraping-Plattformen wie GitHub oder organisatorische Websites Text liefern. Es gelten jedoch ethische Überlegungen: Einige Manifeste sind urheberrechtlich geschützt und Bewegungen haben möglicherweise Präferenzen hinsichtlich der Verwendung ihrer Dokumente. Forscher sollten nach Möglichkeit eine Erlaubnis einholen und Quellen transparent zuordnen.

2. Vorverarbeitung: Vom Rohtext zu analysierbaren Daten

Roher Manifesttext ist unordentlich: inkonsistente Großschreibung, abweichende Schreibweisen (z. B. "Arbeit" vs. "Arbeit"), archaische Phrasierung und Formatierung von Trümmern (Seitennummern, Kopfzeilen).

  • Tokenization: Splitting in words or n-grams (Sequenzen von n Wörtern). For manifestos, bi-grams or tri-grams can capture multi-word slogans like “Wage slavery” or “climate justice”.
  • Normalisierung: Lowercasing, Entfernen von Interpunktion und Handhabung von Bindestrichen.
  • Stop Wortentfernung: Herausfiltern von sehr häufigen Funktionswörtern. Allerdings kann Überentfernung stilistische Markierungen verlieren - einige Forschungen behalten absichtlich Stoppwörter, um syntaktische Muster zu erfassen (z. B. "wir verlangen" vs. "sie verlangen").
  • Lemmatisierung: Gruppierung eingebogener Formen. “Demand”, “Demand”, “Demand” reduzieren sich alle auf “Demand”, wodurch Frequenzzählungen die Konzeptnutzung und nicht die grammatikalische Variation widerspiegeln.
  • Regelnormalisierung: wesentlich für historische Texte. Ein feministisches Manifest der 1920er Jahre könnte das „Wahlrecht der Frau“ verwenden, während ein Manifest der 1970er Jahre „Frauenbefreiung“ verwendet. Automatisierte Wörterbücher können historische Varianten zu modernen Entsprechungen abbilden.

Tools wie Pythons spaCy oder NLTK bieten robuste Vorverarbeitungspipelines. Das R-Paket quanteda ist auch für die Korpuslinguistik beliebt. Eine bewährte Vorgehensweise ist es, jede Vorverarbeitungsentscheidung zu dokumentieren und die Empfindlichkeit zu testen: Ändert das Entfernen von Stoppwörtern die relative Bedeutung von Schlüsselwörtern? Zuverlässigkeitsprüfungen mit einem zweiten Codierer oder automatisierte Validierung verbessern die Replizierbarkeit.

3. Kernanalysetechniken

Nach der Vorverarbeitung wählen die Forscher Methoden aus, die für ihre Forschungsfragen geeignet sind.

  • Keyword Analysis: Vergleich der Wortfrequenzen mit einem Referenzkorpus (z. B. allgemeine politische Reden), um überrepräsentierte Begriffe zu identifizieren. Schlüsselmetriken wie Log-Likelihood zeigen, was am Lexikon einer Bewegung charakteristisch ist.
  • Collocation Analysis: Identifizieren statistisch signifikanter Wortpaare. Zum Beispiel kolloziert in Arbeitsmanifesten "Rechte" oft mit "Arbeitern", während es in Umweltmanifesten mit "Natur" kollokiert. Dies zeigt, wie verschiedene Bewegungen abstrakte Begriffe verwenden.
  • Sentimentanalyse: Verwendung von Wörterbüchern wie LIWC oder AFINN, um Positivität/Negativität zu bewerten. Eine bemerkenswerte Erkenntnis ist, dass revolutionäre Manifeste oft eine erhöhte negative Stimmung gegenüber dem “System” zeigen, aber eine hohe positive Stimmung gegenüber “der Zukunft”. Das LIWC-Tool bietet validierte Kategorien für eine solche Analyse.
  • Thema Modellierung: Algorithmen wie Latent Dirichlet Allocation (LDA) decken verborgene thematische Strukturen auf. Ein Thema von “Rechten, Gleichheit, Gerechtigkeit” könnte die Bürgerrechtsmanifeste dominieren, während ein separates Thema von “Regierung, Kontrolle, Freiheit” libertäre Texte charakterisiert. Thema Modellierung ist besonders nützlich für große Korpora, wo manuelle Kodierung nicht möglich ist.
  • Zeitreihenanalyse: Aufzeichnen von Termfrequenzen oder Stimmungswerten über Veröffentlichungsdaten. Dies kann Wendepunkte aufdecken - zum Beispiel einen starken Anstieg des "Klimanotstands" nach 2015 in Umweltmanifesten.

Interaktive Tools wie Voyant Tools ermöglichen Anfängern, mit diesen Techniken ohne Programmierung zu experimentieren, während fortgeschrittene Benutzer sich an Python-Bibliotheken wie gensim für die Themenmodellierung oder scikit-learn für die Klassifizierung wenden können.

4. Interpretation und Validierung durch gemischte Methoden

Quantitative Outputs erfordern interpretatives Framing. Ein Spitzenwert des Begriffs „Community kann entweder auf eine echte Organisation der Community oder auf rhetorische Kooptation hinweisen. Forscher müssen mit dem historischen Kontext, dem qualitativen Lesen von Schlüsselpassagen und Interviews mit Bewegungsteilnehmern triangulieren. Die Validierung kann die Zuverlässigkeit zwischen den Kodierern für jede manuelle Kodierung von Themen, Split-Sample-Tests für Themenmodelle und Sensitivitätsanalysen für Vorverarbeitungsentscheidungen umfassen. Das Ziel ist es, ein Argument zu erstellen, bei dem computergestützte Beweise ein Strang innerhalb eines größeren Beweisbandes sind.

Case Studies in Quantitative Manifestanalyse

Frauenbefreiung und die Entwicklung feministischer Forderungen

Eine wegweisende Studie analysierte alle Manifeste der US-Frauenbewegung von 1964 bis 2014 mithilfe von Schlüsselwort- und Themenmodellierungstechniken. Frühe Dokumente (1960er-70er Jahre) stufen „Gleichheit, „Bezahlung und „Diskriminierung am höchsten ein. In den 1990er Jahren tauchen „Reproduktion, „Gewalt und „Intersektionalität als Leitbegriffe auf. Eine Zeitreihenhandlung des Themas „wirtschaftliche Gleichheit zeigt einen Rückgang nach den 1980er Jahren, während „identitätsbasierte Rechte steigen. Diese quantitativen Beweise bestätigen die Argumente feministischer Wissenschaftler über die Diversifizierung der Bewegung und spiegeln den breiteren kulturellen Wandel wider von klassenfokussierter zu identitätsorientierter Politik.

Die Studie fand auch heraus, dass Manifeste aus den 2000er Jahren zunehmend globale Sprache verwenden - „Vereinte Nationen und „Menschenrechte -, die transnationale Solidaritätsnetzwerke widerspiegeln.

Occupy Wall Street vs. Tea Party: Linguistische Polarisierung

Vergleicht man die Occupy Wall Street „Erklärung der Besatzung (2011) mit Tea Party Manifests von 2009-2012, zeigt sich deutlich lexikalische Unterschiede. Eine Frequenzanalyse zeigt Occupy mit „Unternehmen, „Menschen, „Demokratie und „Ungleichheit zu Raten, die zehnmal höher sind als der Tea Party Corpus. Im Gegensatz dazu sind die Tea Party Texte dicht mit „Steuern, „Regierung, „Freiheit und „Verfassung. Die Collocation-Analyse zeigt weiter gegensätzliche Ziele: Occupy paart „System mit „Korruption, während die Tea Party „Regierung mit „Überreife paart. Die Sentiment-Analyse zeigt, dass beide Bewegungen einen hohen negativen Einfluss auf Eliten haben, aber Occupy lenkt Wut auf wirtschaftliche Eliten, die Tea Party auf politische Eliten.

Diese computergestützte Sektion zeigt, wie populistische Bewegungen ähnliche rhetorische Wut verwenden können, um verschiedene kollektive Identitäten aufzubauen.

Umweltbewegungen: Von der Naturschutz- bis zur Klimakrise

Eine Analyse der wichtigsten Umweltmanifeste von 1962 (Rachel Carsons *Stille Frühling* gilt als Vorläufer) bis 2023 zeigt eine dramatische lexikalische Verschiebung. In frühen Dokumenten (1960er-80er Jahre) sind die Topwörter "Erhaltung", "Wildnis", "Verschmutzung", "Spezies" enthalten. In den 1990er Jahren tritt "globale Erwärmung" ins Lexikon ein, und nach 2015 dominieren "Klimakrise", "Dekarbonisierung" und "Klimagerechtigkeit". Die Themenmodellierung zeigt drei verschiedene Perioden: "Erhaltungszeit" (1960-80), "Regulatorische Ära" (1980-2005) und "Klimanotstandszeit" (2005-heute). Das Wort "nachhaltig" erscheint mit zunehmender Häufigkeit nach dem Rio Earth Summit 1992, während "Aussterben" in den 2010er Jahren ansteigt.

Dieses quantitative Porträt spiegelt sowohl wissenschaftliche Entwicklungen als auch strategische Gestaltungsentscheidungen von Umweltorganisationen wider.

Vorteile, Einschränkungen und ethische Überlegungen

Vorteile des quantitativen Ansatzes

  • Skalierbarkeit: Analysieren Sie Hunderte von Manifesten über Jahrzehnte und Länder in Stunden.
  • Objektivität: Reduziert die Bestätigungsvoreingenommenheit des Forschers, der selektiv Beweise für eine Haustiertheorie finden könnte.
  • Replizierbarkeit: Der Workflow (Corpus + Code) kann geteilt werden, sodass andere die Ergebnisse überprüfen oder erweitern können.
  • Mustererkennung: Identifiziert subtile Verschiebungen, die qualitative Konten vermissen könnten, wie den langsamen Rückgang eines einst dominanten Themas.
  • Vergleichende Kraft: Erleichtert Vergleiche von Bewegungen, die selten zusammen analysiert werden, und offenbart unerwartete Ähnlichkeiten oder Unterschiede.

Einschränkungen und Fallstricke

  • Dekontextualisierung: Wort zählt, ignoriert Ironie, Sarkasmus und rhetorische Gedeihen. Eine Bewegung mag ironischerweise “Freiheit” verwenden, aber eine Frequenzliste behandelt sie genauso wie aufrichtige Nutzung.
  • Korpus-Empfindlichkeit : Einschließlich oder Ausschließen eines einzigen einflussreichen Manifests (z. B. das Kommunistische Manifest in einem Arbeitskorpus) kann die Ergebnisse dramatisch verändern.
  • Vorverarbeitungsentscheidungen: Aggressive Stop-Wort-Entfernung könnte sinnvolle Funktions-Wort-Muster löschen (z. B. Verwendung von “wir” vs. “sie”).
  • Überinterpretation: Einen Anstieg der “Solidarität” zu sehen und sie einer Gewerkschaftskampagne zuzuschreiben, ohne historische Beweise zu überprüfen, riskiert falsche Schlussfolgerungen.
  • Algorithmische Voreingenommenheit: Gefühlslexikone werden oft in moderner, westlicher Sprache trainiert und können historische oder nicht-englische Texte falsch klassifizieren.

Ethische Dimensionen

Soziale Bewegungsmanifeste repräsentieren oft die Stimmen marginalisierter Gemeinschaften. Forscher müssen überlegen, ob ihre Analyse diese Stimmen befähigt oder aneignet. Die Veröffentlichung von Schlüsselwörtern könnte eine strategische Sprache aufdecken, die Bewegungen lieber fließend halten. Darüber hinaus kann die automatisierte Analyse Bewegungen falsch darstellen, bei denen mündliche Überlieferung oder nicht-textuelle Kommunikation von zentraler Bedeutung sind. Transparenz über Methoden, die Einbeziehung von Bewegungsteilnehmern in die Interpretation und die Bereitstellung von freiem Zugang zu Erkenntnissen können ethische Risiken mindern.

Aufkommende Techniken und zukünftige Richtungen

Das Feld schreitet mit den Entwicklungen in der Verarbeitung natürlicher Sprache (NLP) rasant voran. Transformer-basierte Modelle wie BERT und RoBERTa ermöglichen kontextualisierte Worteinbettungen, was bedeutet, dass dasselbe Wort je nach Verwendung unterschiedliche semantische Darstellungen haben kann. Dies ermöglicht eine tiefere Analyse des Framings: Zum Beispiel können "Rechte" in einem feministischen Manifest semantisch näher an "reproduktiv" sein, während es in einem Arbeitsmanifest näher an "Arbeitern" sein kann.

Große Sprachmodelle (LLMs) ermöglichen auch die semantische Ähnlichkeitsanalyse über große Korpora hinweg und identifizieren Manifeste, die sich im Inhalt ähneln, auch wenn sie unterschiedliche Vokabeln verwenden. Dies kann versteckte Einflusslinien aufdecken - z. B. wie die Port Huron-Erklärung spätere anarchistische Manifeste beeinflusst hat. Darüber hinaus kann die Netzwerkanalyse von Konzepten - die Behandlung von gleichzeitig auftretenden Begriffen als Knoten und Kanten - die konzeptionelle Struktur einer Bewegung visualisieren Ideologie.

Eine weitere Grenze ist , mehrsprachige Analyse. Bewegungen sind zunehmend global und der Vergleich von Manifesten über Sprachen hinweg erfordert sprachübergreifende Einbettungen. Tools wie LASER oder XLM-R ermöglichen es Forschern, Manifeste aus verschiedenen sprachlichen Traditionen in einen gemeinsamen semantischen Raum zu übertragen. Übersetzungsverzerrungen müssen jedoch anerkannt werden.

Digitale Archive werden weiter ausgebaut. Projekte wie die Stanford Encyclopedia of Philosophy digitale Sammlungen und Basisinitiativen wie das Social Movement Archive machen mehr Texte verfügbar. Mit dem Wachstum maschinenlesbarer Korpora wird das Potenzial für longitudinale, bewegungsübergreifende Analysen besser machbar. Forscher könnten bald jedes vorhandene Arbeitsmanifest von 1800 bis 2020 analysieren und die globale Verbreitung von Phrasen wie „Arbeiter der Welt, vereinigt euch.

Quantitative Textanalyse in die Bewegungsforschung integrieren

Keine einzige Methode bietet ein vollständiges Verständnis. Die robustesten Studien kombinieren computergestützte Textanalyse mit qualitativer historischer Forschung, Interviews und Teilnehmerbeobachtung. Quantitative Textanalyse zeichnet sich durch die Frage aus, "was sich geändert hat" und "wie viel", während qualitative Methoden "warum" und "was bedeutet es?" Antworten Mixed-Methods-Designs ermöglichen es Forschern, Computertechniken zu verwenden, um Hypothesen zu erstellen und sie dann durch Archivierung zu testen - oder umgekehrt, indem qualitative Erkenntnisse verwendet werden, um die Wahl von Stoppwörtern, Themennummern oder Referenzkorpora zu informieren.

Zum Beispiel könnte ein Forscher mit Themenmodellierung beginnen, um zu entdecken, dass „Dekolonisierung in den 2010er-Jahren-Manifesten für Klimagerechtigkeit häufiger auftritt als in früheren. Sie können dann diese Dokumente genau lesen, um zu verstehen, wie der Begriff verwendet wird – ist es wörtliche Dekolonisierung oder metaphorisch? Diese iterative Schleife zwischen Distanz und Intimität mit dem Text ist das Kennzeichen der strengen Arbeit der Digital Humanities.

Da computergestützte und sozialwissenschaftliche Werkzeuge immer zugänglicher werden, sinkt die Eintrittsbarriere. Online-Tutorials, Open-Source-Software und vorverarbeitete Korpora bedeuten, dass Wissenschaftler mit begrenzter Programmiererfahrung diese Methoden anwenden können. Allerdings wird der Bedarf an kritischem Denken und Domänenwissen zunehmen. Technische Kenntnisse ohne substantielles Verständnis sozialer Bewegungen riskieren, präzise, aber bedeutungslose Zahlen zu erzeugen.

Quantitative Textanalyse wird niemals das sorgfältige, einfühlsame Lesen eines Manifests als menschliches Dokument ersetzen. Aber sie kann diese Lesungen ergänzen und stärken, Muster aufdecken, die Jahrzehnte und Kontinente umfassen. Für jeden, der untersucht, wie Bewegungen überzeugen, mobilisieren und aushalten, bieten die Zahlen einen starken Begleiter für die Worte.