Table of Contents
Die Rolle lokaler Bibliotheken bei der Erhaltung der Gemeinschaftsgeschichte durch Digitalisierung
Überall auf der Welt sind lokale Bibliotheken zu Vorreitern des Gemeinschaftsgedächtnisses geworden. Von fragilen, jahrhundertealten Zeitungen bis hin zu bröckelnden Familienfotos besitzen diese Institutionen eine Fülle von Originaldokumenten, die die Geschichten von Nachbarschaften, Städten und Städten erzählen. Doch physisches Material verschlechtert sich unter dem Gewicht von Zeit, Klima und Handhabung. Als Reaktion darauf führen Bibliotheken eine stille Revolution an: Die Digitalisierung von Gemeinschaftszeitungen, Jahrbüchern, Briefen, Karten und Gemeindeaufzeichnungen, um sie online frei zugänglich zu machen. Diese Bemühungen dienen mehr als der Bewahrung der Vergangenheit; es demokratisiert den Zugang zur Geschichte, stärkt lokale Forscher und stärkt die bürgerliche Identität.
Die Digitalisierung verwandelt spröde, vergilbte Seiten in durchsuchbare, gemeinsam nutzbare digitale Dateien. Anstatt einen Lesesaal zu besuchen und durch gebundene Bände zu blättern, kann ein Benutzer in jedem Teil der Welt jetzt dieselbe Zeitung von 1885 auf einem Smartphone oder Laptop abrufen. Das Ausmaß dieser Arbeit ist enorm, aber Bibliotheken finden kreative Wege, um dies zu erreichen - durch Partnerschaften, Freiwilligenprogramme, Zuschussfinanzierung und Open-Source-Plattformen. Dieser Artikel untersucht, wie Bibliotheken die Herausforderung angehen, welche Technologien sie verwenden und was die Zukunft für digitale Community-Archive bereithält.
Die wachsende Bedeutung der Digitalisierung von Community Archives
Gemeinschaftszeitungen werden oft als erster Entwurf der Geschichte bezeichnet. Sie erfassen lokale Wahlen, Nachrufe, Highschool-Sport, Eröffnungen kleiner Unternehmen und das tägliche Leben. Aber das Papier, auf dem sie gedruckt werden, wird sauer und spröde, besonders für die Ausgaben Ende des 19. und Anfang des 20. Jahrhunderts. Bibliotheken haben lange die Dringlichkeit verstanden: Wenn eine Zeitung nicht erhalten wird, verschwindet ein Kapitel der lokalen Geschichte einfach.
Die Digitalisierung stoppt die Uhr. Es erzeugt eine genaue digitale Replik, die gespeichert, gesichert und auf unbestimmte Zeit referenziert werden kann, während das Original von der häufigen Handhabung ausgeschlossen werden kann.
Über die Erhaltung hinaus löst die Digitalisierung ein grundlegendes Zugangsproblem. Viele Community-Zeitungen wurden nie umfassend indexiert oder mikroverfilmt. Forscher wissen vielleicht, dass eine Geschichte existiert, können sie aber nicht finden, ohne jahrelange Probleme zu durchforsten. Digitaler Text kann jedoch durch die optische Zeichenerkennung (OCR) durchsuchbar gemacht werden, was bedeutet, dass ein Benutzer einen Namen oder ein Ereignis eingeben und sofort jede relevante Erwähnung über Jahrzehnte hinweg finden kann. Diese Fähigkeit hat die lokale Geschichtsforschung verändert und sie so schnell wie eine Google-Suche gemacht.
Bibliotheken erkennen auch an, dass digitalisierte Sammlungen den Stolz der Gemeinschaft fördern. Wenn eine digitalisierte Zeitung von 1920 eine Parade entlang der Main Street zeigt, teilen ältere Bewohner Erinnerungen, jüngere Generationen lernen ihre Stadt kennen und Schulen können Primärquellen in Unterrichtspläne integrieren. Der immaterielle Nutzen - ein Gefühl von Ort und Kontinuität - ist genauso wertvoll wie die Erhaltung selbst.
Wie Bibliotheken den Digitalisierungsprozess angehen
Die Digitalisierung einer Gemeinschaftszeitung oder Dokumentensammlung ist keine einzelne Aktion, sondern ein sorgfältig geplanter Workflow. Bibliotheken müssen ihre Bestände bewerten, Prioritäten festlegen, Materialien vorbereiten, scannen oder fotografieren, beschreibende Metadaten erstellen und schließlich die digitalen Objekte zur Verfügung stellen. Jeder Schritt hat seine eigenen Herausforderungen und Best Practices.
Bewertung und Priorisierung
Die meisten Bibliotheken haben mehr Material, als sie jemals mit den aktuellen Ressourcen digitalisieren könnten. Der erste Schritt ist also, zu bewerten, was am meisten gefährdet und gefragt ist. Fragile Zeitungen aus dem 19. Jahrhundert haben oft Vorrang vor neueren Auflagen. Einzigartige Dokumente, wie handschriftliche Bücher von lokalen Unternehmen oder persönliche Tagebücher von frühen Siedlern, stehen ebenfalls auf dem höchsten Rang.
Bibliothekare können sich mit lokalen historischen Gesellschaften beraten oder die Gönner befragen, um zu sehen, was die Gemeinschaft am meisten schätzt. Diese Phase beinhaltet auch die Überprüfung, ob Artikel bereits anderswo digitalisiert wurden, um Doppelarbeit zu vermeiden.
Materialzubereitungen
Vor dem Scannen müssen Dokumente oft sorgfältig behandelt werden. Lose Seiten müssen chronologisch organisiert werden; Tränen müssen mit Archivband repariert werden; Heftklammern und Büroklammern müssen entfernt werden, um Schäden am Original und am Scanner zu verhindern. Für gebundene Bände wie Jahrbücher oder Bücher entscheiden Bibliothekare, ob sie sich trennen (wenn akzeptabel) oder einen spezialisierten Buchscanner verwenden, der Seiten erfassen kann, ohne den Rücken zu glätten. Das Personal reinigt auch Oberflächen, um Staub und Schimmel zu entfernen, mit weichen Bürsten oder Mikrovakuums, um weiteren Abrieb zu vermeiden.
Scannen und Erfassen von Technologien
Bibliotheken verwenden je nach Material eine Reihe von Geräten. Für Standard-Zeitungsseiten ist ein großformatiger Flachbettscanner mit einer hohen Auflösung (600 dpi oder höher) üblich. Mikrofilm, den viele Bibliotheken bereits für die Zeitungskonservierung besitzen, kann mit speziellen Mikrofilmscannern gescannt werden, die digitale Dateien mit weit größerer Effizienz erzeugen als das Nachscannen von Originalpapier. Für empfindliche gebundene Bücher oder übergroße Karten ermöglichen Overhead-Buchscanner mit einer V-förmigen Wiege eine sichere Erfassung, ohne die Bindung zu belasten. Einige Bibliotheken verwenden auch Digitalkameras auf Kopierständern für dreidimensionale Objekte oder extrem spröde Gegenstände.
Dateiformate sind wichtig. Bibliotheken erstellen typischerweise eine Masterdatei im TIFF-Format (unkomprimiert, hochauflösend) für die Langzeiterhaltung und eine Derivatedatei in JPEG oder PDF für die öffentliche Anzeige. Die Masterdatei wird in einem sicheren digitalen Erhaltungssystem gespeichert, während die Derivate über eine Online-Plattform bereitgestellt werden. Für Zeitungen verwenden viele Bibliotheken jetzt das Format JPEG 2000, weil es eine bessere Komprimierung für große Bilder bietet, ohne Details zu verlieren.
Metadatenerstellung
Ein digitalisiertes Bild ist nutzlos, wenn es niemand finden kann. Metadaten – die beschreibenden Informationen über das Element – sind unerlässlich. Bibliothekare erstellen Datensätze, die Titel, Datum, Publikationsname, Seitenzahl, Themen (wie "lokale Regierung" oder "Einwanderung") und geografische Abdeckung enthalten. Für Zeitungen enthalten Metadaten oft die Indexierung auf Spalten- und Artikelebene. Viele Bibliotheken folgen Standards wie Dublin Core oder dem Metadata Object Description Schema (MODS).
Gut strukturierte Metadaten stellen sicher, dass Benutzer über Sammlungen hinweg suchen können und dass die digitalen Objekte in größeren Portalen wie der Digital Public Library of America (DPLA) oder dem Chronicling America Portal der Library of Congress zusammengefasst werden können.
Upload und Access Plattformen
Einmal gescannt und beschrieben, müssen digitale Dateien auf einer zugänglichen Plattform veröffentlicht werden. Bibliotheken haben viele Möglichkeiten: Einige verwenden Open-Source-Systeme wie Omeka oder Islandora, die speziell für digitale Sammlungen entwickelt wurden. Andere verwenden Content-Management-Systeme wie Directus, mit denen Bibliotheken benutzerdefinierte digitale Archive mit flexiblen Metadatenschemata und leistungsstarken Suchfunktionen erstellen können. Die groß angelegte Digitalisierung von Zeitungen basiert oft auf proprietären Plattformen von Anbietern wie Veridian oder Newspapers.com, aber viele Bibliotheken bevorzugen offene Lösungen, um die langfristige Kontrolle über ihre Daten zu behalten. Die gewählte Plattform muss die Volltextsuche über OCR, facettiertes Surfen nach Datum oder Publikationsname und klare Rechteerklärungen unterstützen.
Schlüsseltechnologien, die moderne Digitalisierungsbemühungen vorantreiben
Hinter jedem Digitalisierungsprojekt für Bibliotheken steckt eine Reihe von Software- und Hardwaretechnologien, die sich in den letzten zehn Jahren rasant entwickelt haben. Das Verständnis dieser Tools hilft zu erklären, wie Bibliotheken Tausende von Seiten effizient verarbeiten können.
Optische Zeichenerkennung (OCR)
OCR-Software konvertiert Bilder von Text in editierbare, durchsuchbare Textzeichenfolgen. Für historische Zeitungen mit defekten oder verzierten Schriften ist die Standard-OCR oft schlecht. Bibliotheken verwenden daher spezialisierte historische OCR-Engines wie Tesseract mit Sprachmodellen, die auf Schriften des 19. Jahrhunderts trainiert sind, oder proprietäre Tools wie Abbyy FineReader mit erhöhter Genauigkeit für degradierten Mikrofilm. Der resultierende Text ist oft unvollkommen - verschmutzte Buchstaben, falscher Abstand - ermöglicht aber dennoch eine leistungsstarke Keyword-Suche.
Einige Bibliotheken verfeinern die OCR-Ausgabe durch manuelle Korrektur durch Crowdsourcing.
IIIF (International Image Interoperabilitätsrahmen)
IIIF hat sich als kritischer Standard für die gemeinsame Nutzung hochauflösender Bilder im Internet herausgebildet. Es definiert eine Reihe von APIs, die es jedem IIIF-kompatiblen Viewer (wie Mirador oder Universal Viewer) ermöglichen, zoombare Bilder von jedem IIIF-kompatiblen Server anzuzeigen. Für Bibliotheken bedeutet IIIF, dass ein Benutzer eine digitalisierte Zeitung öffnen und in eine kleine Kleinanzeige zoomen kann, ohne das gesamte Seitenbild herunterzuladen. Es ermöglicht auch, Bilder von verschiedenen Institutionen im selben Viewer nebeneinander zu vergleichen. Viele digitale Bibliotheksarchive verwenden jetzt IIIF, wodurch ihre Sammlungen interoperabler und benutzerfreundlicher werden.
Crowdsourcing-Plattformen
Die Digitalisierung erzeugt eine Flut von Bildern, aber die Transkription und Metadatenverbesserung bleiben menschenintensive Aufgaben. Bibliotheken haben sich dem Crowdsourcing zugewandt, um Freiwillige in die Korrektur von OCR, das Taggen von Personen und Orten und das Transkribieren handschriftlicher Dokumente einzubinden. Plattformen wie FromThePage ermöglichen es Bibliotheken, Transkriptionsprojekte zu erstellen, bei denen Freiwillige helfen können, den Inhalt von Tagebüchern, Briefen und Kreisaufzeichnungen freizuschalten. Der Einsatz von Freiwilligen beschleunigt nicht nur die Arbeit, sondern baut auch eine engagierte Gemeinschaft von Bibliotheksunterstützern auf. Einige Bibliotheken führen sogar Online-Events durch, bei denen Freiwillige darum konkurrieren, die meisten Seiten in einer Stunde zu transkribieren.
Digitale Konservierungs-Speicherung
Digitale Dateien sind auf ihre eigene Weise zerbrechlich – Festplatten versagen, Formate werden veraltet, Metadaten gehen verloren. Bibliotheken müssen Best Practices für die digitale Konservierung befolgen, wie z. B. die Speicherung mehrerer Kopien an geografisch getrennten Standorten, die Verwendung von Prüfsummen zur Überprüfung der Dateiintegrität und die Migration von Dateien in neuere Formate, wenn sich die Technologie ändert. Viele Bibliotheken verwenden den Standard Audit and Certification of Trustworthy Digital Repositories (ISO 16363), um zuverlässige Konservierungssysteme zu erstellen. Cloud-Speicherdienste wie Amazon Glacier oder Wasabi werden zunehmend für Backups verwendet, aber der primäre Speicher verbleibt oft auf lokalen institutionellen Servern aus Sicherheitsgründen.
Real-World Beispiele für Bibliothek Zeitung Digitalisierung
Um zu verstehen, wie diese Prinzipien zusammenkommen, hilft es, erfolgreiche Projekte zu betrachten, die Maßstäbe für das Feld gesetzt haben.
Chronik Amerika (Bibliothek des Kongresses)
Chronik Amerika ist ein lang laufendes Programm, das von der National Endowment for the Humanities und der Library of Congress gesponsert wird. Es bietet freien Zugang zu ausgewählten historischen Zeitungen aus den Vereinigten Staaten, die die Jahre 1789–1963 abdecken. Teilnehmende Bibliotheken und historische Gesellschaften digitalisieren ihre Zeitungsbestände nach strengen technischen Richtlinien und die resultierenden Dateien werden in einer zentralen durchsuchbaren Datenbank zusammengefasst. Ab 2025 enthält die Website über 20 Millionen Seiten, die alle vollständig durchsuchbar und zum Download verfügbar sind. Das Projekt ist zu einem Modell für Digitalisierungsbemühungen auf staatlicher Ebene geworden, wobei jeder Staat oft seine eigene NEH-finanzierte Initiative betreibt.
Besuchen Sie Chronicling America, um diese riesige Ressource zu erkunden.
Britisches Zeitungsarchiv
Im Vereinigten Königreich ist das ]British Newspaper Archive eine Partnerschaft zwischen der British Library und dem kommerziellen Verlag Findmypast. Es hat über 40 Millionen Seiten regionaler und nationaler Zeitungen digitalisiert, die das 18. bis 20. Jahrhundert abdecken. Die Sammlung ist sowohl über die Website der British Library (kostenloser Zugang vor Ort) als auch über ein Abonnement von Findmypast verfügbar. Dieses Projekt zeigt, wie öffentlich-private Partnerschaften die Digitalisierung über das hinaus skalieren können, was sich eine einzelne Bibliothek leisten könnte.
Die British Library stellt die physischen Zeitungen und das kuratorische Fachwissen zur Verfügung, während Findmypast die Scan- und Hosting-Infrastruktur liefert. Erkunden Sie das British Newspaper Archive für einen Einblick in die britische Lokalgeschichte.
Staatliche und lokale Initiativen: Die California Digital Newspaper Collection
Nicht alle großen Projekte sind national. Die California Digital Newspaper Collection (CDNC), die an der University of California, Riverside, veranstaltet wird, bietet freien Zugang zu Zeitungen aus der frühen Geschichte des Staates bis zur Gegenwart. Sie umfasst Titel wie die San Francisco Call (1863–1913) und die Los Angeles Herald (1873–1938). Die CDNC verwendet Open-Source-Software, die auf dem Extensible Text Framework (ETF) basiert und sowohl HTML- als auch PDF-Ansichten bietet. Sie enthält auch eine Timeline-Funktion, mit der Benutzer die Publikationsgeschichte jedes Titels visualisieren können.
Die CDNC ist ein Paradebeispiel dafür, wie eine Universitätsbibliothek mit öffentlichen Bibliotheken, historischen Gesellschaften und sogar unabhängigen Community-Gruppen zusammenarbeiten kann, um ein umfassendes Archiv auf staatlicher Ebene aufzubauen. Besuche die California Digital Newspaper Collection.
Herausforderungen für Bibliotheken in Digitalisierungsprojekten
Trotz der Erfolge stehen Digitalisierungsbemühungen der Bibliotheken vor anhaltenden Herausforderungen, die den Fortschritt verlangsamen oder den Umfang der Sammlungen einschränken können.
Finanzierung und Nachhaltigkeit
Die Digitalisierung ist teuer. Die Ausrüstung, Software und die Zeit, die für das Scannen einer einzelnen Seite benötigt wird, kosten oft zwischen 0,50 und 2,00 US-Dollar, abhängig vom Zustand des Originals und den benötigten Metadaten. Für einen 10.000-seitigen Zeitungslauf summiert sich das schnell. Viele Bibliotheken verlassen sich auf kurzfristige Zuschüsse von Organisationen wie dem National Endowment for the Humanities, dem Institute of Museum and Library Services oder lokalen Stiftungen. Aber wenn das Stipendium endet, wer zahlt für die laufende Speicherung, Serverwartung und digitale Bewahrung?
Einige Institutionen haben gestaffelte Zugangsmodelle eingeführt - freien Zugang für die grundlegende Betrachtung, eine geringe Gebühr für hochauflösende Downloads - aber das kann mit der Mission des Open Access in Konflikt stehen. Andere suchen fortlaufende institutionelle Unterstützung, indem sie digitalisierte Sammlungen in das Kernbudget der Bibliothek integrieren.
Urheberrecht und geistiges Eigentum
Selbst für Zeitungen, die vor mehr als einem Jahrhundert veröffentlicht wurden, können Urheberrechtsfragen überraschend komplex sein. Während die meisten Zeitungen von vor 1928 in den Vereinigten Staaten gemeinfrei sind, können spätere Probleme immer noch geschützt sein, insbesondere wenn die Zeitung im Besitz eines Unternehmens war, das noch existiert. Einige Zeitungen haben Klauseln, die das Urheberrecht an einzelne Mitwirkende (wie Kolumnisten) statt an den Verlag vergeben. Bibliotheken müssen eine sorgfältige Rechteanalyse durchführen, bevor sie eine digitalisierte Zeitung online stellen. Einige haben nur Metadaten und Vorschauen mit niedriger Auflösung für urheberrechtlich geschützte Inhalte veröffentlicht, die mit dem physischen Original im Lesesaal verknüpft sind.
Der Mangel an klaren Urheberrechtsrichtlinien für Gemeinschaftszeitungen ist ein großes Hindernis für eine umfassende Digitalisierung.
Metadatenstandards und Interoperabilität
Verschiedene Bibliotheken verwenden unterschiedliche Metadatenschemata, kontrollierte Vokabulare und Namenskonventionen. Ein Zeitungsartikel über das Feuer in der Orchard Street könnte in einer Sammlung als "Feuer - New York City" und in einer anderen als "Orchard Street" gekennzeichnet sein. Wenn diese Sammlungen in einem nationalen Portal zusammengefasst werden, macht das Fehlen konsistenter Metadaten die Suche schwierig. Organisationen wie die Digital Public Library of America arbeiten daran, Metadaten durch Aufnahmerichtlinien zu harmonisieren, aber lokalen Bibliotheken fehlt es oft an Personal oder Fachwissen, um ihre Aufzeichnungen dem Standard der DPLA zuzuordnen. Die Aufrechterhaltung konsistenter Metadaten ist eine ständige Herausforderung.
Technischer Maßstab und Infrastruktur
Viele kleine Bibliotheken haben nur begrenzte IT-Unterstützung. Die Verwaltung eines digitalen Archivs erfordert Serververwaltung, Datenbankverwaltung und Sicherheitspatching – Aufgaben, die möglicherweise einem einzelnen Bibliothekar mit vielen anderen Aufgaben zufallen. Cloud-basierte Dienste wie das Internet Archive Archive.org oder Digital Commonwealth in Massachusetts bieten einen Ausweg, indem sie Bibliotheken erlauben, ihre Dateien auf eine gemeinsame Plattform mit einer vorgefertigten Benutzeroberfläche hochzuladen. Diese Plattformen geben Bibliotheken jedoch nicht immer die volle Kontrolle über Metadaten oder Erhaltungsrichtlinien. Für Bibliotheken, die ihre eigene Plattform erstellen möchten, kann die Lernkurve für Software wie Omeka oder Islandora steil sein.
Vorteile des digitalen Zugangs für Gemeinschaften und Forschung
Die Digitalisierung von Gemeinschaftsmaterialien zahlt sich weit über die Bibliothekswände hinaus aus. Der offensichtlichste Vorteil ist die Erhaltung, aber die Multiplikatoreffekte sind beträchtlich.
Empowerment Genealogen und Historiker
Genealogen sind bei Nachrufen, Heiratsanzeigen und rechtlichen Hinweisen stark auf lokale Zeitungen angewiesen. Vor der Digitalisierung muss ein Forscher möglicherweise in die Bibliothek einer Stadt reisen und dann Tage damit verbringen, durch Mikrofilmrollen zu scrollen. Mit einer digitalisierten und OCR-indexierten Sammlung kann die gleiche Forschung in wenigen Minuten von zu Hause aus durchgeführt werden. Diese Demokratisierung des Zugangs schafft die Voraussetzungen: Ein Nachkomme, der Hunderte von Kilometern entfernt lebt, kann die gleichen Aufzeichnungen erkunden wie jemand, der noch in der Gemeinde lebt. Viele Bibliotheken berichten von einem dramatischen Anstieg der Fernreferenzanfragen nach dem Start einer digitalen Zeitungssammlung.
Verbesserung der K-12-Bildung
Primäre Quellen – Originaldokumente aus der Vergangenheit – sind mächtige Lehrmittel. Ein Lehrer an einer örtlichen Schule kann die Schüler bitten, zu vergleichen, wie über ein nationales Ereignis wie die Mondlandung in der Lokalzeitung berichtet wurde, im Vergleich zur New York Times. Sie können Werbung untersuchen, um wirtschaftliche Trends zu verstehen, oder Briefe an den Herausgeber lesen, um die öffentliche Meinung zu kontroversen Themen zu beurteilen. Digitalisierte Sammlungen ermöglichen diese Lektionen, ohne dass eine Exkursion erforderlich ist. Einige Bibliotheken erstellen Unterrichtspläne oder "primäre Quellensätze", die mit staatlichen Standards in Einklang stehen, um die Nutzung von Klassenzimmern direkt zu unterstützen.
Aufbau von Bürgerengagement und Identität
Wenn Menschen ihre eigene Geschichte sehen – die Gründung der Stadt, die Feier eines Hundertjahrfeier, die Geschichte eines lokalen Soldaten – die mit Autorität in einem digitalen Archiv präsentiert wird, bestätigt dies die Bedeutung ihrer Gemeinschaft. Bibliotheken arbeiten oft mit historischen Gesellschaften zusammen, um Community-Scan-Tage zu veranstalten, an denen die Bewohner Familienfotos und Dokumente mitbringen können, die digitalisiert und der Sammlung hinzugefügt werden. Diese Ereignisse fördern ein Gefühl von Besitz und Stolz. In einigen Fällen sind digitalisierte Sammlungen die Grundlage für Wanderungen, Augmented-Reality-Apps oder mobile Exponate geworden, die Geschichte auf die Straße bringen.
Unterstützung des lokalen Journalismus
Die Digitalisierung historischer Zeitungen dient auch den Journalisten von heute. Reporter, die eine Geschichte berichten, können schnell im Archiv nach Kontexten suchen – was passierte, als eine Flut die Stadt das letzte Mal traf, oder wie sich die Debatte um einen örtlichen Park 1910 abspielte. Diese Verbindung zwischen Vergangenheit und Gegenwart bereichert die aktuelle Berichterstattung und hilft Journalisten, sich zu wiederholen Mythen oder halb erinnerte Fakten zu vermeiden. Einige Bibliotheken bieten jetzt spezielle Suchportale für Journalisten an, die es einfacher machen, nach Datumsbereichen und Veröffentlichungen zu filtern.
Zukünftige Trends und Chancen
Die Landschaft der Digitalisierung von Bibliotheken entwickelt sich weiter. Aufkommende Technologien und sich ändernde Erwartungen der Gemeinschaft werden das Aussehen des nächsten Jahrzehnts digitaler Archive prägen.
Machine Learning und automatisierte Metadaten
Eine der vielversprechendsten Entwicklungen ist der Einsatz von maschinellem Lernen, um automatisch Metadaten zu generieren. Experimentelle Projekte haben Bilderkennung verwendet, um Werbung, Fotos oder Illustratoren auf einer Zeitungsseite zu identifizieren. Natürliche Sprachverarbeitung (Natural Language Processing, NLP) kann benannte Entitäten extrahieren – Menschen, Orte, Organisationen – und sie mit externen Datenbanken wie Wikidata verknüpfen. Diese Automatisierung könnte den Aufwand für die Erstellung reichhaltiger Metadaten drastisch reduzieren. Bibliotheken müssen jedoch vorsichtig sein mit algorithmischen Vorurteilen: Ein auf Mainstream-Zeitungen trainiertes Modell kann Inhalte aus ethnischen oder Minderheiten-Publikationen falsch identifizieren.
Menschliche Überprüfung wird für die Genauigkeit unerlässlich bleiben.
Partizipative und Community-Owned Archive
Anstatt dass Bibliotheken die einzigen Torwächter der Digitalisierung sind, gibt es eine wachsende Bewegung hin zu gemeinschaftseigenen Archiven. Tools wie Wikidata und Wikimedia Commons ermöglichen es den Bewohnern, ihre eigenen digitalen Dateien und Metadaten direkt zu einer globalen Plattform beizutragen. Bibliotheken können Workshops zum Hochladen von Inhalten und zur ordnungsgemäßen Lizenzierung von Inhalten veranstalten (z. B. unter Creative Commons). Dieser Ansatz verteilt nicht nur die Arbeitsbelastung, sondern stellt auch sicher, dass marginalisierte oder unterrepräsentierte Stimmen einbezogen werden. Zum Beispiel könnte ein lokales Kunstkollektiv die Zines der 1970er Jahre digitalisieren und sie dem Datensatz hinzufügen, wodurch Lücken in der Bibliothekssammlung geschlossen werden könnten.
Integration mit Linked Open Data
Bibliotheken wandeln ihre Metadaten zunehmend in Linked Open Data (LOD) um, die sich mit anderen Datensätzen im Internet verbinden. Ein digitalisierter Zeitungsartikel über die Wahlen von 1928 könnte mit der Autoritätsdatei der Kongressbibliothek für den Kandidaten, mit geografischen Koordinaten für den Wahlort und mit einer historischen Wetterdatenbank verknüpft werden, um zu sehen, ob Regen die Wahlbeteiligung beeinflusst. Dieses Netz von Verbindungen verwandelt isolierte digitalisierte Seiten in ein reichhaltiges Netzwerk von Wissen. Zum Beispiel sammelt die Europeana-Plattform Millionen von Artikeln aus europäischen Bibliotheken und bietet Linked Data-Zugriff für Entwickler und Forscher.
Langfristige Nachhaltigkeitsmodelle
Die größte Herausforderung am Horizont ist die Nachhaltigkeit. Bibliotheken, die in den frühen 2000er Jahren digitale Sammlungen auf den Markt brachten, stehen jetzt vor Plattformmigrationen, abgelaufener Softwareunterstützung und steigenden Cloud-Speicherkosten. Einige haben begonnen, eine bescheidene Gebühr für die kommerzielle Nutzung hochauflösender Dateien zu erheben, während andere Konsortien gegründet haben, um Infrastrukturkosten zu teilen. Die Digital Public Library of America’s “National Digital Initiative” erforscht ein Modell, bei dem eine Reihe verteilter “Hub”-Bibliotheken digitale Sammlungen von kleineren Institutionen akzeptieren und langfristige Erhaltung und Zugriff zu gemeinsamen Kosten bieten. Wenn solche Modelle erfolgreich sind, könnten sie das Nachhaltigkeitsproblem für Hunderte von kleinen Bibliotheken im ganzen Land lösen.
Erfahren Sie mehr über die Digital Public Library of America für neue landesweite Ansätze.
Schlussfolgerung
Lokale Bibliotheken arbeiten unermüdlich daran, Gemeinschaftszeitungen und Dokumente zu digitalisieren, fragile Papiere in dauerhafte, zugängliche digitale Assets zu verwandeln. Durch durchdachte Planung, sorgfältigen Einsatz von Technologie und kreative Partnerschaften öffnen sie die lokale Geschichte für ein globales Publikum. Die Vorteile für Forschung, Bildung, Gemeinschaftsidentität und Journalismus sind immens. Doch Herausforderungen bei Finanzierung, Urheberrecht, Metadaten und Nachhaltigkeit bleiben bestehen. Mit der Entwicklung von maschinellem Lernen und partizipativen Modellen verspricht die nächste Digitalisierungswelle noch integrativer und vernetzter zu sein.
Für jeden, der sich für die Geschichten interessiert, die einen Ort definieren, ist die Unterstützung der Digitalisierungsbemühungen Ihrer lokalen Bibliothek eine Investition in die Vergangenheit, die sich in Zukunft auszahlt.