Von Büchern zu Bytes
Die digitale Transformation in der Geschichtswissenschaft
Der professionelle Umgang mit wissenschaftlichen Daten ist ein drängendes und hochaktuelles Thema über die Grenzen der Fachdisziplinen hinweg. NFDI4Memory möchte die Community bei der Bewältigung des “Digital Turns” unterstützen und Forschenden in den historisch arbeitenden Wissenschaften helfen, ihre Fachkompetenzen zu erweitern und von den Möglichkeiten digital gestützter Methoden zu profitieren.
Die Veranstaltungsreihe „From Books to Bytes“ stellt regelmäßig aktuelle Themen und relevante Anwendungsfelder in Vorträgen von und mit Expert:innen, Forschenden und Lehrenden vor. Dabei erhalten die Teilnehmenden nach kurzen thematischen Einführungen die Möglichkeit, sich in Hands-on-Sessions selbstständig mit den vorgestellten Inhalten auseinanderzusetzen und die Ergebnisse innerhalb der Fachcommunity ausführlich zu diskutieren.
Eine Anmeldung ist nicht notwendig. Einfach Einwahldaten eingeben und los geht's!
Teilnahmelink: https://uni-trier.zoom-x.de/j/69148560192?pwd=ZUVjclY2V1JibXhFYVk1VGgrdE9qdz09
Meeting-ID: 691 4856 0192
Kenncode: M0gcpwTh
Uhrzeit: 10 - 11.30 Uhr, genaue Termine s. u.
Wir freuen uns, sie ab Oktober 2026 wieder monatlich begrüßen zu dürfen!
Von Büchern zu Bytes - Staffel 4
Referentinnen: Prof. Ursula Lehmkuhl und Marina Lemaire (Universität Trier)
Zum Auftakt der neuen “Von Büchern zu Bytes” Staffel werden zwei zentrale Ergebnisse im Kontext der Datenkompetenzvermittlung in den historisch arbeitenden Disziplinen vorgestellt: das neue Open-Access-Handbuch Historische Propädeutik im digitalen Zeitalter und die Informations-, Lern- und Lehrplattform HISTOFOX.
Das Handbuch diskutiert in 35 Beiträge von 67 Autor*innen wie die klassische Quellenkritik um zentrale Anforderungen des digitalen Zeitalters erweitert werden kann. Behandelt werden Fragen der digitalen Hermeneutik und Datenkritik, Recht und Ethik, Forschungsdatenmanagement und Digital Area Histories.
Die Plattform HISTOFOX sammelt und publiziert Fachartikel, interaktive Selbstlerneinheiten, Lehrszenarien mit Forschungsdatensätzen und Tool-Steckbriefe, die zeigen, wie die notwendige Weiterentwicklung der historischen Propädeutik in die Lehrpraxis überführt werden kann.
Möglich wird diese Verbindung von Fachartikel und digitaler Lerneinheit durch das Open Encyclopedia System (OES) der Freien Universität Berlin, auf dem HISTOFOX aufbaut. Wir stellen das System vor und zeigen anhand geschichtswissenschaftlicher Publikationsprojekte, welche Möglichkeiten es für offene, kollaborative, innovative Publikations- und Lehrformate eröffnet.
Referent: Michael Thoß (Technische Universität Dresden)
Historische Daten sind selten eindeutig. Quellen sind lückenhaft, widersprüchlich oder nur indirekt aussagekräftig. Dennoch erscheinen historische Befunde in digitalen Forschungsumgebungen oft als klare Datensätze: ein Datum, ein Ort, ein Ereignis oder eine Organisationseinheit. Besonders digitale Karten können dabei eine räumliche und zeitliche Eindeutigkeit suggerieren, die die Quellenlage nicht hergibt.
IDOHIST setzt hier an. Die webbasierte Forschungsinfrastruktur dokumentiert den Weg von der Quelle zur historischen Aussage und ihrer Visualisierung. Sie unterscheidet zwischen Quelle, Deutung und Ableitung und erfasst sogenannte Paradaten: Informationen über Entscheidungen, Annahmen und Bewertungen, durch die aus Quellenbefunden historische Aussagen entstehen.
Im Vortrag stellen wir Konzept und Infrastruktur von IDOHIST vor. An vorbereiteten Beispielen zeigen wir, wie unsichere Datierungen, indirekte Verortungen, widersprüchliche Quellenangaben und konkurrierende Interpretationen modelliert und kartografisch sichtbar gemacht werden können. Im Hands-On-Teil arbeiten die Teilnehmenden selbst mit ausgewählten Fällen und diskutieren, welche Informationen als Daten, Metadaten oder Paradaten erfasst werden sollten.
Die Session vermittelt konzeptionelle Grundlagen und praktische Einblicke in eine Infrastruktur, die quellenkritisches Arbeiten dokumentiert und visualisiert.
Keine technischen Vorkenntnisse erforderlich.
Daidalos ist ein an der Humboldt-Universität zu Berlin angesiedeltes Infrastrukturprojekt, das niedrigschwellige Zugänge zu Methoden der computergestützten Analyse lateinischer und altgriechischer Texte entwickelt. Dabei sind die Nachnutzung bereits vorhandener Algorithmen und Datensätze sowie Open Science maßgebliche Prinzipien unserer Arbeit. Im Impulsvortrag zeigen wir, wo sich Daidalos im Spannungsfeld zwischen moderner generativer KI und älteren NLP-Verfahren verortet und wie die Plattform der klassisch-philologischen Fachcommunity beim Forschen helfen kann: Daidalos verbindet einfach nutzbare Werkzeuge mit Lernangeboten und hilft dabei, Analyseergebnisse und die dazugehörigen Statistiken kritisch zu beurteilen und fachlich einzuordnen.
Im anschließenden Hands-on-Teil erproben die Teilnehmenden an einem überschaubaren Beispiel, wie sie — ausgehend von einer geisteswissenschaftlichen Forschungsfrage — passende digitale Ressourcen in der Plattform auswählen und fachlich evaluieren können. Gemeinsam erproben wir die Arbeitsschritte von der Vorverarbeitung eines Textes über seine maschinelle Analyse bis zur Visualisierung und philologischen Interpretation der Ergebnisse. Technische Vorkenntnisse sind nicht erforderlich.
Referent: Peter Kompiel (Freie Universität Berlin)
Das von NFDI4Memory geförderte Projekt ASR4Memory hat für die Forschungscommunity ein Angebot zur automatischen Transkription audiovisueller Forschungsdaten entwickelt, das 2025 als 4Memory-Initiativdienst in das Serviceportfolio von NFDI4Memory aufgenommen wurde. Ein fachlicher Schwerpunkt liegt auf den historisch arbeitenden Geisteswissenschaften.
Mit dem Service können audiovisuelle Ressourcen aus heterogenen Quellen in mehr als 30 Sprachen für unterschiedliche Forschungs-, Nachnutzungs- und Archivierungsszenarien automatisch transkribiert werden. Die Forschungsdaten werden datenschutzkonform ausschließlich auf lokal betriebenen Infrastrukturen der Freien Universität Berlin verarbeitet. Für die weitere wissenschaftliche Nutzung werden die Ergebnisse in verschiedenen standardisierten Transkript- und Austauschformaten bereitgestellt.
Der Vortrag veranschaulicht anhand von Hands-on-Beispielen die Stärken und Schwächen von Speech-to-Text-Modellen und gibt Einblicke in die Potenziale des Finetunings zur Verbesserung der Transkriptionsqualität.
Referent*innen: Constanze Buyken und Fabian Cremer (IEG Mainz)
Datenmanagementpläne (DMPs) beschreiben und dokumentieren für ein spezifisches Projekt die verschiedenen Aspekte der Forschungsdaten und den Umgang mit diesen Daten. DMPs werden als ein zentrales Instrument im Forschungsdatenmanagement angesehen und in den letzten Jahren von vielen Fördereinrichtungen bei einer Projektbeantragung eingefordert. Im Juli 2026 hat das DFG-Fachkollegium Geschichtswissenschaften neue Empfehlungen zum Umgang mit Forschungsdaten herausgegeben, an denen NFDI4Memory unterstützend mitgewirkt hat.
In der Session gehen wir auf diese Empfehlungen ein und stellen den Teilnehmenden mit DMP4Memory einen Dienst auf Basis des Tools Research Data Management Organiser (RDMO) vor, der Forschende in ihrem Forschungsdatenmanagement in der Phase der Antragsstellung von Projekten unterstützt und dabei die DFG-Empfehlungen berücksichtigt.
Ausgehend von einer grundlegenden Vorstellung des Konzeptes des Datenmanagementplans in der Projektbeantragung machen sich die Teilnehmenden des Workshops mit den Empfehlungen des Fachkollegiums Geschichtswissenschaften für das Forschungsdatenmanagement in DFG-Anträgen vertraut. In der Hands-On-Session stellen wir DMP4Memory vor und die Teilnehmenden können den Dienst für geplante Projekte und ähnliche Anwendungsfälle erproben.
Referentin: Sophie Schneider (Freie Universität Berlin)
Namen ermöglichen es uns, Gegenstände aus unserer Welt eindeutig zu referenzieren. Daher steht die Erforschung von Namen auch schon lange im Zentrum geschichtswissenschaftlicher Untersuchungen: Forschungszweige wie beispielsweise die Onomastik und Prosopographie waren bereits lange vor dem Computerzeitalter mit der Sammlung und Auswertung von Personen- bzw. Eigennamen im Allgemeinen befasst. Mithilfe des Computers können wir nun allerdings Verfahren zur automatischen Erkennung, Disambiguierung, Verlinkung und Analyse benannter Entitäten („Named Entities“) in Texten einsetzen. Die verschiedenen methodischen Ansätze, vielseitigen Herausforderungen und verfügbaren Ressourcen für die Arbeit mit historischen Named Entities werden im Vortrag näher beleuchtet.
Im praktischen Teil widmen wir uns dann konkreten Fragen zur Verknüpfung benannter Entitäten unter Zuhilfenahme des Open Source Tools OpenRefine:
- Wie und mit welchen externen Datenquellen lassen sich Named Entities verknüpfen?
- Wie wirken sich Unterschiede in der Vorgehensweise auf die Ergebnisse aus?
- Welche Möglichkeiten und Herausforderungen ergeben sich durch die Verlinkung von Named Entities mithilfe von OpenRefine?
Für den praktischen Teil wird um eine Installation von OpenRefine im Voraus gebeten.
Referent: Prof. Thomas Hartmann (FIZ Karlsruhe Leibniz-Institut für Informationsinfrastruktur)
Aus der Perspektive der Geschichtswissenschaft und den digital arbeitenden Geisteswissenschaften insgesamt werden rechtliche Handlungsfelder vorgestellt. Ein besonderes Augenmerk wird dabei darauf gelegt, welche Bedeutung rechtliche Vorgaben entfalten, wenn innerhalb kurzer Zeit Big Data, Künstliche Intelligenz & Co. den Wissenschaftsalltag beherrschen. Die Teilnehmenden erhalten in Übungsphasen Gelegenheit, die Bedeutung rechtlicher Vorgaben für ihr eigenes Handeln zu reflektieren und auf rechtliche Gestaltungsmöglichkeiten zu achten. Gemeinsam wird diskutiert, welche rechtlichen Standards datengetriebenen Wissenschaften dienen sollten.
Referent*innen: Mitglieder von ELSA4Memory, der Ethik-/Recht-Expert:innenrunde von NFDI4Memory
In historischen Kontexten – gerade wenn sie weiter zurückliegende Epochen betreffen – herrscht manchmal die Vorstellung vor, dass doch alles „so lange her sei“. Was kann es denn da groß aus ethischer Perspektive zu beachten geben? Aber so einfach ist es meist dann doch nicht, denn nicht nur in der Zeitgeschichte stellen sich ethische und rechtliche Fragen bei vielen Aspekten der digitalhistorischen Forschung, Vermittlung und Zugänglichmachung.
Vielen Forscher:innen, Archivar:innen, Vermittler:innen und anderen historisch-orientierten Praktiker:innen fehlt die Sicherheit bei der Beantwortung ethischer und rechtlicher Fragen. Es bleibt oft das Gefühl eines nicht kalkulierbaren Risikos mit den Schreckensszenarien von Strafzahlungen oder diskreditierenden Shitstorms. Es ist an der Zeit, dass wir in den historischen Arbeitsfeldern praktisch umsetzbare Lösungsansätze diskutieren. Wir können uns auf ethischen Prinzipien besinnen, die sich in „analogen“ Projekten bereits etabliert haben, diese hinterfragen, ob sie auch im Digitalen tragen, und letztlich Antworten auf spezifische Fragen finden, die uns durch KI und andere digitale Entwicklungen neu oder anders bewegen.
Mit ELSA4Memory arbeitet bei NFDI4Memory eine Expert:innenrunde an einer Handreichung zu juristischen und ethischen Themen der historischen Praxis. In der Session von „Büchern zu Bytes“ soll diese aber nicht nur vorgestellt werden, sondern wir wollen die ethischen Dimensionen ausloten und Lösungsansätze diskutieren. Denn Ethik ist kein fixes Konstrukt, sondern ein (gesellschaftlicher) Aushandlungsprozess. Gerne können im Hands-On Teil eigene ethische Fragen eingebracht werden.
Referent*innen: Timo Holste (Landesarchiv Baden-Württemberg), Dr. Felix Bach, Sandra Göller, Kerstin Soltau (FIZ Karlsruhe Leibniz-Institut für Informationsinfrastruktur),
Wo lassen sich Forschungsdaten aus den Geschichts- und Kulturwissenschaften so veröffentlichen, dass sie langfristig auffindbar, zitierbar und nachnutzbar bleiben? In dieser Session wird RADAR4Memory vorgestellt – der kostenfreie Publikationsdienst von NFDI4Memory für geschichtswissenschaftliche Forschungsdaten. Der Dienst basiert auf dem etablierten Datenrepository RADAR von FIZ Karlsruhe und ermöglicht die Veröffentlichung von Forschungsdaten gemäß den FAIR-Prinzipien. Durch die Vergabe eines DOI und eine Aufbewahrungsfrist von mindestens 25 Jahren bleiben Forschungsdaten so langfristig verfügbar, zitierfähig und auffindbar.
Anhand eines praxisnahen Beispiels wird der Weg einer Datenpublikation Schritt für Schritt vorgestellt: vom Upload und der Beschreibung der Daten bis hin zur Veröffentlichung. Dabei erhalten die Teilnehmenden einen verständlichen Einstieg in den allgemeinen Publikationsworkflow sowie in die Metadatenannotation und das Rollen- und Rechtemodell. Die Session richtet sich insbesondere an Interessierte, die sich einen ersten Überblick über die nachhaltige Publikation von Forschungsdaten mit RADAR4Memory verschaffen möchten.

Session verpasst? Kein Problem! Alle vergangenen Sitzungen jetzt auf YouTube anschauen.