Christopher Pollin | Digitale Geschichte(n). Projekte und Praktiken der Digital History
Am 14. März 2023 wurde GPT-4 veröffentlicht (OpenAI 2024). Bereits im Mai hatte ich die kostenpflichtige Version von ChatGPT und damit Zugang zu GPT-4. Ich führte erste Experimente durch, um aus transkribierten historischen Texten, etwa Briefen und Rechnungsbucheinträgen, strukturierte Forschungsdaten in TEI XML (Pollin, Steiner und Zach 2023) und RDF zu erzeugen. Das funktionierte damals noch nicht zuverlässig, aber gut genug, um über die Integration in einen Workflow nachzudenken. Für mich war klar, dass das bald alle tun würden. Dem war jedoch nicht so. Bei einem Hackathon entstand ein funktionierender Prototyp, den wir teiCrafter nannten. Aber wir hatten damals schon verstanden, dass es riskant ist, Zeit in ein Produkt zu investieren, das Big Tech dann sowieso fressen könnte.
Wichtiger als der “gehackte Prototyp” war, was ich dabei über die Technologie selbst lernte. Über den YouTube-Channel AI Explained habe ich zwei Dinge verstanden, die meine Arbeit seitdem prägen: die Scaling Laws (Kaplan et al. 2020), die zeigen, dass sich Modellleistung aus Größe, Daten und Compute ableiten lässt, und SmartGPT, eine mehrstufige Prompting-Technik (AI Explained 2023). Gerade solche Techniken des Prompt Engineering haben zu Beginn einen großen Unterschied gemacht.
Auf Basis dieser Experimente und der “Kunst”, sich viele YouTube-Videos in erhöhter Geschwindigkeit anzuschauen, habe ich im Jahr 2023 die Workshopreihe Angewandte generative KI in den (digitalen) Geisteswissenschaften durchgeführt (Pollin 2025a). Bei einem dieser Workshops habe ich behauptet: “In drei Jahren wird niemand mehr manuell TEI XML schreiben”. Bis dahin ist es nicht mehr weit. Wenn ich mir anschaue, was Frontier-Modelle wie Claude Opus 4.5 oder Gemini 3 Pro heute können – sofern man sie richtig bedient – dann gilt dieser Satz für mich bereits. Meine Arbeit als Digital Humanities Entwickler mit Schwerpunkt Digital History hat sich extrem verändert.