Uni Heidelberg

Research Data Engineer (w/m/d) deutsch and english

Baden-Württemberg · Heidelberger Zentrum für Digitale Geisteswissenschaften (HCDH)
Uni Heidelberg Stellenangebote →
Arbeitszeit Vollzeit Befristung befristet 4 Jahre

Research Data Engineer (w/m/d)

English version see below.

Die Universität Heidelberg ist eine Volluniversität mit ausgeprägter Forschungsorientierung und internationalem Anspruch. Mit rund 3

Stellenbeschreibung (Deutsch)

Aufgaben

  • Brückenbildung zwischen Kulturerbe- und anderen Forschungsdaten zum Kulturerbe und computationeller Forschung: Entwurf und Aufbau von data storage layers und Datenverarbeitungs-Pipelines, die es unseren Geisteswissenschaftler∗innen ermöglichen, umfangreiche, heterogene Datensätze (incl. legacy data) zu erstellen und zu analysieren – von historischen Texten und Archiven bis zu Multimedia-, 3D- und weiteren raumbezogenen Daten
  • Vernetzung und Kooperation: Technische und forschungsstrategische Beratung für Geisteswissenschaftler∗innen, um komplexe Forschungsfragen in umsetzbare Anforderungen an Datenverarbeitung und Datenbanken zu übersetzen
  • Daten-Pipelines: Entwurf, Implementierung und Wartung skalierbarer Pipelines zur Erfassung, Bereinigung und Harmonisierung vielfältiger Daten zum Kulturerbe und anderer geisteswissenschaftlich relevanter Daten sowie zur Erstellung interoperabler Datensätze für die Forschung
  • Datenarchitektur: Entwurf, Implementierung und Kuratierung datenbezogener Organisations- und Vorhaltungsstrukturen und deren Verbindung zu bereits bestehenden Datenhaltungssystemen und Dateninfrastrukturen
  • Semantic Web & Wissensgraphen: Entwicklung und Optimierung von Graphdatenbanken, Ontologien und semantischen Modellen (z. B. unter Verwendung von RDF, OWL, CIDOC-CRM) zur Vernetzung komplexer historischer und kultureller Daten.
  • Tool Entwicklung & Automatisierung: Entwicklung benutzerdefinierter APIs und unterschiedlicher Skripte (vorwiegend in Python) zur Automatisierung von Workflows in den Bereichen Datenerfassung, Text-Mining und Verarbeitung natürlicher Sprache (NLP)
  • FAIR und FAIR4RS Prinzipien: Zusammenarbeit mit der Reseach Data Unit und dem Scientific Software Center und seiner Data Science Unit am IWR sowie mit dem Universitätsrechenzentrum (HPC und Speicherinfrastruktur)

Anforderungen

  • Ausbildung: Vorzugsweise Promotion, eine Bewerbung mit MA/MSc ist bei entsprechendem Forschungshintergrund möglich
  • Soft Skills: Ausgeprägte Kommunikationsfähigkeiten, um effektiv in interdisziplinären Teams aus Softwareentwickler∗innen und Geisteswissenschaftler∗innen zu arbeiten
  • Softwarekompetenzen: Hervorragende Kenntnisse in Python (sowie in Bibliotheken wie Open3D, Pandas, SpaCy oder NLTK) und in der Versionsverwaltung mit Git; Erfahrung mit Rust und/oder PyTorch ist von Vorteil
  • Datenbanken & Semantic Web: Umfassende Erfahrung mit relationalen und nicht-relationen Datenbanken (z. B. Neo4j, GraphDB, NoSQL, SQL) und Technologien des Semantic Web (z. B. SPARQL, JSON-LD)
  • DH Standards: Wünschenswert sind Kenntnisse zu Textkodierungsstandards (z. B. TEI-XML) und Metadatenschemata (z. B. Dublin Core, MODS, LIDO) sowie Erfahrung im Umgang mit geisteswissenschaftlichen Daten im Allgemeinem
  • Arbeitsweise: Selbstständiges und strukturiertes Arbeiten, Teamfähigkeit und die Fähigkeit, termingerecht zu arbeiten
  • Sprachkenntnisse: Sehr gute Englischkenntnisse, wünschenswert: Grundkenntnisse des Deutschen

Wir bieten

  • Die Möglichkeit, an der Spitze der Digital und der Computational Humanities zu arbeiten und dabei moderne Methoden der KI und des Data Engineering weiterzuentwickeln und einzusetzen
  • Tätigkeit in einem innovativen Umfeld mit der Möglichkeit zur beruflichen Weiterbildung und Qualifizierung im aufstrebenden Berufsfeld des Research Data Engineering
  • Ein stark kooperatives, interdisziplinäres und internationales Forschungsumfeld
  • Unterstützung bei aktiven Beiträgen zu den Open-Source- und Digital-Humanities-Communities
  • Gute Möglichkeiten zur eigenständigen Forschung und wissenschaftlichen Weiterqualifizierung
  • Flexible Arbeitszeiten und eine gute Work-Life-Balance; Homeoffice-Zeiten sind in Teilzeit möglich
  • Möglichkeiten zur Weiterbildung und zum Aufbau eines beruflichen Netzwerks durch die Teilnahme an nationalen und internationalen Konferenzen
  • Ein engagiertes Team, das sich gegenseitig unterstützt
  • Arbeitsplatz im Herzen der Heidelberger Altstadt mit guter Anbindung an den öffentlichen Nahverkehr
  • Zugang zu den Sportangeboten der Universität
  • Unterstützung der Mobilität der Mitarbeitenden durch ein bezuschusstes Deutschlandticket

Job Description (English)

Responsibilities

  • Bridging the gap between cultural heritage data and advanced computational research: Design and build data storage layers and data processing pipelines that enable our humanities researchers to create and analyze massive, heterogeneous datasets (including legacy data)—ranging from historical texts and archives to multimedia, 3D and spatial data
  • Research Collaboration: Act as the technical consultant for humanities scholars, translating complex research questions into viable computational and database requirements
  • Data Pipelines: Design, implement, and maintain scalable pipelines to ingest, clean, and harmonize diverse cultural heritage and other data and create interoperable datasets for research
  • Data architecture: Design, implement, and maintain data structures and connect to existing data storage layers and infrastructure
  • Semantic Web & Knowledge Graphs: Develop and optimize graph databases, ontologies, and semantic models (e.g., using RDF, OWL, CIDOC-CRM) to interconnect complex historical and cultural data
  • Tool Development & Automation: Build custom APIs, and scripts (primarily in Python) to automate data ingestion, text-mining, and natural language processing (NLP) workflows
  • FAIR and FAIR4RS principles: Collaborate with the Research Data Unit and Scientific Software Center and its Data Science Unit at the IWR, and the University Computing Centre (HPC and storage infrastructure)

Requirements

  • Education & Background: Preferably a PhD, but MA/MSc are encouraged to apply
  • Soft Skills: Strong communication skills to effectively collaborate across interdisciplinary teams of software engineers and traditional humanities scholars
  • Core Tech Stack: Excellent knowledge of Python (plus libraries like Open3D, Pandas, SpaCy, or NLTK) and version control using Git, experience with Rust and/or PyTorch is a plus
  • Database & Semantic Web Skills: Strong experience with databases (e.g., Neo4j, GraphDB, NoSQL, SQL) and semantic web technologies (e.g., SPARQL, JSON-LD)
  • DH Standards: Ideally knowledge of text encoding standards (e.g., TEI-XML) and metadata schemas (e.g., Dublin Core, MODS, LIDO); desirable: Experience with working with humanities’ data
  • Work Style: Independent and structured work style, ability to work in teams and to fixed timelines
  • Language requirements: Very good English language skills, desirable: basic German skills

What We Offer

  • The opportunity to work at the cutting edge of digital and computational humanities using modern AI and data engineering methods
  • Work in an innovative environment with the opportunity of professional training and qualification in the emerging professional field of research data engineering
  • A highly collaborative, interdisciplinary, and international research environment
  • Support for active contributions to the Open Source and Digital Humanities communities
  • Excellent opportunities for independent research and further academic training
  • Flexible working hours and a good work-life balance; part-time remote work is possible
  • Opportunity for further training and building a professional network by participating in national and international conferences
  • A dedicated team that supports each other
  • Workplace in the very Center of Heidelberg Altstadt with good public transport
  • Access to university sports offers
  • Support for employee mobility through a subsidized Deutschlandticket
Schlagworte
Digital HumanitiesResearch Data EngineeringPythonSemantic WebGraphdatenbankenFAIRNLPGitMasterPromotionEnglisch
Deutschlands Stellenbörse für die Wissenschaft
wissenschaftsstellen.de
← Zurück zur Stellenbörse