Databricks, Data Lead/Engineer/Architect, Artificial Intelligence, Data Science, Business Intelligence, Data Mesh, Data Lakehouse, Cloud (Azure/GCP)
Aktualisiert am 19.06.2026
Profil
Freiberufler / Selbstständiger
Remote-Arbeit
Verfügbar ab: 01.07.2026
Verfügbar zu: 100%
davon vor Ort: 100%
Databricks
Apache Spark
Data Engineer
Azure
GCP
Machine Learning
Python
SQL
PySpark
LLM
PyTorch

Einsatzorte

Einsatzorte

München (+75km)
Deutschland, Schweiz, Österreich
möglich

Projekte

Projekte

2 Jahre 10 Monate
2023-09 - heute

Data Analytics Plattform auf Kubernetes & Spark

Sr. Data/AI Engineer Spark NiFi Kubernetes ...
Sr. Data/AI Engineer
  • Implementierung von skalierbaren Spark-Pipelines auf Kubernetes
  • Entwurf von Pipeline in NiFi zur Datenintegration


Gefahrguterkennung und automatische Label-Bereinigung

  • Entwicklung eines Transformer-basierten Modells zur Identifizierung von Gefahrstogen aus Textetiketten.
  • Implementierung eines ResNet-Objekterkennungsmodells zur automatischen Reinigung von IBC-Platten.


Databricks Unity Catalog Migration

  • Teilautomatisierte Migration von über 500 Azure Databricks Workspaces zum Unity Catalog.


Ausgabenmanager

  • Erstellung einer Mobil- und Web-App zur Verwaltung von Ausgaben aus Rechnungen und Belegen.
  • Entwicklung von KI-Modellen zur Entitätsextraktion aus Dokumenten und Fotos.

Spark NiFi Kubernetes GCP Python PyTorch Transformers (Hugging Face) ResNet Computer Vision Docker Azure DevOps Pulumi Databricks API SQL ReactJS (Web/Mobile) Python (Backend) OCR/Vision-Modelle Cloud Services (GCP)
auf Anfrage
4 Jahre 9 Monate
2019-01 - 2023-09

verschiedene Projekte

Sr. Solutions Architect & Manager Azure Databricks Delta Lake MLflow ...
Sr. Solutions Architect & Manager

Datenplattform

Kunde: Munich RE


Aufgaben:

  • Zusammenarbeit mit dem Plattform-Team zur Architekturgestaltung der Azure Databricks Integration. 
  • Unterstützung diverser Teams bei ihren Anwendungsfällen und ML-Operations.


Rohstoffpreisprognose

Kunde: Nestlé


Aufgaben:

  • Unterstützung des Projektteams bei der Optimierung des XGBoost-Modells durch Feature Engineering und parallele Berechnungen.


SAP Integration 

Kunde: Henkel


Aufgaben:

  • Entwicklung und Optimierung einer Databricks-basierten ETL-Pipeline zur Integration von SAP ERP-Informationen in den Data Lake. 
  • Sicherstellung der erforderlichen Geschwindigkeits- und Qualitätsstandards.

Azure Databricks Delta Lake MLflow Python Cloud Security/IAM XGBoost PySpark Pandas Scikit-learn Databricks Spark/PySpark SAP-Konnektoren Data Lake Storage (ADLS) SQL
diverse
1 Jahr 10 Monate
2017-03 - 2018-12

Data Intelligence

Solution Advisor CoE SAP Data Intelligence Kubernetes (K8s) Docker ...
Solution Advisor CoE

  • Verantwortlich für MVPs, Präsentationen, Demos und Beratung zur SAP Data Intelligence Plattform.
  • SAP Young-Thinkers Ambassador und Leiter der SIG Big Data Kubernetes.

SAP Data Intelligence Kubernetes (K8s) Docker Kafka Python
SAP
2 Jahre 11 Monate
2014-06 - 2017-04

Implementierung mehrerer Big-Data-Projekte

Sr. Systems Architect Hadoop Ökosystem (HDFS YARN) Spark ...
Sr. Systems Architect
  • Leitung der Implementierung mehrerer Big-Data-Projekte für Großunternehmen weltweit.  
  • Awards auf Anfrage
Hadoop Ökosystem (HDFS YARN) Spark Hive Kafka Distributed Computing
Hortonworks Inc.
1 Jahr 5 Monate
2013-01 - 2014-05

Aufbau einer neuen Machine-Learning-Pipeline

AI & Data Engineer Python Scikit-learn (SVM) AWS (Cloud) ...
AI & Data Engineer
  • Aufbau einer neuen Machine-Learning-Pipeline, die Daten aus verschiedenen Online-Quellen kombiniert.
  • Verantwortlich für verteiltes (Cloud-basiertes) Web-Crawling, analytisches Backend und Datenbereinigungsaufgaben.
  • Entitätsauflösung basierend auf SVM-Klassifikation.
Python Scikit-learn (SVM) AWS (Cloud) Web Crawling Frameworks SQL
TrustYou GmbH
1 Jahr 7 Monate
2011-06 - 2012-12

Entwicklung eines Systems

Software Engineer Java Hadoop Cassandra (NoSQL) ...
Software Engineer
  • Mitwirkung an der Entwicklung eines Systems zur Speicherung und Analyse von Daten von Websites wie YouTube, Google und eBay.
  • Evaluierung mehrerer Hadoop-Distributionen und des NoSQL-Datenspeichers Cassandra.
Java Hadoop Cassandra (NoSQL) MapReduce
GfK
1 Jahr 5 Monate
2009-01 - 2010-05

Data Integration

Java SQL Algorithmen zur Datenintegration
  • Entitätsauflösung
  • Objektabgleich
  • Deduplizierung
  • Datenextraktion und -integration
Java SQL Algorithmen zur Datenintegration
WDI Lab (University of Leipzig)

Aus- und Weiterbildung

Aus- und Weiterbildung

  • Diplm. Informatiker
  • Hortonworks Certified Apache Hadoop Developer 2.0
  • Coursera ? Getting and Cleaning Data
  • Coursera ? R Programming
  • Coursera ? The Data Scientist?s Toolbox

Kompetenzen

Kompetenzen

Top-Skills

Databricks Apache Spark Data Engineer Azure GCP Machine Learning Python SQL PySpark LLM PyTorch

Produkte / Standards / Erfahrungen / Methoden

Databricks
Big Data
Microsoft Azure
Python
Spark
R
AWS
GCP
Java
Kafka

Profil

  • Dem Freiberufler verbindet tiefes technisches Fachwissen mit praktischer Projekterfahrung über den gesamten KI/ML-Lebenszyklus hinweg. Seine nachgewiesene Erfolgsbilanz umfasst:
    • Transformer-basierte Modelle zur Erkennung von Gefahrgut.
    • Computer-Vision-Lösungen (ResNet, R-CNN).
    • Skalierbare ML-Pipelines in Cloud-Umgebungen.
  • Mit umfassender Erfahrung sowohl im klassischen maschinellen Lernen (SVM, XGBoost) als auch im modernen Deep Learning (Transformer, LLMs) entwirft er End-to-End-Lösungen von der Datenaufnahme bis zur Bereitstellung.
  • Seine Führungserfahrung bei großen Technologieunternehmen wie Databricks und SAP unterstreicht seine Fähigkeit, KI-Lösungen auf Enterprise-Niveau zu liefern.
  • Expertise in MLOps, verteiltem Rechnen und Cloud-Plattformen gewährleistet robuste, skalierbare Implementierungen.


Technische Fähigkeiten

Data & ML Technologien:

  • PyTorch 
  • Transformers 
  • (Py)Spark 
  • Kafka


Plattformen:

  • GCP 
  • Azure 
  • AWS 
  • Databricks 
  • Hadoop 

Programmiersprachen

Python
SQL
Java
JavaScript
ReactJS

Einsatzorte

Einsatzorte

München (+75km)
Deutschland, Schweiz, Österreich
möglich

Projekte

Projekte

2 Jahre 10 Monate
2023-09 - heute

Data Analytics Plattform auf Kubernetes & Spark

Sr. Data/AI Engineer Spark NiFi Kubernetes ...
Sr. Data/AI Engineer
  • Implementierung von skalierbaren Spark-Pipelines auf Kubernetes
  • Entwurf von Pipeline in NiFi zur Datenintegration


Gefahrguterkennung und automatische Label-Bereinigung

  • Entwicklung eines Transformer-basierten Modells zur Identifizierung von Gefahrstogen aus Textetiketten.
  • Implementierung eines ResNet-Objekterkennungsmodells zur automatischen Reinigung von IBC-Platten.


Databricks Unity Catalog Migration

  • Teilautomatisierte Migration von über 500 Azure Databricks Workspaces zum Unity Catalog.


Ausgabenmanager

  • Erstellung einer Mobil- und Web-App zur Verwaltung von Ausgaben aus Rechnungen und Belegen.
  • Entwicklung von KI-Modellen zur Entitätsextraktion aus Dokumenten und Fotos.

Spark NiFi Kubernetes GCP Python PyTorch Transformers (Hugging Face) ResNet Computer Vision Docker Azure DevOps Pulumi Databricks API SQL ReactJS (Web/Mobile) Python (Backend) OCR/Vision-Modelle Cloud Services (GCP)
auf Anfrage
4 Jahre 9 Monate
2019-01 - 2023-09

verschiedene Projekte

Sr. Solutions Architect & Manager Azure Databricks Delta Lake MLflow ...
Sr. Solutions Architect & Manager

Datenplattform

Kunde: Munich RE


Aufgaben:

  • Zusammenarbeit mit dem Plattform-Team zur Architekturgestaltung der Azure Databricks Integration. 
  • Unterstützung diverser Teams bei ihren Anwendungsfällen und ML-Operations.


Rohstoffpreisprognose

Kunde: Nestlé


Aufgaben:

  • Unterstützung des Projektteams bei der Optimierung des XGBoost-Modells durch Feature Engineering und parallele Berechnungen.


SAP Integration 

Kunde: Henkel


Aufgaben:

  • Entwicklung und Optimierung einer Databricks-basierten ETL-Pipeline zur Integration von SAP ERP-Informationen in den Data Lake. 
  • Sicherstellung der erforderlichen Geschwindigkeits- und Qualitätsstandards.

Azure Databricks Delta Lake MLflow Python Cloud Security/IAM XGBoost PySpark Pandas Scikit-learn Databricks Spark/PySpark SAP-Konnektoren Data Lake Storage (ADLS) SQL
diverse
1 Jahr 10 Monate
2017-03 - 2018-12

Data Intelligence

Solution Advisor CoE SAP Data Intelligence Kubernetes (K8s) Docker ...
Solution Advisor CoE

  • Verantwortlich für MVPs, Präsentationen, Demos und Beratung zur SAP Data Intelligence Plattform.
  • SAP Young-Thinkers Ambassador und Leiter der SIG Big Data Kubernetes.

SAP Data Intelligence Kubernetes (K8s) Docker Kafka Python
SAP
2 Jahre 11 Monate
2014-06 - 2017-04

Implementierung mehrerer Big-Data-Projekte

Sr. Systems Architect Hadoop Ökosystem (HDFS YARN) Spark ...
Sr. Systems Architect
  • Leitung der Implementierung mehrerer Big-Data-Projekte für Großunternehmen weltweit.  
  • Awards auf Anfrage
Hadoop Ökosystem (HDFS YARN) Spark Hive Kafka Distributed Computing
Hortonworks Inc.
1 Jahr 5 Monate
2013-01 - 2014-05

Aufbau einer neuen Machine-Learning-Pipeline

AI & Data Engineer Python Scikit-learn (SVM) AWS (Cloud) ...
AI & Data Engineer
  • Aufbau einer neuen Machine-Learning-Pipeline, die Daten aus verschiedenen Online-Quellen kombiniert.
  • Verantwortlich für verteiltes (Cloud-basiertes) Web-Crawling, analytisches Backend und Datenbereinigungsaufgaben.
  • Entitätsauflösung basierend auf SVM-Klassifikation.
Python Scikit-learn (SVM) AWS (Cloud) Web Crawling Frameworks SQL
TrustYou GmbH
1 Jahr 7 Monate
2011-06 - 2012-12

Entwicklung eines Systems

Software Engineer Java Hadoop Cassandra (NoSQL) ...
Software Engineer
  • Mitwirkung an der Entwicklung eines Systems zur Speicherung und Analyse von Daten von Websites wie YouTube, Google und eBay.
  • Evaluierung mehrerer Hadoop-Distributionen und des NoSQL-Datenspeichers Cassandra.
Java Hadoop Cassandra (NoSQL) MapReduce
GfK
1 Jahr 5 Monate
2009-01 - 2010-05

Data Integration

Java SQL Algorithmen zur Datenintegration
  • Entitätsauflösung
  • Objektabgleich
  • Deduplizierung
  • Datenextraktion und -integration
Java SQL Algorithmen zur Datenintegration
WDI Lab (University of Leipzig)

Aus- und Weiterbildung

Aus- und Weiterbildung

  • Diplm. Informatiker
  • Hortonworks Certified Apache Hadoop Developer 2.0
  • Coursera ? Getting and Cleaning Data
  • Coursera ? R Programming
  • Coursera ? The Data Scientist?s Toolbox

Kompetenzen

Kompetenzen

Top-Skills

Databricks Apache Spark Data Engineer Azure GCP Machine Learning Python SQL PySpark LLM PyTorch

Produkte / Standards / Erfahrungen / Methoden

Databricks
Big Data
Microsoft Azure
Python
Spark
R
AWS
GCP
Java
Kafka

Profil

  • Dem Freiberufler verbindet tiefes technisches Fachwissen mit praktischer Projekterfahrung über den gesamten KI/ML-Lebenszyklus hinweg. Seine nachgewiesene Erfolgsbilanz umfasst:
    • Transformer-basierte Modelle zur Erkennung von Gefahrgut.
    • Computer-Vision-Lösungen (ResNet, R-CNN).
    • Skalierbare ML-Pipelines in Cloud-Umgebungen.
  • Mit umfassender Erfahrung sowohl im klassischen maschinellen Lernen (SVM, XGBoost) als auch im modernen Deep Learning (Transformer, LLMs) entwirft er End-to-End-Lösungen von der Datenaufnahme bis zur Bereitstellung.
  • Seine Führungserfahrung bei großen Technologieunternehmen wie Databricks und SAP unterstreicht seine Fähigkeit, KI-Lösungen auf Enterprise-Niveau zu liefern.
  • Expertise in MLOps, verteiltem Rechnen und Cloud-Plattformen gewährleistet robuste, skalierbare Implementierungen.


Technische Fähigkeiten

Data & ML Technologien:

  • PyTorch 
  • Transformers 
  • (Py)Spark 
  • Kafka


Plattformen:

  • GCP 
  • Azure 
  • AWS 
  • Databricks 
  • Hadoop 

Programmiersprachen

Python
SQL
Java
JavaScript
ReactJS

Vertrauen Sie auf Randstad

Im Bereich Freelancing
Im Bereich Arbeitnehmerüberlassung / Personalvermittlung

Fragen?

Rufen Sie uns an +49 89 500316-300 oder schreiben Sie uns:

Das Freelancer-Portal

Direktester geht's nicht! Ganz einfach Freelancer finden und direkt Kontakt aufnehmen.