Professional Summary
Senior Data Engineer with extensive background in building resilient cloud data architectures, distributed processing pipelines, and enterprise data lakehouses on AWS.
Demonstrated record in modernizing legacy database infrastructures, establishing data quality standards, and optimizing high-throughput analytics platforms in Germany.
Professional Experience
SpreeMetrics Analytics GmbH
Berlin, Germany
Lead AWS Data Engineer
Mar 2021 – Present
- Architected automated ingestion pipelines using AWS Glue, Amazon EMR, and S3, processing 4.2 TB of daily telematics and transactional data.
- Migrated analytical workloads from legacy on-premises databases to Amazon Redshift, reducing nightly batch processing windows by 38%.
- Standardized data governance and lineage tracking across 14 enterprise datasets using AWS Lake Formation and Apache Iceberg tables.
- Mentored mid-level engineers in Infrastructure as Code best practices utilizing Terraform and AWS CDK.
Kranich Logistik Systeme AG
Berlin, Germany
Senior Data Engineer
Aug 2016 – Feb 2021
- Constructed event-driven streaming pipelines with Amazon Kinesis Data Streams and AWS Lambda for real-time fleet telematics tracking.
- Designed Athena and Amazon S3 lakehouse query patterns that decreased ad-hoc analytics query latency for operations analysts by 45%.
- Implemented automated data validation workflows using Great Expectations integrated into Step Functions and MWAA (Managed Airflow).
Berolina Software Fabrik GmbH
Berlin, Germany
Data Engineer
Apr 2012 – Jul 2016
- Transitioned on-premise relational reporting databases to scalable cloud data warehouses on AWS and PostgreSQL clusters.
- Developed PySpark transformation jobs orchestrated by Apache Airflow to aggregate vendor catalog and inventory updates.
- Maintained high-throughput data access layers supporting internal business intelligence dashboards across 6 regional hubs.
Education
Technische Universität Berlin
Diplom-Informatiker · Computer Science (Informatik) · Berlin, Germany · 1.4 · Oct 1986 – Jun 1992
Specialized in distributed systems, database architectures, and algorithmic data processing.
Technical Projects
Automated Lakehouse Compactor
Apr 2023 – Nov 2023
- Built an open-source data quality auditing framework using PySpark and AWS Glue to validate parquet schema evolution across distributed pipelines.
- Reduced partition scanning overhead on Amazon S3 by introducing Z-order clustering and automated compactions with Apache Iceberg.
Technical Skills
AWS Glue
Amazon Redshift
Amazon EMR
Apache Spark
PySpark
SQL
Python
Terraform
Apache Airflow
AWS Lake Formation
Amazon Kinesis
Languages
German
C2
English
C1
Certifications
AWS Certified Data Engineer - Associate
Amazon Web Services · May 2024
AWS Certified Solutions Architect - Professional
Amazon Web Services · Feb 2025
Volunteering
Berlin Cloud Data Community
Berlin, Germany · Jan 2019 – Dec 2025
- Co-Organizer
- Organized bi-monthly technical community talks focused on distributed computing, cloud ETL design patterns, and big data architectures.