Wolfgang Becker
Senior AWS Data Engineer | Cloud Data Warehousing & ETL-Architektur
Berlin
Profil
Senior Data Engineer mit fundiertem Schwerpunkt auf stabilen Cloud-Datenarchitekturen, verteilter Datenverarbeitung und analytischen Plattformen im AWS-Ökosystem. Langjährige Praxis im Aufbau skalierbarer Data Lakes, serverloser Integrationsstrecken sowie strukturierter Data Warehouses.
Fokussiert auf saubere Datenmodellierung, Performance-Optimierung von ETL-Pipelines und reproduzierbare Infrastruktur nach modernen DataOps-Standards.
Berufserfahrung
Novaris Data Systems GmbH
Berlin
Senior AWS Data Engineer
Apr. 2020 – Heute
- Konzeption und Realisierung eines zentralen unternehmensweiten Data Lakes auf Amazon S3 und AWS Glue für täglich über 35 Terabyte heterogene Log- und Transaktionsdaten.
- Entwicklung performanter ETL-Pipelines mit PySpark und Apache Airflow zur automatisierten Transformation und Beladung von Amazon Redshift.
- Implementierung von Data-Governance- und Zugriffskonzepten über AWS Lake Formation sowie automatisierte Absicherung sensibler Finanzdaten.
- Umstellung der Analyse- und Speicherumgebungen auf Infrastructure as Code mit Terraform zur Gewährleistung konsistenter Multi-Account-Deployments.
Kallisto Analytics AG
Berlin
Cloud Data Engineer
Aug. 2015 – März 2020
- Migration gewachsener On-Premise-Data-Warehouse-Strukturen in eine skalierbare Cloud-Architektur auf Basis von Amazon Redshift und Amazon EMR.
- Aufbau echtzeitnaher Streaming-Pipelines mittels Amazon Kinesis Data Streams und AWS Lambda zur Auswertung von Telemetriedaten.
- Optimierung komplexer analytischer Abfragen und Tabellenverteilungsschlüssel in Redshift, wodurch Batch-Verarbeitungszeiten im Monatsabschluss um 40 % sanken.
Syntec Logistik Software GmbH
Berlin
Datenbankentwickler & DWH-Spezialist
Feb. 2011 – Juli 2015
- Modellierung relationaler Datenbanken und Entwicklung von Batch-ETL-Strecken für mandantenfähige Flottenmanagementsysteme.
- Einführung automatisierter Datenqualitätsprüfungen und Leistungsüberwachung für geschäftskritische Berichtsschnittstellen.
Ausbildung
Technische Universität Berlin
Diplom-Informatiker · Informatik · Berlin · 1,7 · Okt. 1986 – Juni 1992
Vertiefung in Verteilte Systeme, Datenbankentwurf und parallele Informationsverarbeitung an der Fakultät für Elektrotechnik und Informatik.
Ausgewählte Projekte
Optimierter S3-Parquet-Exporter für Spark
Feb. 2023 – Sept. 2023
- Entwicklung eines Open-Source-Konnektors zur effizienten Partitionierung und Komprimierung großer Zeitreihendatensätze im Parquet-Format auf Amazon S3.
- Durchführung von Benchmark-Tests zur I/O-Optimierung bei Abfragen über Amazon Athena und Trino.
Fachliche Schwerpunkte
AWS Glue
Amazon Redshift
Amazon S3
Amazon EMR
Apache Spark
Apache Airflow
Python
SQL
Terraform
AWS Lambda
AWS Lake Formation
Sprachen
Deutsch
C2
Englisch
C1
Zertifizierungen
AWS Certified Data Analytics – Specialty
Amazon Web Services · Mai 2025
AWS Certified Solutions Architect – Professional
Amazon Web Services · Feb. 2024
Ehrenamtliches Engagement
MINT-Zukunft Berlin e.V.
Berlin · Okt. 2019 – Nov. 2024
- Mentor für Datenverarbeitung
- Leitung praxisorientierter Einführungskurse zu SQL und Grundlagen der relationalen Datenmodellierung für Quereinsteiger.