Jens Albrecht
Ingeniero de Datos Sénior en AWS | Especialista en Arquitecturas Analíticas y Procesamiento Distribuido
Berlin
Perfil Profesional
Ingeniero de datos sénior con amplia trayectoria en el diseño, despliegue y mantenimiento de arquitecturas de datos a escala empresarial en Amazon Web Services. Especializado en la optimización de canalizaciones distribuidas con Apache Spark, modelado analítico en Amazon Redshift y gestión segura de lagos de datos con AWS Lake Formation. Enfocado en la fiabilidad de infraestructuras críticas, eficiencia operativa de costes y entrega robusta de datos analíticos.
Experiencia Laboral
Novasphere Analytics GmbH
Berlín, Alemania
Ingeniero de Datos Principal en AWS
mar 2021 – Actualidad
- Liderazgo técnico en el diseño e implementación de un lago de datos empresarial sobre Amazon S3, procesando más de 12 TB diarios de telemetría y registros de operaciones.
- Construcción y optimización de canalizaciones ETL/ELT con AWS Glue, Apache Spark y Amazon EMR, reduciendo los tiempos de ingesta en un 38 %.
- Modelado dimensional y gobernanza de almacenamiento analítico en Amazon Redshift, implementando políticas de seguridad mediante AWS Lake Formation y IAM.
- Automatización integral de infraestructura como código mediante Terraform y flujos de trabajo orquestados con Amazon Managed Workflows for Apache Airflow (MWAA).
Kinetix Data Systems AG
Potsdam, Alemania
Ingeniero de Datos Sénior
ago 2016 – feb 2021
- Migración de almacenes de datos heredados en centros de datos locales hacia arquitecturas basadas en Amazon Redshift y Amazon S3.
- Desarrollo de procesos de transmisión en tiempo real utilizando Amazon Kinesis Data Streams y AWS Lambda para el análisis de transacciones financieras.
- Supervisión del rendimiento de consultas SQL y particionamiento en bases de datos analíticas, disminuyendo la latencia de reportes críticos para negocio.
StrataCore Solutions GmbH
Berlín, Alemania
Especialista en Integración de Datos
abr 2012 – jul 2016
- Diseño y mantenimiento de canalizaciones de integración de datos por lotes utilizando Python, SQL y servidores Apache Spark locales y en nube.
- Implementación de controles de calidad automatizados y validaciones de integridad de datos para sistemas de soporte a decisiones.
Educación
Technische Universität Berlin
Diplom-Informatiker (Equivalente a Máster en Informática) · Ciencias de la Computación · Berlín, Alemania · 1,4 (Sehr gut) · oct 1986 – jul 1992
Especialización en sistemas de bases de datos relacionales y estructuras de datos distribuidas.
Proyectos Destacados
Plataforma de Analítica Serverless en Tiempo Real
abr 2023 – nov 2023
- Diseño de una arquitectura sin servidor para enriquecimiento y agregación de flujos de eventos usando Amazon Kinesis, AWS Glue y Amazon Athena.
- Reducción de costos de consulta analítica en un 25 % mediante la conversión eficiente de formatos tabulares a Apache Parquet con partición por fecha y región.
Competencias Técnicas
Amazon Redshift
AWS Glue
Amazon S3
Amazon EMR
Apache Spark
Python
SQL
Terraform
Amazon MWAA
AWS Lake Formation
Modelado Dimensional
Idiomas
Alemán
C2
Inglés
C1
Español
B2
Certificaciones
AWS Certified Data Engineer - Associate
Amazon Web Services · may 2024
AWS Certified Solutions Architect - Professional
Amazon Web Services · feb 2025
Voluntariado
Förderverein Digitale Bildung Berlin
Berlín, Alemania · ene 2022 – dic 2024
- Mentor de Ingeniería de Datos
- Mentoría técnica a jóvenes graduados en diseño de sistemas de datos, buenas prácticas de ingeniería de software y uso de plataformas en la nube.