Resumen profesional
Ingeniera de datos junior con sólida base en desarrollo de canalizaciones ETL/ELT, procesamiento distribuido y modelado de almacenes de datos. Experiencia práctica optimizando flujos de trabajo con Python, SQL, Apache Spark y entornos en la nube para entregar datos fiables a equipos de analítica.
Experiencia laboral
Kananaskis Cloud Analytics
Calgary, Alberta
Ingeniera de Datos Junior
jun 2024 – Actualidad
- Desarrollo y mantenimiento de canalizaciones de datos por lotes en Apache Spark y Python para integrar fuentes operativas y registros de clientes.
- Implementación de pruebas automatizadas de calidad de datos y validaciones de esquemas en Amazon S3 y Snowflake, reduciendo anomalías de ingesta en un 25%.
- Optimización de consultas SQL y tareas programadas en Apache Airflow, disminuyendo los tiempos de ejecución diarios en 35 minutos.
- Colaboración con analistas de negocio en el diseño de tablas dimensionales siguiendo metodologías Kimball para tableros corporativos.
Prairie Grid Technologies
Calgary, Alberta
Pasante de Ingeniería de Datos
may 2023 – ago 2023
- Automatización de scripts en Python para la extracción semanal de métricas de telemetría desde APIs REST hacia PostgreSQL.
- Creación de documentación técnica de diccionario de datos y diagramas de flujo de linaje para más de 40 tablas operativas.
- Asistencia en la migración de scripts heredados a contenedores Docker para garantizar entornos reproducibles de prueba.
Educación
University of Calgary
Licenciatura en Ciencias · Ciencias de la Computación · Calgary, Alberta, Canadá · 3.7 / 4.0 GPA · sept 2020 – abr 2024
Formación centrada en sistemas distribuidos, bases de datos relacionales y no relacionales, estructuras de datos avanzadas y procesamiento de flujos de datos. Participación activa en el club de computación técnica de la facultad.
Proyectos destacados
Pipeline de analítica de streaming para comercio electrónico
ene 2024 – abr 2024
- Diseño de una arquitectura lakehouse en Delta Lake con ingesta continua de transacciones sintéticas mediante Apache Kafka y PySpark.
- Configuración de transformaciones modulares con dbt para generar capas de datos bronze, silver y gold listas para analítica.
- Despliegue de la infraestructura local a través de Docker Compose para reproducir el flujo completo de prueba de extremo a extremo.
Habilidades técnicas
Python
SQL
Apache Spark
Apache Airflow
Snowflake
dbt
PostgreSQL
Amazon Web Services (AWS)
Docker
Modelado dimensional
Idiomas
Español
C2
Inglés
C1
Certificaciones
Databricks Certified Associate Developer for Apache Spark
Databricks · ago 2024
AWS Certified Data Engineer - Associate
Amazon Web Services · mar 2025
Voluntariado
Calgary Tech Mentorship Collective
Calgary, Alberta · oct 2023 – mar 2024
- Mentora voluntaria de bases de datos
- Organización de sesiones quincenales de tutoría práctica sobre sintaxis básica de SQL y consultas relacionales para 20 estudiantes.
- Revisión de ejercicios de laboratorio y apoyo técnico en la configuración de entornos de desarrollo locales.