Construiré pipelines de ETL usando databricks y pyspark
Acerca de este Servicio
¿Luchas con datos desordenados, pipelines rotos o paneles que no muestran la verdadera historia? Puedo ayudarte.
Soy un ingeniero de datos con más de 4 años de experiencia práctica en diseñar, construir y optimizar pipelines de datos de extremo a extremo y plataformas de datos en la nube.
LO QUE PUEDO HACER POR TI:
- Construir y orquestar pipelines ETL/ELT usando Apache Airflow
- Diseñar y gestionar almacenes de datos en la nube en Snowflake y Databricks
- Escribir SQL y Python (PySpark) eficientes y de nivel producción para transformación de datos a gran escala
- Migrar flujos de trabajo legados (por ejemplo, Hive/Oozie) a pipelines modernos de Databricks/Airflow
- Limpiar, transformar y modelar datos en bruto en tablas listas para análisis
- Optimizar pipelines existentes para mejorar el rendimiento (particionamiento, caché, cargas incrementales)
- Crear paneles en Power BI, Tableau o Qlik sobre tu pipeline
POR QUÉ TRABAJAR CONMIGO:
- Experiencia en proyectos reales en toda la pila de datos desde la ingesta hasta el panel
- Comunicación clara durante todo el proyecto, no solo entrega de código
- Explico qué construí y por qué, para que nunca te quedes manteniendo una caja negra que no entiendes

