Diseñaré y construiré tu pipeline de datos ETL ELT
Ingeniero de datos en la nube
Acerca de este Servicio
¿Luchas con flujos de trabajo de datos desordenados, manuales o poco confiables? Creo pipelines de datos limpios y automatizados que simplemente funcionan de manera confiable, a tiempo y sin necesidad de supervisión constante.
Soy un ingeniero de datos que trabaja profesionalmente en pipelines ETL basados en Spark para datos financieros,
con experiencia práctica en Python, PySpark, Airflow, PostgreSQL y AWS.
LO QUE PUEDO CREAR PARA TI:
pipelines ETL/ELT (fuentes API, bases de datos o archivos)
DAGs de Airflow para flujos de trabajo programados y automatizados
Capas de validación y control de calidad de datos (verificación de nulos, conteo de registros, comprobaciones de esquema)
pipelines PySpark para procesamiento de grandes conjuntos de datos
Almacenamiento y reportes en data warehouse con PostgreSQL/MySQL
Limpiar y optimizar pipelines existentes lentos o poco confiables
¿POR QUÉ TRABAJAR CONMIGO?
- Escribo pipelines diseñados para funcionar en producción, no solo una vez
- Comunicación clara, preguntaré las cosas correctas antes de escribir una línea de código
- Código documentado y listo para entregar (README + comentarios), no una caja negra
No estás seguro exactamente de qué necesitas? Envíame un mensaje con tu fuente de datos y tu objetivo final y te diré
honestamente qué es realista y cómo lo abordaría.
