Construiré pipelines ETL en AWS con airflow, spark y python

Parte de la información se ha traducido automáticamente.

México

Hablo Español, Inglés

Ingeniero de datos sénior

Soy un ingeniero de datos independiente con más de 20 años en TI y más de 10 especializados en plataformas de datos de gran volumen. Diseño, construyo y optimizo pipelines ETL/ELT, lagos de datos resp...
Acerca de este Servicio

Ingeniero de datos senior con más de 10 años creando ETL en producción para clientes de Fortune 500 (Expedia, Ford, HP).

Construyo pipelines de datos confiables y listos para producción en AWS usando Python, PySpark, Airflow y Spark, no scripts desechables. Ingeniería real: particionado, joins de broadcast, orquestación y pruebas.

Historial:

Reducí un trabajo HiveQL de 64 horas a menos de 3 horas (95.6% más rápido)

Migré 500 TB de Hadoop a AWS, completamente validado

Construí y gestioné mi propia plataforma SaaS multi-inquilino de principio a fin

Lo que obtienes: pipelines de código limpio, documentado y desplegable que tu equipo puede mantener, no una caja negra.

Con base en México (superposición de zona horaria con EE. UU.), colaboración en tiempo real durante tus horas laborales. Inglés fluido.

No estás seguro de qué paquete necesitas? Envíame un mensaje primero y lo definiré contigo.

Plataforma de destino:

Amazon Redshift

Postgresql

mySQL

Herramientas y plataformas:

AWS Glue DataBrew

Otros

Mi porfolio