Construiré pipelines de datos robustas y escalables usando pyspark, databricks y airflow

Parte de la información se ha traducido automáticamente.

India

Hablo Inglés

Ingeniero de datos certificado

Ingeniero de datos orientado a resultados con 4.5 años de experiencia en diseñar, desarrollar, probar, soportar y optimizar pipelines ETL/ELT escalables usando PySpark, Databricks, SQL, Python, Apache...
Acerca de este Servicio

¿Necesitas pipelines de datos escalables y listos para producción? Construyo arquitecturas de datos de alto rendimiento usando Databricks, PySpark, SQL, Apache Airflow y Apache Kafka. Desde ingestión simple de archivos hasta streaming en tiempo real complejo, entrego soluciones en la nube optimizadas y rentables.


Lo que ofrezco:

  • ETL/ELT de extremo a extremo: Pipelines de datos seguros usando PySpark y SQL.
  • Optimización de Databricks: Configuración de Delta Lake, Delta Live Tables (DLT) y Unity Catalog.
  • Orquestación: DAGs automatizados en Apache Airflow con manejo de errores.
  • Streaming en tiempo real: Streaming de eventos con baja latencia mediante Apache Kafka.
  • Optimización del rendimiento: Reducción de costos en la nube con consultas optimizadas.


¿Por qué elegirme?

  • Código limpio, listo para producción y reutilizable.
  • Experiencia en la nube empresarial (AWS / Azure).
  • Documentación arquitectónica gratuita incluida.



Plataforma de destino:

Snowflake

Databricks Lakehouse

Teradata

Herramientas y plataformas:

Fivetran

Kafka Connect