Construiré pipelines de datos ETL, ELT con Python, Spark, Airflow y dbt

Parte de la información se ha traducido automáticamente.

Pakistán

Hablo Inglés

Ingeniero de Datos y IA, Python, PySpark, Airflow y ETL en la nube

¿Necesitas datos confiables pero estás atascado con pipelines rotos? Ayudo a las empresas a construir flujos de trabajo ETL/ELT robustos que realmente funcionan. Soy un ingeniero de datos especializad...
Acerca de este Servicio

Sobre este servicio:

¿Necesitas que tus datos se limpien, transformen y fluyan de manera confiable desde la fuente hasta el destino? Construyo pipelines ETL/ELT usando herramientas modernas de ingeniería de datos como Python, PySpark, SQL, Apache Airflow, dbt y Databricks, siguiendo la arquitectura Medallion (Bronze/Silver/Gold) para capas de datos limpias y listas para producción.

Trabajos recientes incluyen un pipeline que ingiere datos en vivo vía API, lo orquesta con Airflow con alertas automáticas de fallos, los transforma mediante más de 10 modelos dbt con más de 60 pruebas de calidad de datos, y los presenta en un dashboard de Power BI además de un pipeline separado en Databricks que procesa datos de comercio electrónico de principio a fin con PySpark.

Lo que ofrezco:

  • Diseño y desarrollo de pipelines ETL/ELT (batch)
  • Limpieza, validación y pruebas de calidad de datos
  • Implementación de la arquitectura Medallion (Bronze/Silver/Gold)
  • Orquestación con Apache Airflow
  • Transformación de datos con dbt, SQL, PySpark
  • Desarrollo de pipelines en Databricks
  • Ingesta de datos vía API
  • Integración de dashboards (Power BI)

Por qué trabajar conmigo:

  • Trabajo real y verificable, cada entregable cuenta con un repositorio público en GitHub
  • Comunicación clara, plazos realistas
  • Código limpio, documentado y de estilo productivo, no scripts desechables

Plataforma de destino:

Postgresql

•

Amazon S3

•

Otros

Herramientas y plataformas:

Azure Data Factory

•

Otros

Mi porfolio