Construiré pipelines de etl para ingeniería de datos usando apache airflow

Parte de la información se ha traducido automáticamente.

Bangladesh

Hablo Bengalí, Inglés

Data Scientist junior, ingeniero de ML, Python, pipelines ETL

Soy científico de datos e ingeniero de datos, recién graduado en AIUB (CGPA: 3.98/4.00), con una publicación en una conferencia revisada por pares de IEEE y doble certificación en DataCamp, como cient...
Acerca de este Servicio

¿Tu información está en APIs o archivos sin una forma automatizada de recopilarla y almacenarla? Construyo pipelines ETL listos para producción y flujos de trabajo de ingeniería de datos usando Apache Airflow 3, Python y SQL que extraen, transforman y cargan tus datos en un horario, completamente automatizado, sin trabajo manual.


Lo que entrego:

  • Pipeline automatizado con tareas independientes de extracción, transformación y carga
  • Apache Airflow 3 con TaskFlow API y programación diaria
  • Pila de Docker multi-contenedor para un despliegue limpio y reproducible
  • Base de datos PostgreSQL o MySQL con registros estructurados y consultables
  • Código fuente completo entregado vía GitHub


¿Por qué elegirme? Tengo una publicación revisada por pares en una conferencia IEEE, doble certificación en DataCamp (Data Scientist certificado y Associate Data Scientist certificado), y una pasantía de investigación en un laboratorio de IA en Reino Unido. Mi pipeline ETL funciona en producción en vivo, acumulando más de 365 registros estructurados al año sin intervención manual.


Trabajo con: APIs REST y fuentes de datos basadas en archivos, cargando datos en bases de datos SQL como PostgreSQL o MySQL.


Nota: Por favor, envíame un mensaje antes de hacer tu pedido para discutir tu fuente de datos y requisitos.

Plataforma de destino:

Postgresql

mySQL

Herramientas y plataformas:

Otros

Mi porfolio