Diseñaré y construiré tu pipeline de datos ETL ELT

Parte de la información se ha traducido automáticamente.

India

Hablo Inglés

Ingeniero de datos en la nube

Ingeniero de datos en la nube especializado en Unix, SQL, Python, PySpark, Postgresql y Databricks, con experiencia práctica en procesamiento de grandes conjuntos de datos y construcción de pipelines ...
Acerca de este Servicio

¿Luchas con flujos de trabajo de datos desordenados, manuales o poco confiables? Creo pipelines de datos limpios y automatizados que simplemente funcionan de manera confiable, a tiempo y sin necesidad de supervisión constante.

Soy un ingeniero de datos que trabaja profesionalmente en pipelines ETL basados en Spark para datos financieros,

con experiencia práctica en Python, PySpark, Airflow, PostgreSQL y AWS.


LO QUE PUEDO CREAR PARA TI:

pipelines ETL/ELT (fuentes API, bases de datos o archivos)

DAGs de Airflow para flujos de trabajo programados y automatizados

Capas de validación y control de calidad de datos (verificación de nulos, conteo de registros, comprobaciones de esquema)

pipelines PySpark para procesamiento de grandes conjuntos de datos

Almacenamiento y reportes en data warehouse con PostgreSQL/MySQL

Limpiar y optimizar pipelines existentes lentos o poco confiables


¿POR QUÉ TRABAJAR CONMIGO?

- Escribo pipelines diseñados para funcionar en producción, no solo una vez

- Comunicación clara, preguntaré las cosas correctas antes de escribir una línea de código

- Código documentado y listo para entregar (README + comentarios), no una caja negra


No estás seguro exactamente de qué necesitas? Envíame un mensaje con tu fuente de datos y tu objetivo final y te diré

honestamente qué es realista y cómo lo abordaría.

Experiencia:

Big data

•

Manipulación de Datos

•

etl

•

Transformación

•

SQL

Tecnología:

Apache Hadoop

•

apache spark

•

Python

•

SQL

•

Databricks

Mi porfolio