Construiré pipelines de ETL usando databricks y pyspark

Parte de la información se ha traducido automáticamente.

India

Hablo Inglés

Ingeniero de datos

Ingeniero de datos con más de 4 años de experiencia en construir pipelines escalables de ETL/ELT y plataformas de datos en la nube. Hábil en Databricks, Snowflake, Apache Airflow, PySpark, SQL y Pytho...
Acerca de este Servicio

¿Luchas con datos desordenados, pipelines rotos o paneles que no muestran la verdadera historia? Puedo ayudarte.


Soy un ingeniero de datos con más de 4 años de experiencia práctica en diseñar, construir y optimizar pipelines de datos de extremo a extremo y plataformas de datos en la nube.


LO QUE PUEDO HACER POR TI:

- Construir y orquestar pipelines ETL/ELT usando Apache Airflow

- Diseñar y gestionar almacenes de datos en la nube en Snowflake y Databricks

- Escribir SQL y Python (PySpark) eficientes y de nivel producción para transformación de datos a gran escala

- Migrar flujos de trabajo legados (por ejemplo, Hive/Oozie) a pipelines modernos de Databricks/Airflow

- Limpiar, transformar y modelar datos en bruto en tablas listas para análisis

- Optimizar pipelines existentes para mejorar el rendimiento (particionamiento, caché, cargas incrementales)

- Crear paneles en Power BI, Tableau o Qlik sobre tu pipeline


POR QUÉ TRABAJAR CONMIGO:

- Experiencia en proyectos reales en toda la pila de datos desde la ingesta hasta el panel

- Comunicación clara durante todo el proyecto, no solo entrega de código

- Explico qué construí y por qué, para que nunca te quedes manteniendo una caja negra que no entiendes


Idioma:

Inglés

Experiencia técnica:

dbt (herramienta de modelado de datos)

Experiencia:

Canalización de datos

Desarrollo ETL

industria:

Análisis de Datos

Mi porfolio