Construiré pipelines escalables de ETL en databricks usando pyspark sql

Parte de la información se ha traducido automáticamente.

India

Hablo Inglés

Ingeniero de datos y creador de sistemas de IA, con 10 años de experiencia

Soy Arun, ingeniero de datos y consultor de IA con más de 10 años de experiencia en la creación de plataformas de datos escalables, soluciones de análisis y aplicaciones de IA. Me especializo en pipel...
Acerca de este Servicio

¿Necesitas un pipeline confiable de Databricks en lugar de notebooks frágiles y procesamiento manual de datos?


Soy ingeniero de datos con 9 años de experiencia profesional en la creación de pipelines ETL, plataformas de datos y soluciones analíticas. Trabajo con Databricks, PySpark, Spark SQL, Delta Lake, Python y servicios de datos en la nube para convertir datos en bruto en conjuntos de datos limpios y listos para análisis.

Puedo ayudarte con:

  • Notebooks de Databricks usando PySpark y Spark SQL
  • Desarrollo de pipelines ETL y ELT por lotes
  • Arquitectura lakehouse de Bronze, Silver y Gold
  • Tablas Delta Lake, MERGE y cargas incrementales
  • Limpieza, transformación y validación de datos
  • Configuración de workflows y trabajos
  • Depuración y mejoras de rendimiento
  • Comentarios claros en el código y documentación técnica


Recibirás código fuente mantenible, lógica de pipeline claramente definida y documentación práctica para operar la solución.


Por favor, envíame un mensaje por Fiverr antes de ordenar el paquete Premium o cualquier proyecto que involucre acceso a producción, streaming, configuración de infraestructura, datos sensibles o una fecha límite urgente.

Plataforma de almacenes:

Snowflake

BigQuery

Databricks

Tipo de proyecto:

Nueva creación

Mi porfolio