Construiré pipelines de datos en pyspark y databricks

Parte de la información se ha traducido automáticamente.

India

Hablo Hindi, Inglés, Francés, Español

Ingeniero de datos empresarial que crea pipelines automatizados y optimiza SQL

Ingeniero de datos | Python | SQL | ETL | Spark Construyo pipelines de datos listos para producción, flujos de trabajo ETL y soluciones de datos usando Python, SQL, PySpark, Apache Spark, Airflow, Dat...
Acerca de este Servicio

¿Necesitas ayuda para procesar grandes conjuntos de datos con PySpark o Databricks?


Construiré pipelines de datos escalables usando PySpark, Apache Spark y Databricks para transformación, procesamiento y análisis de datos.


Puedo ayudarte con:

  • Transformaciones y limpieza de datos con PySpark
  • Notebooks y flujos de trabajo en Databricks
  • Desarrollo de pipelines ETL/ELT
  • Procesamiento de datos a gran escala
  • Uniones, agregaciones, filtrado y deduplicación
  • Procesamiento incremental y por lotes
  • Validación de datos y controles de calidad
  • Optimización del rendimiento
  • Cargar datos en data warehouses y bases de datos

Me enfoco en pipelines limpios, fáciles de mantener y eficientes, con documentación clara.


Contáctame antes de hacer un pedido para proyectos complejos, así puedo entender tus datos y requisitos.

Plataforma de almacenes:

Snowflake

•

Azure Synapse

•

Databricks

Tipo de proyecto:

Nueva creación

Mi porfolio

Otros servicios de Ingeniería de datos que ofrezco