Construiré pipelines de datos en pyspark y databricks

Parte de la información se ha traducido automáticamente.

Sri Lanka

Hablo Tamil, Cingalés, Inglés

Científico de datos

Soy un Científico de Datos que trabaja para una empresa australiana de buena reputación con sede en Sri Lanka, donde desarrollo soluciones basadas en datos y aplicaciones impulsadas por IA. Actualment...
Acerca de este Servicio

¿Necesitas ayuda con tu pipeline de datos?


Construiré un pipeline de datos en PySpark y Databricks limpio y confiable según tus requisitos.


Lo que puedo ayudarte a hacer:

  • Procesamiento de datos en PySpark
  • Limpieza y transformación de datos
  • pipelines ETL/ELT
  • Notebooks y flujos de trabajo en Databricks
  • Spark SQL
  • Procesamiento de datos en CSV, JSON y Parquet
  • Validación de datos y optimización básica


Lo que obtendrás:

  • Pipeline limpio y organizado
  • Código PySpark bien estructurado
  • Código fuente incluido
  • Implementación fácil de entender
  • Documentación básica cuando sea necesario


Puedo trabajar con tus datos existentes o ayudarte a construir un pipeline desde cero.


Por favor, envíame un mensaje antes de ordenar si tu proyecto tiene requisitos específicos o un conjunto de datos grande.

Experiencia:

Big data

•

Flujo de Datos

•

Manipulación de Datos

Tecnología:

apache spark

•

Excel

•

Python

•

SQL

•

Databricks