Parece que este servicio está en espera

Diseñaré modelos de big data y pipelines de ETL usando pyspark y databricks

Parte de la información se ha traducido automáticamente.

India

Hablo Hindi, Gujarati, Inglés

34 pedidos completados

Experto en ingeniería de datos y arquitecto de soluciones en la nube

Ingeniero de datos en Azure con más de 13 años creando soluciones de datos escalables usando Microsoft Fabric, Azure Data Factory (ADF), Azure Data Lake y Synapse Analytics. También trabajo con Snowfl...
Acerca de este Servicio

Procesa petabytes de datos a velocidad vertiginosa con modelos optimizados de PySpark y pipelines de Databricks que escalan infinitamente.


¿Abrumado por conjuntos de datos masivos que colapsan sistemas tradicionales? ¿Necesitas procesamiento en tiempo real que maneje miles de millones de registros sin esfuerzo? Has encontrado a tu arquitecto de big data.


Lo que obtendrás:

  • Modelos y transformaciones de datos escalables en PySpark
  • Configuraciones optimizadas de clústeres de Databricks
  • Arquitectura Delta Lake para transacciones ACID
  • Pipelines de procesamiento en tiempo real y por lotes
  • Consultas Spark SQL ajustadas para rendimiento
  • Estrategias de optimización de costos y configuración de monitoreo


Mi experiencia en Big Data:

Con más de 13 años diseñando soluciones en Spark, he construido pipelines que procesan más de 500 TB diarios para gigantes tecnológicos, logrando mejoras de rendimiento de 10 veces mediante técnicas avanzadas de optimización y ajuste de clústeres.


Tecnologías que domino:

  • Plataformas: Databricks, Apache Spark, Delta Lake, MLflow
  • Lenguajes: PySpark, Scala, Spark SQL, Python
  • Optimización: Catalyst optimizer, particionado, estrategias de caching

Idioma:

Inglés

Experiencia técnica:

apache spark

Databricks

Snowflake

Experiencia:

Canalización de datos

Desarrollo ETL

industria:

Análisis de Datos

Servicios financieros