Construiré databricks delta lake lakehouse y arquitectura medallion

J
jesseantony
J
jesseantony
Jessay
Parte de la información se ha traducido automáticamente.

Acerca de este Servicio

Traducción automática

¿Quieres construir un data lakehouse moderno y escalable en Databricks? Diseñaré e implementaré un Delta Lake Lakehouse listo para producción con arquitectura Medallion (capas Bronze, Silver, Gold).


Con más de 4 años de experiencia en Publicis Sapient y Alcon construyendo plataformas de datos empresariales, aporto un profundo conocimiento en Databricks, PySpark y Delta Lake.


Lo que construiré para ti:

  • Configuración de Delta Lake con capas medallion optimizadas Bronze/Silver/Gold
  • Pipeline de PySpark para ingestión, transformación y agregación
  • Delta Live Tables (DLT) para pipelines declarativos y de autoescalado
  • Unity Catalog para gobernanza de datos y control de acceso detallado
  • Verificación de calidad de datos, cumplimiento de esquemas y transacciones ACID
  • Integración con ML feature store para flujos de trabajo de aprendizaje automático
  • Optimización del rendimiento: Z-ordering, particionado y compactación de archivos
  • Flujos de trabajo automatizados usando Databricks Jobs y clusters
  • Documentación completa y entrega


Tecnologías: Databricks, PySpark, Delta Lake, Delta Live Tables, Unity Catalog, Azure Data Lake Storage, Apache Spark, SQL


Escríbeme para discutir tus requisitos.

Conoce a Jessay

Jessay

Senior Data Engineer: AWS, Azure, Spark, ETL Pipelines and Data Architecture

  • DeIndia
  • Miembro desdeabr 2025
  • Responde aprox. en:1 hora
  • Última entrega7 meses
  • Idiomas

    Malayalam, Inglés
Struggling with slow pipelines or messy data? I design and build scalable ETL pipelines that deliver real results. With 5+ years on AWS and Azure, I specialize in Databricks, Apache Spark, AWS Glue, and Azure Data Factory. I have built production-grade data warehouses, optimized Spark performance, and integrated Hadoop, Hive, and HBase environments. Stack: Python, PySpark, Scala, SQL, S3, Lambda, Step Functions, Azure Data Lake Gen2, Redshift, PostgreSQL. Ready to turn your raw data into clean, actionable insights.

Traducción automática

Mi porfolio

Etiquetas relacionadas