Seré tu ingeniero de datos para soluciones de databricks pyspark ETL y lakehouse
Acerca de este Servicio
Construiré pipelines de datos robustos y soluciones lakehouse usando Databricks, PySpark, Apache Spark, Spark SQL y Delta Lake.
Lo que puedo construir:
pipelines ETL/ELT en Databricks
Transformaciones de datos con PySpark
Procesamiento de datos en batch
Soluciones Delta Lake
Arquitectura Medallion
Capas de datos Bronze, Silver y Gold
Procesamiento incremental de datos
Limpieza y validación de datos
SCD Tipo 1 / Tipo 2
Modelado de datos y conjuntos de datos listos para análisis
Puedo trabajar con datos estructurados de archivos CSV, APIs, bases de datos y otras fuentes soportadas, transformándolos en conjuntos de datos limpios y confiables para análisis y aplicaciones downstream.
Por favor, contáctame antes de hacer tu pedido para revisar tus requisitos y recomendarte el paquete adecuado.
Mi porfolio
Otros servicios de Ingeniería de datos que ofrezco
FAQ
Traducción automática
¿Debo comunicarme con usted antes de realizar el pedido?
Sí. Por favor, envía tus fuentes de datos, datos de muestra, requisitos de transformación, salida esperada y alcance del proyecto para que pueda recomendarte el paquete adecuado o ofrecerte una propuesta personalizada.
¿Ofreces soluciones completas de principio a fin?
Sí. Para proyectos más grandes, puedo trabajar en ingesta, almacenamiento, transformación, modelado de datos y capas de datos listas para análisis.
¿Con qué fuentes de datos puedes trabajar?
Puedo trabajar con CSV, JSON, Excel, APIs REST y bases de datos relacionales como SQL Server, dependiendo de los requisitos del proyecto.

