Optimizaré soluciones de datos en sql server, tsql y pyspark
Desarrollador senior de SQL, Data Engineer, TSQL, SSIS, SSRS, PySpark, AWS, 14 años de experiencia
Acerca de este Servicio
Haré ingeniería de big data usando pyspark, hive sql, hdfs y sql
¿Buscas desbloquear el verdadero potencial de tus conjuntos de datos masivos? ¿Necesitas pipelines de datos optimizados y escalables que funcionen sin problemas? ¡Estás en el lugar correcto!
Como un Data Engineer con experiencia, me especializo en construir arquitecturas robustas de Big Data y flujos de trabajo ETL eficientes. Ya sea que necesites limpiar datos desorganizados, migrar arquitecturas o optimizar consultas de búsqueda pesadas, entrego soluciones listas para producción, altamente optimizadas y adaptadas a las necesidades de tu negocio.
️ Servicios que ofrezco:
Optimización de consultas SQL: Escribir consultas relacionales complejas, procedimientos almacenados, ajuste de rendimiento y indexación de bases de datos.
Desarrollo en PySpark: Pipelines ETL personalizados por lotes y en streaming usando RDDs, DataFrames y Spark SQL.
Hive y Hive-SQL: Diseñar esquemas Hive optimizados, tablas externas/gestionadas, particionado, bucketing y escribir consultas Hive-SQL de alto rendimiento.
HDFS y gestión de almacenamiento: Arquitectura de estructuras de almacenamiento distribuidas, gestión de formatos de archivo (Parquet, ORC, Avro) e ingesta de datos.
Pipelines de datos de extremo a extremo: Construir flujos de trabajo escalables para transformar datos brutos en datos limpios y listos para análisis.
