Construiré pipelines ETL en Python para tu data warehouse
Practicante de ingeniería de productos
Acerca de este Servicio
Soy estudiante de ingeniería en Ciencias de la Computación con experiencia práctica en la construcción de pipelines ETL y soluciones de ingeniería de datos usando Python, SQL y Databricks. A través de trabajos reales en prácticas, he creado servicios backend y APIs REST que procesan datos a gran escala (más de 120 millones de registros), integré Databricks, Unity Catalog y Delta Tables en flujos de trabajo de producción, y implementé pipelines de validación y limpieza de datos para equipos de ingeniería.
Lo que ofrezco:
diseño y desarrollo de pipelines ETL (extraer, transformar, cargar)
Conectividad con fuentes de datos (bases de datos, APIs, archivos)
Limpieza, formateo y validación de datos
Flujos de trabajo con Databricks y Delta Table
Integración de APIs para flujos de datos automatizados
Código limpio, documentado y reutilizable
Me enfoco en crear pipelines que sean confiables, bien estructurados y fáciles de mantener, no solo scripts rápidos.
Comunico claramente durante todo el proyecto y entrego a tiempo.
Tecnología:
apache spark
•
Java
•
Python
•
R
•
SQL
•
Databricks
Mi porfolio
FAQ
Traducción automática
¿Trabajas con data warehouses diferentes a Databricks?
Databricks es mi principal especialización. Para otras plataformas, envíame un mensaje primero para confirmar si encaja. Pero puedo trabajar en ellas, si me siento cómodo con ello.
¿Obtendré el código fuente?
Sí, incluido en el paquete Premium (o como complemento).
¿Puedes manejar múltiples fuentes de datos?
Sí — los paquetes Standard y Premium soportan múltiples fuentes.
¿Qué información necesitas para empezar?
Tu(s) fuente(s) de datos, el destino o data warehouse, y cualquier lógica de transformación específica.
