Monitorearé y depuraré tus pipelines de datos en databricks y pyspark

Parte de la información se ha traducido automáticamente.

Bután

Hablo Inglés

Ingeniero de datos

Soy un ingeniero de datos y software profesional con un historial comprobado en la construcción de arquitecturas de datos robustas y soluciones de software personalizadas. Con experiencia liderando pr...
Acerca de este Servicio

¿Tu pipeline de datos está generando fallos silenciosos, funcionando lentamente o fallando en producción sin advertencia? Diagnóstico y soluciono estos problemas rápidamente.


Soy ingeniero de datos que administra un entorno lakehouse en Databricks en vivo con múltiples clientes a diario. Sé cómo se ve cuando un pipeline está realmente saludable versus cuando acumula problemas silenciosos que luego se convierten en un incidente mayor.


Lo que puedo hacer por ti:

  • Auditar un pipeline existente en busca de cuellos de botella, fallos silenciosos y riesgos de confiabilidad
  • - Depurar un trabajo específico que falla o tiene bajo rendimiento (Databricks, PySpark, Spark SQL)
  • - Configurar monitoreo, alertas y registros para detectar problemas antes de que causen interrupciones
  • - Recomendar soluciones para el diseño del esquema, particionado o estructura del trabajo que causan lentitud
  • - Explicar qué está mal en un lenguaje sencillo, no solo un informe técnico

Este no es un servicio de reconstrucción completa del pipeline, sino un trabajo de diagnóstico y reparación enfocado y dirigido. Si necesitas construir un pipeline desde cero, revisa mi otro gig para eso.


Envíame un mensaje con lo que está fallando (errores, ejecuciones lentas, comportamiento poco claro) y te diré honestamente si puedo ayudarte antes de que hagas tu pedido.

Idioma:

Inglés

Experiencia técnica:

Apache Airflow

•

apache spark

•

Databricks

Experiencia:

Canalización de datos

industria:

Análisis de Datos

•

Servicios financieros

Otros servicios de Ingeniería de datos que ofrezco