Seré tu ingeniero de datos en databricks, azure y gcp

Parte de la información se ha traducido automáticamente.

Pakistán

Hablo Urdu, Inglés

14 pedidos completados

Un ingeniero de datos para resolver problemas complejos

Ingeniero de datos Hola, como ingeniero de datos experto, aporto una gran experiencia en construir y mejorar pipelines de datos de principio a fin. Con una sólida formación en ETL y almacenamiento de...
Acerca de este Servicio

Canales de datos confiables, escalables y nativos de la nube | Especialista en Azure y Databricks

¿Tienes dificultades para mover, transformar o escalar tus datos de manera confiable? Creo canales de datos de extremo a extremo, de grado de producción, que automatizan la ingesta, transformación, validación y despliegue, totalmente nativos de la nube y guiados por CI/CD.

Aporto experiencia práctica en PySpark, Spark SQL, Python, SQL, Databricks, Azure y GCP para convertir datos crudos y desordenados en conjuntos de datos limpios, confiables y listos para análisis.

Lo que ofrezco:

  • Diseño de canales ETL y ELT (batch y streaming)
  • Transformación de datos basada en PySpark y Spark SQL a gran escala
  • Desarrollo en Databricks con Databricks Asset Bundles (DAB) para despliegues repetibles y controlados por versiones
  • Configuración de pipeline CI/CD usando Azure DevOps (compilación, lanzamiento, pruebas automatizadas y despliegue)
  • Integración segura usando Service Principals para autenticación en diferentes entornos
  • Despliegue nativo en la nube: Azure Data Factory, Azure Data Lake, Azure SQL, Databricks, GCP Dataflow, BigQuery
  • Integraciones con API, bases de datos y almacenamiento en la nube
  • Arquitectura de streaming en tiempo real (Kafka / Event Hubs / Pub-Sub)
  • Prácticas completas de DevOps: control de versiones, promoción de entornos

Idioma:

Inglés

Experiencia técnica:

Apache Airflow

apache spark

Databricks

Experiencia:

Canalización de datos

Desarrollo ETL

industria:

Análisis de Datos