Construiré pipelines de datos ETL con pyspark y databricks

Parte de la información se ha traducido automáticamente.

Nepal

Hablo Nepalí, Hindi, Inglés

Ingeniero de datos

Soy ingeniero de datos y backend con más de 5 años de experiencia creando pipelines ETL escalables, plataformas de datos en la nube y sistemas backend robustos. Mi experiencia abarca Python, PySpark, ...
Acerca de este Servicio

Hola, soy Arbind Sah y puedo ayudarte a crear pipelines de ETL escalables, procesar Big Data o optimizar sistemas en la nube.

Me especializo en Python, SQL y herramientas nativas de la nube para agilizar la integración de datos, la automatización y el análisis para empresas de todos los tamaños.


En qué puedo ayudarte:

-Diseño y optimización de pipelines de ETL y datos usando PySpark y Databricks para una transformación de datos confiable y lista para producción. Soluciones Utiliza Redshift, BigQuery, Spark y Databricks para manejar conjuntos de datos masivos de manera eficiente.

-Infraestructura en la nube: Crear y gestionar infraestructura en AWS (EC2, RDS, S3, Lambda) y GCP, incluyendo despliegues en contenedores con Docker.

-Optimización y seguridad de bases de datos: Mejorar el rendimiento de consultas, implementar seguridad robusta y garantizar el cumplimiento con los estándares de la industria.

-Migración de datos y reconciliación de esquemas: Migrar y consolidar datos en PostgreSQL, MySQL y plataformas en la nube, manejando incompatibilidades de tipos, valores nulos y mapeo complejo de esquemas.


Con un fuerte enfoque en computación en la nube, automatización de datos y análisis, aseguro soluciones de datos escalables, seguras y de alto rendimiento.

Conéctate conmigo para optimizar tus flujos de datos y lograr la máxima eficiencia.

Plataforma de destino:

Google BigQuery

Databricks Lakehouse

Herramientas y plataformas:

Airbyte

AWS Glue DataBrew

Mi porfolio