Parece que este servicio está en espera

Haré etl en pyspark

Parte de la información se ha traducido automáticamente.

Pakistán

Hablo Inglés, Alemán

6 pedidos completados

Soy un ingeniero de datos con pasión por transformar datos sin procesar en información significativa. Tengo experiencia en el diseño, la construcción y el mantenimiento de canales de datos escalables ...
Acerca de este Servicio

Crearé un pipeline ETL (Extracción, Transformación y Carga) para usted en Pyspark. Según sus preferencias, puedo crear el pipeline ETL en AWS Glue o Databricks usando el código de Pyspark.


Con Pyspark, obtendré datos de la fuente, ya sea una base de datos, una API o datos almacenados en un depósito de AWS S3 o un lago de datos de Azure.

Una vez que los datos se cargan desde la fuente al área de almacenamiento, los transformaré de acuerdo con su lógica comercial y los cargaré en su área de destino.

El área de destino puede ser un lago de datos como un bucket S3, un almacén de datos como Redshift o algún otro lugar.