Construiré una pipeline ETL en python para csv, Excel, API y sql
Ingeniero de backend y datos que crea APIs escalables, bases de datos y sistemas ETL
Acerca de este Servicio
Si tus datos son demasiado grandes, desordenados o demasiado manuales en este momento, los automatizaré.
Prueba: construí una pipeline que procesa más de 2 mil millones de filas para una plataforma financiera, y convertí un conjunto de datos en bruto de 7GB y más de 2 millones de documentos en un lago de datos estructurado y buscable en dos semanas, de forma autónoma.
Lo que construyo:
Pipeline ETL personalizada (extraer, limpiar, transformar, cargar)
Grandes conjuntos de datos manejados sin caídas de memoria
Pipeline reanudable e idempotente
Validación de datos y controles de calidad
Carga en PostgreSQL, MySQL o Parquet
Registro y manejo de errores
Configuración de programación/automatización
Fuentes: CSV, Excel, JSON, APIs REST, PostgreSQL, MySQL, SQLite, Parquet.
Envíame una muestra de tus datos y tu objetivo final, y definiré el alcance de la pipeline antes de que hagas el pedido.
pipeline ETL
python
ingeniería de datos
limpieza de datos
automatización
Herramientas y plataformas:
Kafka Connect
•
Otros
Mi porfolio
FAQ
Traducción automática
¿Qué tamaño de conjunto de datos puedes manejar?
He procesado más de 2 mil millones de filas usando técnicas de streaming y chunks.
¿Puede ejecutarse en un horario programado?
Las ejecuciones programadas o activadas están incluidas en los planes Standard o Premium.

