Construiré pipelines de datos ETL en python y automatizaré flujos de trabajo de datos
Ingeniero de datos
Acerca de este Servicio
¿Buscas pipelines de datos ETL/ELT robustos, escalables y automatizados? Ayudo a las empresas a extraer, limpiar, transformar y cargar sus datos sin problemas en bases de datos modernas y almacenes de datos en la nube.
Con más de 2 años de experiencia práctica en Ingeniería de Datos, me especializo en construir flujos de trabajo de datos confiables y tolerantes a fallos usando Python, SQL y AWS.
Lo que puedo hacer por ti:
Pipelines ETL/ELT personalizados: Ingesta automatizada desde APIs REST, webhooks, bases de datos o archivos planos (CSV/JSON/Parquet).
Almacenamiento de datos en la nube: Diseño de esquemas, modelado y carga en Snowflake, AWS
Optimización y ajuste de consultas: Acelerar consultas SQL lentas y solucionar cuellos de botella en el rendimiento.
Orquestación de flujos de trabajo: Programación, mapeo de dependencias y alertas automáticas usando Apache Airflow.
Streaming de datos en tiempo real: Pipelines en casi tiempo real usando Apache Kafka.
Calidad de datos y pruebas automatizadas: Implementación de validaciones y pruebas unitarias con pytest para prevenir corrupción de datos.
Pila tecnológica y herramientas:
Lenguajes: Python, SQL
Bases de datos y almacenes: Snowflake, MySQL
Nube y Big Data: AWS (S3), Kafka, Airflow
Por favor, envíame un mensaje con el formato de tus datos y los requisitos del proyecto antes de hacer un pedido.
Plataforma de destino:
Snowflake
•
Amazon S3
Herramientas y plataformas:
Otros
FAQ
Traducción automática
¿Qué detalles necesitas de mí antes de comenzar?
Por favor, proporciona una descripción breve de los requisitos de tu proyecto, archivos de datos de entrada o esquemas de muestra, detalles de la base de datos o destino, y las credenciales API o permisos de acceso necesarios.
¿En qué herramientas y tecnologías te especializas?
Me especializo en Python y SQL para construir scripts automatizados de ingesta y transformación de datos, y flujos de trabajo en bases de datos. Trabajo ampliamente con APIs REST, archivos planos (CSV, JSON, Excel) y bases de datos relacionales.
¿Qué pasa si mis requisitos no encajan en los paquetes predefinidos?
No hay problema. Cada arquitectura de datos es única. Envíame un mensaje explicando tu configuración, y crearé una Oferta Personalizada adaptada a tu alcance y plazo exactos.
¿Cómo garantizas la precisión de los datos y la fiabilidad del pipeline?
Implemento reglas de validación de esquemas, controles de calidad de datos, manejo de casos extremos (como null o duplicados) y pruebas unitarias automatizadas para asegurar que el pipeline funcione de manera confiable sin fallar en silencio.
¿Proporcionas documentación y soporte después de la entrega?
Sí. Cada entrega completa incluye documentación clara de configuración y comentarios en el código para que puedas mantener y operar fácilmente el pipeline en el futuro.

