Soy ingeniero de confiabilidad de sitios/DevOps con más de 4 años de experiencia práctica en producción construyendo infraestructura que escala sin fallar a las 3 de la mañana.
Lo que realmente he construido en producción:
- Migraciones AWS sin tiempo de inactividad (cambio de Elastic IP entre cuentas, delegación DNS en Route53, reconfiguración de NLB) con automatización de rollback
- Canales CI/CD usando CDK/CodePipeline y GitHub Actions con escaneo de seguridad automatizado
- Clústeres EKS con almacenamiento respaldado por FSx y recuperación ante desastres, reduciendo el tiempo de inactividad en un 90%
- Monitoreo con CloudWatch/Prometheus cubriendo más de 15 modos de fallo con registros estructurados y alertas en múltiples períodos
- Infraestructura provisionada con Terraform para una incorporación segura y repetible del entorno
- Automatización personalizada en Go y Python para orquestación de infraestructuras (por ejemplo, una capa proxy SFTP personalizada)
Lo que aporto de mis propios sistemas (construidos y gestionados de forma independiente):
- Plataformas Kubernetes auto-sanantes con GitOps (ArgoCD), política como código (Kyverno) y ingeniería de caos (AWS FIS) probadas contra un SLA de recuperación de 10 minutos
- Detección de seguridad en tiempo de ejecución usando Falco con respuesta a incidentes automatizada y con puntuación de severidad
- Un operador de Kubernetes desde cero (Go, CRDs personalizados, controller-runtime) para gestión de flotas
- Multi-cl