Configuraré el monitoreo y las alertas de prometheus grafana para tus servidores
AWS DevOps y SRE, 7 años, Kubernetes CKA, Terraform, CICD
Acerca de este Servicio
Descubrir que tu servidor estuvo caído por un cliente no es la mejor forma de enterarse. Déjame configurar un monitoreo que te avise primero.
Senior DevOps / SRE, más de 7 años en Zoom, Airtel, Infosys y Mindtree. Me encargo de la atención en línea para más de 150 hosts Linux y multi-cluster EKS con un tiempo de actividad superior al 99%, usando Prometheus, Grafana, Datadog y PagerDuty todos los días. Certificado: CKA, AWS Solutions Architect, AWS SysOps, Terraform.
LO QUE CONFIGURO
Prometheus con node exporter, cAdvisor y exportadores de servicios
Tableros de Grafana que muestran lo que realmente importa, no 40 paneles inútiles
Reglas de Alertmanager dirigidas a Slack, correo electrónico o PagerDuty
Loki para logs centralizados, buscables junto a tus métricas
Monitoreo de Kubernetes: pods, nodos, despliegues, presión de recursos
Alarmas de AWS CloudWatch donde encajan mejor que Prometheus
POR QUÉ IMPORTA
Las alertas que se activan constantemente se ignoran. Ajusto los umbrales para que cada alerta signifique que algo está realmente mal y necesita atención humana.
CÓMO TRABAJO
Primer paso: dime qué usas y qué te ha causado problemas antes.
Segundo paso: confirmo el alcance y qué debe alertar. La consulta es gratuita.
Tercer paso: pila de trabajo lista, alertas ajustadas y un runbook por alerta.
Envíame un mensaje con tu configuración para una consulta gratuita.
Herramientas:
Docker
•
Kubernetes
•
Amazon EKS
•
Otros
Marcos:
Terraform
•
Ansible
Proveedor de la nube:
Amazon Web Services
Lenguaje de programación:
Bash
•
Python
Experiencia:
Instalación
•
Depuración de código
•
Configuración

