Configuraré agentes de Claude code AI en tu vps con docker
Ingeniero senior de DevOps y seguridad de redes y experto en Linux
Acerca de este Servicio
He estado gestionando flotas de Linux en producción durante años. Configurar agentes de AI no es solo "docker run", se trata de hacer que sobrevivan a reinicios, manejen fallos, se mantengan seguros y no te arruinen la factura de GPU.
Lo que obtienes:
Agente dockerizado Claude Code, OpenHands, AutoGen, o tu agente personalizado en Python/TypeScript, construcción en varias etapas, sin root, verificaciones de salud
Servicio systemd Se inicia al arrancar, se reinicia en caso de fallo, límites de recursos (CPU/RAM/GPU), rotación de logs mediante journald
Proxy inverso Nginx TLS (renovación automática con Let's Encrypt), soporte para WebSocket para streaming, limitación de tasa, opción de autenticación básica
Cola Redis Cola de trabajos con prioridad, reintentos/exponencial backoff, manejo de dead-letter (Estándar/Premium)
Observabilidad Loki + Promtail para logs, métricas Prometheus (profundidad de cola, latencia, uso de tokens), panel de Grafana
Vector DB Qdrant/Weaviate para agentes RAG, volumen persistente, respaldo con cron (Premium)
Guardia de costos Alerta de gasto diario (Discord/Slack/Email), apagado automático si se supera el presupuesto (Premium)
Runbook Arquitectura, guía de escalado, solución de problemas "¿agente atascado?", procedimiento de rotación de credenciales
Pila que uso a diario: Docker, Nginx, systemd, Redis, Loki/Prometheus/Grafana, Qdrant, NVIDIA Container Toolkit, APIs de RunPod/Vast.ai/Lambda, Linux
Mi porfolio
Otros servicios de Ingeniería de DevOps que ofrezco
FAQ
Traducción automática
¿Qué agentes soportas?
Claude Code, OpenHands, AutoGen, CrewAI, LangGraph, agentes personalizados en Python/Node. Cualquier agente en contenedor funciona. Envíame un mensaje con tu repo — confirmaré compatibilidad.
¿Cómo manejas las claves API / secretos?
Nunca en la imagen o en el compose. Opciones: 1) HashiCorp Vault, 2) CLI de 1Password, 3) archivos encriptados con SOPS/age, 4) secretos de Docker (swarm), 5) entornos de GitHub (CI/CD). Elegiremos lo que mejor se adapte a tu flujo de trabajo.
¿Puedes optimizar los costos de GPU?
Solo Premium: alertas de gasto diario (Slack/Discord/Email), apagado automático de agentes inactivos, fallback a instancias spot (RunPod/Vast.ai), seguimiento del uso de tokens por agente. Ahorros típicos: 40-60% frente a siempre encendido.

