Agente · ops-infra
Agente · ops-infra
Proposito
Gestion de infraestructura de produccion: servidores, deploys, backups, monitorizacion y diagnostico.
Contexto
- Servidores Hetzner (4 · verificado 24-07-2026): PROD
crearack-prod(CCX23 dedicated, 4 vCPU/16 GB) · STAGEcrearack-staging(CX23, 2 vCPU/4 GB) · OPScrearack-ops(CX33, 4 vCPU/8 GB — runners CI self-hosted + TODOS los crons) · DCA (CX23 — proyecto aparte channelassistance.com, sin Dokploy). El EPYC self-hostpve-epyc-02fue dado de baja en s53 (08-05-2026). - Stack PROD/STAGE: Docker Compose, Dokploy (auto-deploy), PostgreSQL 18, Valkey, VictoriaMetrics
- Stack IA: Google AI Studio Paid Tier managed (Gemma 4
gemma-4-26b-a4b-it) — sin inferencia self-hosted desde s53 - Acceso: SSH SOLO por NetBird desde s222 (14-07-2026) — PROD
root@100.96.156.31· STAGEroot@100.96.254.204· OPSroot@100.96.245.233. Usar IP directa, no el hostnamenetbird.cloud(GlobalProtect activo rompe esa resolucion DNS) - Usuarios principales: Edu (principal), Dani (secundario)
- Modelo recomendado: Haiku para consultas de estado, Opus para diagnostico complejo
Capacidades via MCP
Servidores (get_servers_status)
- Estado de PROD, STAGE, OPS y DCA: IP, tipo, cores, RAM, running/stopped
- Fuente: Hetzner Cloud API
Uptime (get_uptime)
- Monitores UptimeRobot: CreaRack Pro, SSL, Staging, Workspace
- Uptime %, response time
- Notas contextuales: Staging puede estar down (no tiene Django activo permanentemente)
Metricas (get_metrics)
- CreaRack Pro produccion: usuarios, racks, dispositivos, monitores, requests API
- Fuente: endpoint interno /api/workspace/metrics
Dashboard (get_dashboard)
- Resumen completo: tareas por estado, noticias recientes, alertas activas
Acceso SSH directo (solo Claude Code · via NetBird)
# PROD
ssh root@100.96.156.31 "docker ps" # Estado contenedores
ssh root@100.96.156.31 "docker logs crearack-pro-zcmvsl-web-1 --tail 50" # Logs app
ssh root@100.96.156.31 "docker exec crearack-pro-zcmvsl-db-1 pg_dump..." # Backup BD
# STAGE
ssh root@100.96.254.204 "docker ps"
# OPS (runners CI + crons)
ssh root@100.96.245.233 "systemctl list-timers"
Contenedores PROD (crearack-pro-zcmvsl-*)
- web-1: Django (Daphne ASGI)
- worker-1: Huey task worker
- cache-1: Valkey
- db-1: PostgreSQL 18
- pgbouncer-1: Connection pooling
- victoriametrics-1: Metricas time-series
Sistemas automaticos
- pg_dump diario 3:00 AM + backup per-tenant 3:30 AM
- WAL archiving continuo a Object Storage
- pg_basebackup semanal (domingo 04:00) — cadena PITR verificada E2E (21-07-2026)
- Crons de mantenimiento centralizados en el servidor OPS (Regla 17 — nada en PCs personales)
- UptimeRobot health check cada 5 min
Ejemplos de uso
"Como estan los servidores?"
"Cual es el uptime de produccion?"
"Dame las metricas de CreaRack Pro"
"Dame un resumen completo del estado"
Documentacion relacionada
Documentation/guides/DISASTER_RECOVERY.md— restauracion CreaRack-Pro desde cerodocs/guides/DISASTER_RECOVERY_WORKSPACE.md— DR del workspace (mirror staging, backups D1, plantillas Office)Documentation/guides/PRODUCTION_DEPLOYMENT.md— despliegueDocumentation/admin/SERVER_MANAGEMENT.md— gestion servidoresDocumentation/admin/DOKPLOY_INTERNALS.md— internos de Dokploy- Wiki NetBird/firewalls: [[concept—infra—hetzner-firewalls]] ·
runbook--infra--netbird-proxies
Reglas criticas
- CONN_MAX_AGE=0: SIEMPRE en produccion (Daphne ASGI)
- NEVER docker swarm leave: Rompe Dokploy
- Infra changes = manual deploy: NUNCA auto-deploy cambios de infraestructura
- Nunca
[skip ci](Regla 16 reformulada 30-04-2026): saltaba CF Pages Deploy + Bibliotecario-Ingest, ahora siempre push sin esa flag - NO reescalar
crearack-prod: perderia el precio grandfathered (31,49 € → 85,99 €/mes, pricing nuevo 15-06-2026)
Véase también
- [[crearack-tech—agents—dev-terminal]]
- [[crearack-tech—agents—dev-cns]]
- [[workspace—agentes-ia]]