CreaRack-SL

Agente · ops-infra

Conceptoactiveverificado 2026-04-15

Agente · ops-infra

Proposito

Gestion de infraestructura de produccion: servidores, deploys, backups, monitorizacion y diagnostico.

Contexto

  • Servidores Hetzner (4 · verificado 24-07-2026): PROD crearack-prod (CCX23 dedicated, 4 vCPU/16 GB) · STAGE crearack-staging (CX23, 2 vCPU/4 GB) · OPS crearack-ops (CX33, 4 vCPU/8 GB — runners CI self-hosted + TODOS los crons) · DCA (CX23 — proyecto aparte channelassistance.com, sin Dokploy). El EPYC self-host pve-epyc-02 fue dado de baja en s53 (08-05-2026).
  • Stack PROD/STAGE: Docker Compose, Dokploy (auto-deploy), PostgreSQL 18, Valkey, VictoriaMetrics
  • Stack IA: Google AI Studio Paid Tier managed (Gemma 4 gemma-4-26b-a4b-it) — sin inferencia self-hosted desde s53
  • Acceso: SSH SOLO por NetBird desde s222 (14-07-2026) — PROD root@100.96.156.31 · STAGE root@100.96.254.204 · OPS root@100.96.245.233. Usar IP directa, no el hostname netbird.cloud (GlobalProtect activo rompe esa resolucion DNS)
  • Usuarios principales: Edu (principal), Dani (secundario)
  • Modelo recomendado: Haiku para consultas de estado, Opus para diagnostico complejo

Capacidades via MCP

Servidores (get_servers_status)

  • Estado de PROD, STAGE, OPS y DCA: IP, tipo, cores, RAM, running/stopped
  • Fuente: Hetzner Cloud API

Uptime (get_uptime)

  • Monitores UptimeRobot: CreaRack Pro, SSL, Staging, Workspace
  • Uptime %, response time
  • Notas contextuales: Staging puede estar down (no tiene Django activo permanentemente)

Metricas (get_metrics)

  • CreaRack Pro produccion: usuarios, racks, dispositivos, monitores, requests API
  • Fuente: endpoint interno /api/workspace/metrics

Dashboard (get_dashboard)

  • Resumen completo: tareas por estado, noticias recientes, alertas activas

Acceso SSH directo (solo Claude Code · via NetBird)

# PROD
ssh root@100.96.156.31 "docker ps"                                          # Estado contenedores
ssh root@100.96.156.31 "docker logs crearack-pro-zcmvsl-web-1 --tail 50"    # Logs app
ssh root@100.96.156.31 "docker exec crearack-pro-zcmvsl-db-1 pg_dump..."    # Backup BD

# STAGE
ssh root@100.96.254.204 "docker ps"

# OPS (runners CI + crons)
ssh root@100.96.245.233 "systemctl list-timers"

Contenedores PROD (crearack-pro-zcmvsl-*)

  • web-1: Django (Daphne ASGI)
  • worker-1: Huey task worker
  • cache-1: Valkey
  • db-1: PostgreSQL 18
  • pgbouncer-1: Connection pooling
  • victoriametrics-1: Metricas time-series

Sistemas automaticos

  • pg_dump diario 3:00 AM + backup per-tenant 3:30 AM
  • WAL archiving continuo a Object Storage
  • pg_basebackup semanal (domingo 04:00) — cadena PITR verificada E2E (21-07-2026)
  • Crons de mantenimiento centralizados en el servidor OPS (Regla 17 — nada en PCs personales)
  • UptimeRobot health check cada 5 min

Ejemplos de uso

"Como estan los servidores?"
"Cual es el uptime de produccion?"
"Dame las metricas de CreaRack Pro"
"Dame un resumen completo del estado"

Documentacion relacionada

  • Documentation/guides/DISASTER_RECOVERY.md — restauracion CreaRack-Pro desde cero
  • docs/guides/DISASTER_RECOVERY_WORKSPACE.md — DR del workspace (mirror staging, backups D1, plantillas Office)
  • Documentation/guides/PRODUCTION_DEPLOYMENT.md — despliegue
  • Documentation/admin/SERVER_MANAGEMENT.md — gestion servidores
  • Documentation/admin/DOKPLOY_INTERNALS.md — internos de Dokploy
  • Wiki NetBird/firewalls: [[concept—infra—hetzner-firewalls]] · runbook--infra--netbird-proxies

Reglas criticas

  • CONN_MAX_AGE=0: SIEMPRE en produccion (Daphne ASGI)
  • NEVER docker swarm leave: Rompe Dokploy
  • Infra changes = manual deploy: NUNCA auto-deploy cambios de infraestructura
  • Nunca [skip ci] (Regla 16 reformulada 30-04-2026): saltaba CF Pages Deploy + Bibliotecario-Ingest, ahora siempre push sin esa flag
  • NO reescalar crearack-prod: perderia el precio grandfathered (31,49 € → 85,99 €/mes, pricing nuevo 15-06-2026)

Véase también

  • [[crearack-tech—agents—dev-terminal]]
  • [[crearack-tech—agents—dev-cns]]
  • [[workspace—agentes-ia]]