Volver a la wiki

Auditoría Suprema 2 · Cola monitoring D: rendimiento de deep-discovery y de Wireless/UPS

Cuándo

04-09-2026 · commit 7b1025166 (PR #499, v1.107.0). Task #286 — cola MEDIA de la Auditoría Suprema 2 en monitoring, bloque D: cambia de foco de sondas/validación (ver [[incident—20260904—auditoria-suprema-2-cola-monitoring-a-sondas-y-targets]]) a rendimiento del deep-discovery y de las páginas Wireless/UPS. Cuatro hallazgos MEDIA, 15 tests nuevos.

Síntomas visibles

Cuatro hallazgos MEDIA en el mismo commit:

  1. D-#10 — El progreso del job de deep-discovery (done/failed/status en Valkey) se actualizaba con un cache.get + cache.set sin bloqueo. El Agente Local manda hasta 5 resultados en paralelo (max_concurrent); dos escrituras concurrentes se pisaban y el job se quedaba clavado sin llegar nunca a completed.
  2. D-#11 — El enlace automático de un perfil descubierto a su Device (Rack Editor) recorría TODOS los devices de la organización, deserializando management_config uno a uno en Python — sin límite y sin excluir los racks en papelera.
  3. D-#40 — Un SAI con el ping filtrado, o con ping_enabled=False y solo SNMP, salía unknown/offline y sin métricas de batería/carga aunque estuviera publicando datos SNMP frescos ahora mismo: UPS solo miraba mt.last_status, sin el mismo salvavidas de “evidencia viva” que Wireless ya tenía desde la auditoría #261.
  4. D-#41 — get_ups_summary/get_ups_status_list y sus gemelos de Wireless cargaban deep_snmp_data (un blob JSON de 20-60 KB por equipo real) de TODA la flota en cada refresco, aunque el dato vivo de VictoriaMetrics ya bastara para responder casi siempre — refrescos cada 2 minutos por pestaña, la mayoría del blob descartado sin usar.

Causa raíz

Fix aplicado

Commit 7b1025166 (PR #499):

Lecciones

Preventivos futuros

Véase también

Subir