Volver a la wiki

os-audit y backtrack — veracidad del harness y reparación del routing

os-audit y backtrack — veracidad del harness y reparación del routing

Ajuste del harness de la sesión s236 (26-07-2026), adoptado del video de Nate Herk “5 Hacks to Instantly Level Up Your AI OS” (jul-2026) tras analizarlo con /watch. Tres piezas nuevas en claude-method (commit af4892d), usables por cualquier modelo y propagadas a los 3 perfiles: los plugins se leen en vivo del repo y la regla global converge a ~/.claude/rules en el SessionStart.

1. Skill /method:os-audit — ¿sigue siendo verdad tu AI-OS?

Auditoría READ-ONLY de la veracidad del harness del proyecto. La idea de fondo: el router (CLAUDE.md, reglas, índices de memoria, catálogos) es un conjunto de afirmaciones sobre lo que existe y lo que está vigente, y nadie las verificaba — teníamos vigilantes por dominio (method-doctor = paridad de perfiles, wiki-lint = wiki, atlas-check = fichas del Atlas, Widget Salud = grafo) pero ninguno auditaba el router mismo: una ruta muerta citada en CLAUDE.md o una memoria que apunta a un flag retirado no la cazaba nadie hasta que un agente se estrellaba con ella.

Los 5 chequeos: (1) integridad del routing — cada ruta/script/flag/skill citado existe, y a la inversa, nada importante sin rutear; (2) verdad de los índices — entradas vs disco en ambos sentidos, contadores recontados de la fuente viva; (3) frescura — cada feed etiquetado fresco / derivando / congelado / retirado / a-demanda, con git log o mtime, no intuición; (4) bloat y duplicación de las superficies siempre cargadas; (5) colocación del contexto — expertise vs situacional.

El entregable es un informe (audits/os-audit-YYYY-MM-DD.md + resumen en conversación): semáforo por chequeo con el dato que lo justifica, la sección “¿qué te contestaría MAL hoy?” (cada rojo traducido a la pregunta concreta que hoy recibiría respuesta errónea — eso prioriza por daño real, no por lista técnica), lista de fixes a espera de aprobación (con superficie, cambio mínimo y reversión) y sección “En sencillo”. Nunca arregla nada por su cuenta; en proyectos grandes hace fan-out de subagentes de solo-lectura, uno por chequeo.

Cadencia recomendada: mensual, o tras semanas de cambios gordos en el harness, o cuando se acumulen respuestas rancias.

2. Regla global backtrack — el fallo de búsqueda se repara en el mapa

Regla siempre cargada (claude-method/global-rules/backtrack.md → ~/.claude/rules/ de los 3 perfiles). Cuando el agente no encontró algo que SÍ existía (el usuario le corrige, lo encuentra después por otro camino, o tardó demasiado), antes de seguir debe: (1) reconstruir la búsqueda real desde las acciones registradas — no inventar el análisis; (2) nombrar la causa raíz del routing (índice sin entrada, ruta vieja en el router, memoria rancia, sinónimo sin mapear — “no lo vi” no es una causa); (3) reparar el mapa con el fix mínimo o proponerlo si la superficie no es suya. El principio: la corrección no es disculparse ni memorizar “X existe”, es que la próxima búsqueda lo encuentre a la primera. Con válvula anti-ceremonia: tropiezo puntual sin superficie que reparar → decirlo y seguir.

3. Taxonomía de fallos de contexto — vocabulario compartido

references/context-failures.md (dentro de os-audit) fija el vocabulario que ahora usan os-audit, /crearack:self-harness (Paso 1) y cualquier dieta de superficies siempre cargadas:

ModoQué esAntídoto
PoisoningDato falso residente; el agente lo repite con confianzaVerificar contra la fuente viva; corregir EN la superficie envenenada
BloatExceso que entierra lo relevanteDieta; mover lo situacional a just-in-time; segmentar
ConfusionHueco que el agente rellena inventandoCerrar el hueco donde el routing lo encuentre, o declarar que no existe
ClashDos fuentes vigentes se contradicenUna sola fuente de verdad por dato; retirar lo superado

Prioridad al triar: poisoning y clash primero (fabrican respuestas confiadas y falsas). Se completa con la regla de colocación expertise vs situacional: lo que importa en cualquier tarea gana su línea en la superficie siempre cargada (y paga el hueco manteniéndose corto); lo que solo importa trabajando en X vive en el doc de X con el router apuntando.

4. Automatismos del sync nacidos de la corrida #1 (s237 · s239)

La corrida #1 de os-audit (26-07-2026) dejó tres automatismos permanentes en el paso 0 de claude-method/harness/claude-method-sync.ps1 — corren en cada SessionStart de los 3 perfiles.

Semántica de alcance (verificada s239, PC de Dani): el paso 0 actúa sobre el directorio de memoria del proyecto donde arranca la sesión ($RepoRoot → projects/<key>/memory), NO sobre todos los projects/*/memory del perfil. Es convergencia perezosa por proyecto-ancla: el dir de otro proyecto queda tal cual hasta que una sesión arranque allí — e inofensivo, porque esa sesión lo converge en su propio arranque ANTES de que el agente lea ninguna memoria. Encontrar un dir de memoria “sin convergir” (sin índice, sin _archived, con derogadas vivas) en un proyecto donde ese perfil no arranca sesiones es estado esperado, no un bug.

Qué NO se adoptó del video (y por qué)

Deslindes

Véase también

Subir