CreaRack-SL

os-audit y backtrack — veracidad del harness y reparación del routing

os-audit y backtrack — veracidad del harness y reparación del routing

Ajuste del harness de la sesión s236 (26-07-2026), adoptado del video de Nate Herk “5 Hacks to Instantly Level Up Your AI OS” (jul-2026) tras analizarlo con /watch. Tres piezas nuevas en claude-method (commit af4892d), usables por cualquier modelo y propagadas a los 3 perfiles: los plugins se leen en vivo del repo y la regla global converge a ~/.claude/rules en el SessionStart.

1. Skill /method:os-audit — ¿sigue siendo verdad tu AI-OS?

Auditoría READ-ONLY de la veracidad del harness del proyecto. La idea de fondo: el router (CLAUDE.md, reglas, índices de memoria, catálogos) es un conjunto de afirmaciones sobre lo que existe y lo que está vigente, y nadie las verificaba — teníamos vigilantes por dominio (method-doctor = paridad de perfiles, wiki-lint = wiki, atlas-check = fichas del Atlas, Widget Salud = grafo) pero ninguno auditaba el router mismo: una ruta muerta citada en CLAUDE.md o una memoria que apunta a un flag retirado no la cazaba nadie hasta que un agente se estrellaba con ella.

Los 5 chequeos: (1) integridad del routing — cada ruta/script/flag/skill citado existe, y a la inversa, nada importante sin rutear; (2) verdad de los índices — entradas vs disco en ambos sentidos, contadores recontados de la fuente viva; (3) frescura — cada feed etiquetado fresco / derivando / congelado / retirado / a-demanda, con git log o mtime, no intuición; (4) bloat y duplicación de las superficies siempre cargadas; (5) colocación del contexto — expertise vs situacional.

El entregable es un informe (audits/os-audit-YYYY-MM-DD.md + resumen en conversación): semáforo por chequeo con el dato que lo justifica, la sección “¿qué te contestaría MAL hoy?” (cada rojo traducido a la pregunta concreta que hoy recibiría respuesta errónea — eso prioriza por daño real, no por lista técnica), lista de fixes a espera de aprobación (con superficie, cambio mínimo y reversión) y sección “En sencillo”. Nunca arregla nada por su cuenta; en proyectos grandes hace fan-out de subagentes de solo-lectura, uno por chequeo.

Cadencia recomendada: mensual, o tras semanas de cambios gordos en el harness, o cuando se acumulen respuestas rancias.

2. Regla global backtrack — el fallo de búsqueda se repara en el mapa

Regla siempre cargada (claude-method/global-rules/backtrack.md → ~/.claude/rules/ de los 3 perfiles). Cuando el agente no encontró algo que SÍ existía (el usuario le corrige, lo encuentra después por otro camino, o tardó demasiado), antes de seguir debe: (1) reconstruir la búsqueda real desde las acciones registradas — no inventar el análisis; (2) nombrar la causa raíz del routing (índice sin entrada, ruta vieja en el router, memoria rancia, sinónimo sin mapear — “no lo vi” no es una causa); (3) reparar el mapa con el fix mínimo o proponerlo si la superficie no es suya. El principio: la corrección no es disculparse ni memorizar “X existe”, es que la próxima búsqueda lo encuentre a la primera. Con válvula anti-ceremonia: tropiezo puntual sin superficie que reparar → decirlo y seguir.

3. Taxonomía de fallos de contexto — vocabulario compartido

references/context-failures.md (dentro de os-audit) fija el vocabulario que ahora usan os-audit, /crearack:self-harness (Paso 1) y cualquier dieta de superficies siempre cargadas:

ModoQué esAntídoto
PoisoningDato falso residente; el agente lo repite con confianzaVerificar contra la fuente viva; corregir EN la superficie envenenada
BloatExceso que entierra lo relevanteDieta; mover lo situacional a just-in-time; segmentar
ConfusionHueco que el agente rellena inventandoCerrar el hueco donde el routing lo encuentre, o declarar que no existe
ClashDos fuentes vigentes se contradicenUna sola fuente de verdad por dato; retirar lo superado

Prioridad al triar: poisoning y clash primero (fabrican respuestas confiadas y falsas). Se completa con la regla de colocación expertise vs situacional: lo que importa en cualquier tarea gana su línea en la superficie siempre cargada (y paga el hueco manteniéndose corto); lo que solo importa trabajando en X vive en el doc de X con el router apuntando.

4. Automatismos del sync nacidos de la corrida #1 (s237 · s239)

La corrida #1 de os-audit (26-07-2026) dejó tres automatismos permanentes en el paso 0 de claude-method/harness/claude-method-sync.ps1 — corren en cada SessionStart de los 3 perfiles.

Semántica de alcance (verificada s239, PC de Dani): el paso 0 actúa sobre el directorio de memoria del proyecto donde arranca la sesión ($RepoRoot → projects/<key>/memory), NO sobre todos los projects/*/memory del perfil. Es convergencia perezosa por proyecto-ancla: el dir de otro proyecto queda tal cual hasta que una sesión arranque allí — e inofensivo, porque esa sesión lo converge en su propio arranque ANTES de que el agente lea ninguna memoria. Encontrar un dir de memoria “sin convergir” (sin índice, sin _archived, con derogadas vivas) en un proyecto donde ese perfil no arranca sesiones es estado esperado, no un bug.

  • Tombstones (s237) — onboarding/shared-memory/_retired.txt lista memorias derogadas; el sync las mueve del perfil a _archived/. Antes una memoria derogada vivía para siempre en los perfiles y el recall semántico la servía con la misma confianza que la vigente. Ojo: la convergencia no es retroactiva — un perfil aplica un paso nuevo del sync en el arranque siguiente al que trajo ese paso (verificado en el perfil de Txell, s238).
  • Aviso anti-huérfanas (s237) — memoria del perfil sin entrada en MEMORY.md ni en ningún *_index.md = warning al arrancar (la corrida #1 encontró 30 acumuladas). Solo avisa; rutear o archivar lo decide la sesión/el humano.
  • Índice auto-generado de compartidas (s239, commit 79902b3) — el sync repartía memorias sin repartir el mapa: en perfiles sin índices manuales (Dani/Txell) las ~153 compartidas salían como huérfanas (154 avisos en el perfil de Txell, s238) y solo eran alcanzables por recall semántico. El paso 0.1b regenera shared_memory_index.md en el perfil (nombre + description: del frontmatter, dedup entre las dos fuentes compartidas, tras filtro de rol, solo si cambia) y el chequeo anti-huérfanas lo cuenta como índice: las compartidas quedan ruteadas por construcción y el aviso vigila solo las personales. El índice NO se carga en contexto (eso es solo MEMORY.md); es superficie de routing a demanda. Verificado E2E el 26-07 en los 3 perfiles: Edu (idempotente), Txell (154→0 avisos), Dani (índice + 9 tombstones en su dir del workspace).

Qué NO se adoptó del video (y por qué)

  • Crons de ingesta de datos — ya lo cubren el Bibliotecario-Ingest y los crons del servidor OPS.
  • Segmentar wikis por corpus — ya operativo (wikis por área/producto).
  • CLAUDE.md como router puro — ya era nuestro diseño desde la dieta s115 (context/ a demanda).
  • El “council de 5 agentes” del patrocinador — es funcionalmente nuestro /method:roast.

Deslindes

  • os-audit no sustituye a method-doctor (paridad instalada del harness), wiki-lint (contenido wiki) ni atlas-check (fichas vs git log): cubre los huecos ENTRE ellos, empezando por el router, y cita sus veredictos en vez de duplicarlos.
  • self-harness mina fallos de conducta y propone parches; os-audit audita veracidad del routing. Los hallazgos reincidentes de os-audit son evidencia de entrada para self-harness.

Véase también

  • [[ia-tech—metodo—claude-method-guide]]
  • [[ia-tech—metodo—harness-engineering]]
  • [[ia-tech—metodo—antesala-y-voz]]
  • [[ia-tech—metodo—fable-handover]]