os-audit y backtrack — veracidad del harness y reparación del routing
Ajuste del harness de la sesión s236 (26-07-2026), adoptado del video de Nate Herk “5 Hacks to Instantly Level Up Your AI OS” (jul-2026) tras analizarlo con
/watch. Tres piezas nuevas enclaude-method(commitaf4892d), usables por cualquier modelo y propagadas a los 3 perfiles: los plugins se leen en vivo del repo y la regla global converge a~/.claude/rulesen el SessionStart.
1. Skill /method:os-audit — ¿sigue siendo verdad tu AI-OS?
Auditoría READ-ONLY de la veracidad del harness del proyecto. La idea de fondo: el router (CLAUDE.md, reglas, índices de memoria, catálogos) es un conjunto de afirmaciones sobre lo que existe y lo que está vigente, y nadie las verificaba — teníamos vigilantes por dominio (method-doctor = paridad de perfiles, wiki-lint = wiki, atlas-check = fichas del Atlas, Widget Salud = grafo) pero ninguno auditaba el router mismo: una ruta muerta citada en CLAUDE.md o una memoria que apunta a un flag retirado no la cazaba nadie hasta que un agente se estrellaba con ella.
Los 5 chequeos: (1) integridad del routing — cada ruta/script/flag/skill citado existe, y a la inversa, nada importante sin rutear; (2) verdad de los índices — entradas vs disco en ambos sentidos, contadores recontados de la fuente viva; (3) frescura — cada feed etiquetado fresco / derivando / congelado / retirado / a-demanda, con git log o mtime, no intuición; (4) bloat y duplicación de las superficies siempre cargadas; (5) colocación del contexto — expertise vs situacional.
El entregable es un informe (audits/os-audit-YYYY-MM-DD.md + resumen en conversación): semáforo por chequeo con el dato que lo justifica, la sección “¿qué te contestaría MAL hoy?” (cada rojo traducido a la pregunta concreta que hoy recibiría respuesta errónea — eso prioriza por daño real, no por lista técnica), lista de fixes a espera de aprobación (con superficie, cambio mínimo y reversión) y sección “En sencillo”. Nunca arregla nada por su cuenta; en proyectos grandes hace fan-out de subagentes de solo-lectura, uno por chequeo.
Cadencia recomendada: mensual, o tras semanas de cambios gordos en el harness, o cuando se acumulen respuestas rancias.
2. Regla global backtrack — el fallo de búsqueda se repara en el mapa
Regla siempre cargada (claude-method/global-rules/backtrack.md → ~/.claude/rules/ de los 3 perfiles). Cuando el agente no encontró algo que SÍ existía (el usuario le corrige, lo encuentra después por otro camino, o tardó demasiado), antes de seguir debe: (1) reconstruir la búsqueda real desde las acciones registradas — no inventar el análisis; (2) nombrar la causa raíz del routing (índice sin entrada, ruta vieja en el router, memoria rancia, sinónimo sin mapear — “no lo vi” no es una causa); (3) reparar el mapa con el fix mínimo o proponerlo si la superficie no es suya. El principio: la corrección no es disculparse ni memorizar “X existe”, es que la próxima búsqueda lo encuentre a la primera. Con válvula anti-ceremonia: tropiezo puntual sin superficie que reparar → decirlo y seguir.
3. Taxonomía de fallos de contexto — vocabulario compartido
references/context-failures.md (dentro de os-audit) fija el vocabulario que ahora usan os-audit, /crearack:self-harness (Paso 1) y cualquier dieta de superficies siempre cargadas:
| Modo | Qué es | Antídoto |
|---|---|---|
| Poisoning | Dato falso residente; el agente lo repite con confianza | Verificar contra la fuente viva; corregir EN la superficie envenenada |
| Bloat | Exceso que entierra lo relevante | Dieta; mover lo situacional a just-in-time; segmentar |
| Confusion | Hueco que el agente rellena inventando | Cerrar el hueco donde el routing lo encuentre, o declarar que no existe |
| Clash | Dos fuentes vigentes se contradicen | Una sola fuente de verdad por dato; retirar lo superado |
Prioridad al triar: poisoning y clash primero (fabrican respuestas confiadas y falsas). Se completa con la regla de colocación expertise vs situacional: lo que importa en cualquier tarea gana su línea en la superficie siempre cargada (y paga el hueco manteniéndose corto); lo que solo importa trabajando en X vive en el doc de X con el router apuntando.
4. Automatismos del sync nacidos de la corrida #1 (s237 · s239)
La corrida #1 de os-audit (26-07-2026) dejó tres automatismos permanentes en el paso 0 de claude-method/harness/claude-method-sync.ps1 — corren en cada SessionStart de los 3 perfiles.
Semántica de alcance (verificada s239, PC de Dani): el paso 0 actúa sobre el directorio de memoria del proyecto donde arranca la sesión ($RepoRoot → projects/<key>/memory), NO sobre todos los projects/*/memory del perfil. Es convergencia perezosa por proyecto-ancla: el dir de otro proyecto queda tal cual hasta que una sesión arranque allí — e inofensivo, porque esa sesión lo converge en su propio arranque ANTES de que el agente lea ninguna memoria. Encontrar un dir de memoria “sin convergir” (sin índice, sin _archived, con derogadas vivas) en un proyecto donde ese perfil no arranca sesiones es estado esperado, no un bug.
- Tombstones (s237) —
onboarding/shared-memory/_retired.txtlista memorias derogadas; el sync las mueve del perfil a_archived/. Antes una memoria derogada vivía para siempre en los perfiles y el recall semántico la servía con la misma confianza que la vigente. Ojo: la convergencia no es retroactiva — un perfil aplica un paso nuevo del sync en el arranque siguiente al que trajo ese paso (verificado en el perfil de Txell, s238). - Aviso anti-huérfanas (s237) — memoria del perfil sin entrada en
MEMORY.mdni en ningún*_index.md= warning al arrancar (la corrida #1 encontró 30 acumuladas). Solo avisa; rutear o archivar lo decide la sesión/el humano. - Índice auto-generado de compartidas (s239, commit
79902b3) — el sync repartía memorias sin repartir el mapa: en perfiles sin índices manuales (Dani/Txell) las ~153 compartidas salían como huérfanas (154 avisos en el perfil de Txell, s238) y solo eran alcanzables por recall semántico. El paso 0.1b regenerashared_memory_index.mden el perfil (nombre +description:del frontmatter, dedup entre las dos fuentes compartidas, tras filtro de rol, solo si cambia) y el chequeo anti-huérfanas lo cuenta como índice: las compartidas quedan ruteadas por construcción y el aviso vigila solo las personales. El índice NO se carga en contexto (eso es soloMEMORY.md); es superficie de routing a demanda. Verificado E2E el 26-07 en los 3 perfiles: Edu (idempotente), Txell (154→0 avisos), Dani (índice + 9 tombstones en su dir del workspace).
Qué NO se adoptó del video (y por qué)
- Crons de ingesta de datos — ya lo cubren el Bibliotecario-Ingest y los crons del servidor OPS.
- Segmentar wikis por corpus — ya operativo (wikis por área/producto).
- CLAUDE.md como router puro — ya era nuestro diseño desde la dieta s115 (
context/a demanda). - El “council de 5 agentes” del patrocinador — es funcionalmente nuestro
/method:roast.
Deslindes
os-auditno sustituye amethod-doctor(paridad instalada del harness),wiki-lint(contenido wiki) niatlas-check(fichas vs git log): cubre los huecos ENTRE ellos, empezando por el router, y cita sus veredictos en vez de duplicarlos.self-harnessmina fallos de conducta y propone parches;os-auditaudita veracidad del routing. Los hallazgos reincidentes de os-audit son evidencia de entrada para self-harness.
Véase también
- [[ia-tech—metodo—claude-method-guide]]
- [[ia-tech—metodo—harness-engineering]]
- [[ia-tech—metodo—antesala-y-voz]]
- [[ia-tech—metodo—fable-handover]]