Los siete pecados de los agentes de IA
Por qué casi todo framework responde a los fallos de los agentes con más proceso humano — y por qué ontoref los gradúa con gates que se verifican solos
Los agentes de IA no fallan al azar. Fallan de forma sistemática — siempre los mismos siete vicios, y todos sobreviven a la prueba de “parece correcto”:
- Soberbia de validación — los tests pasan porque el agente los ajustó a su solución, no porque la solución sea correcta.
- Contagio de sesgo — el revisor hereda el contexto del ejecutor y confirma su error en vez de atacarlo.
- Pereza de corrección — el feedback es débil; el sistema no converge, solo se detiene.
- Glotonería de validación — tanta verificación inútil que nadie distingue la señal del ruido.
- Idolatría de evidencia falsa — logs y métricas que no prueban nada se tratan como garantía.
- Avaricia de óptimo local — correcto contra los tests, frágil contra el mundo.
- Confusión de roles — el ejecutor reinterpreta el objetivo, el revisor edita en vez de juzgar; nadie decide qué es cierto.
El arreglo obvio — y por qué se queda corto
Ante esto, el instinto es añadir proceso. Un PEP. Un KEP. Una plantilla con “Rejected Ideas” obligatorio, fases alpha→beta→GA, un comité de revisión. Es buena ingeniería de propuestas, y conviene mirarla de cerca, porque cada uno aporta una primitiva que sí carga peso:
- PEP optimiza la memoria de la decisión: no puedes aceptar una propuesta sin documentar qué descartaste y por qué.
- KEP optimiza el compromiso escalonado: no avanzas de alpha a beta porque “ya está”, sino porque cumples criterios que declaraste de antemano.
El problema no es el proceso. Es que cada fase de graduación termina apoyándose en un humano que la aprueba. Y la velocidad del agente supera al humano que pones en la puerta. El gate se atasca antes de que puedas contratar al siguiente revisor. Los pecados #1 y #5 —la validación soberbia y la evidencia falsa— no se arreglan con más juicio humano: se arreglan quitando al humano de la ruta crítica.
Lo que ontoref ya hace — el gate como invariante, no como reunión
Una decisión en ontoref es un ADR: un fichero tipado, no un acta. Y para ascender
de Proposed a Accepted no pasa por un comité — pasa por gates que se ejecutan
solos:
- Contra el pecado #5 (evidencia falsa).
adr-accepted-has-proof: ningún ADR llega aAcceptedsi no está citado por una Proof del posicionamiento. La graduación exige evidencia referencial, comprobable por máquina, no la palabra de nadie. - Contra el pecado #1 (validación soberbia). Las restricciones de cada ADR no son
prosa: son checks tipados —
Grep,Cargo,NuCmd,ApiCall,FileExists— que el modovalidate-projectdispara y que fallan en rojo si la realidad se desvía. No puedes ajustar el test a la solución: el test es la solución declarada. - Contra el pecado #7 (roles confusos). El criterio que gradúa está sujeto a una disciplina: debe ser decidible y leer un slice acotado del estado. Un validador que pretenda juzgar “verdad” en vez de estructura se rechaza por contrato. El que juzga no improvisa: solo puede afirmar lo que un slice finito demuestra.
- Contra los pecados #3 y #6 (no converge / óptimo local). Las tensiones nombradas y la disciplina ondaod impiden colapsar un dilema arquitectónico eligiendo un polo para “cerrar el ticket”. La decisión registra la síntesis, no el atajo.
ontoref contra PEP y KEP — qué hereda y qué rebasa
| Primitiva | PEP | KEP | ontoref (ADR) |
|---|---|---|---|
| Alternativas rechazadas obligatorias | sí | sí | sí (alternatives_considered, required) |
| Graduación por criterio pre-declarado | no | sí (humano) | sí, witnessed y decidible |
| Criterio acotado y verificable por máquina | no | no | sí (slice + decidibilidad) |
| Restricciones ejecutables, no prosa | no | no | sí (5 variantes tipadas) |
| Cruce con invariantes del dominio | no | no | sí (ondaod / ontology_check) |
PEP y KEP son estándares maduros, y ontoref hereda lo mejor de ambos. Pero cierra el agujero que ninguno toca: el criterio de graduación es él mismo un objeto verificable sin un humano dentro.
No es un revisor mejor. Es un gate que no se cansa, no se sepulta y corre antes de que el código —o la decisión— exista. Los agentes no fallan por falta de inteligencia. Fallan por falta de un gate que no sea humano.