Un agente genera resultados plausibles, no necesariamente correctos (es la naturaleza de un predictor de texto). La verificación es el paso que distingue “parece que funciona” de “funciona”: cómo comprueba el agente —o tú— que lo que hizo es correcto.
En el agentic loop, la verificación cumple dos funciones:
Por eso las tareas con verificación automática (código con tests, algo que compila) son donde los agentes brillan: tienen un juez objetivo. Las tareas sin señal clara (¿es “buena” esta redacción?) son mucho más difíciles de cerrar bien.
[!TIP] “Que pase los tests” no es lo mismo que “que haga lo correcto”. Verifica también contra la intención: ejercita el flujo afectado, no solo la suite. Un agente puede hacer pasar un test rompiendo lo que el test no cubre.
Cierra el agentic loop, se apoya en permisos para actuar con red, y en los coding agents se materializa en flujos de review y ejecución.