Totemize
  • Rutas totémicas
  • Precios
  • Quiénes somos
Iniciar sesiónÚnete gratis
Únete gratis
Ctrl+K
Modelo mental
  • Base de conocimiento
  • Cloud
    • Azure
      • Web Apps
        • App Service
        • App Service Plan
        • Configuración
        • Managed Identity
        • Deployment Slots
        • Networking
        • Observabilidad
      • Storage Accounts
        • Blob Storage
        • Containers
        • Azure Files
        • Queue Storage
        • Table Storage
        • Redundancia
        • Access Tiers
        • Lifecycle Management
        • Seguridad y red
  • Frontend
    • React
      • Componentes
      • Props y Estado
      • Hooks
      • Renderizado de listas
  • IA
    • Fundamentos
      • Determinismo y probabilismo
      • LLM
      • Proveedor
      • Modelos fundacionales
      • Plataforma
      • Mapa del ecosistema
      • Entrenamiento y fine-tuning
      • Tokens
      • Ventana de contexto
      • Inferencia y sampling
      • Alucinaciones y límites
    • Interacción con el modelo
      • Prompts e instrucciones
      • Context engineering
      • Salidas estructuradas
      • Validación
      • Evaluaciones
      • Tool calling
    • Economía de uso
      • API pricing
      • Tokens de entrada y salida
      • Tokens en caché
      • Créditos
      • Suscripciones
      • Límites de uso
      • Selección de modelo
    • Recuperación de conocimiento
      • Vectores
      • Embeddings
      • Chunking
      • Bases de datos vectoriales
      • Búsqueda semántica
      • Búsqueda híbrida y reranking
      • Retrieval
      • RAG
      • Citas y grounding
      • LlamaIndex
    • Agentes
      • Workflows
      • Anatomía de un agente
      • Harness
      • Agentic loop
      • Planificación y human-in-the-loop
      • Memory
      • Permisos
      • Verification
      • MCP
      • Orquestación
      • Multiagentes
      • A2A
      • Frameworks de agentes
        • Microsoft Agent Framework
        • OpenAI Agents SDK
        • Google ADK
        • LangGraph
    • Coding agents
      • Skills
      • Spec-Driven Development
      • Claude Code
        • CLAUDE.md
        • Commands
        • Hooks
        • Plugins
        • Permisos
        • Subagents
      • Codex
        • CLI
        • Extensión de IDE
        • Codex app
        • Cloud
        • AGENTS.md
        • Worktrees
      • Cursor
        • Agent mode
        • Rules
        • Models
        • Precio por uso
  • Soporte
  • Comentarios
  1. IA
  2. Agentes
Árbol de habilidades

Verification

1 min de lecturaActualizado el 9 jul 2026

Un agente genera resultados plausibles, no necesariamente correctos (es la naturaleza de un predictor de texto). La verificación es el paso que distingue “parece que funciona” de “funciona”: cómo comprueba el agente —o tú— que lo que hizo es correcto.

Por qué es la mitad del trabajo

En el agentic loop, la verificación cumple dos funciones:

  1. Señal de “terminado”: sin un criterio verificable, el loop no sabe cuándo parar.
  2. Feedback para corregir: un test que falla o un build roto es contexto nuevo con el que el agente se corrige en la siguiente vuelta. Un agente que puede verse fallar mejora solo.

Por eso las tareas con verificación automática (código con tests, algo que compila) son donde los agentes brillan: tienen un juez objetivo. Las tareas sin señal clara (¿es “buena” esta redacción?) son mucho más difíciles de cerrar bien.

Formas de verificar

  • Ejecutar tests y leer el resultado.
  • Compilar / typecheck / lint: que el código sea válido antes de darlo por hecho.
  • Correr la cosa de verdad: arrancar la app y observar el comportamiento, no solo asumir.
  • Revisión (humana o de otro agente): un subagente o un humano revisando el diff.

[!TIP] “Que pase los tests” no es lo mismo que “que haga lo correcto”. Verifica también contra la intención: ejercita el flujo afectado, no solo la suite. Un agente puede hacer pasar un test rompiendo lo que el test no cubre.

Anti-patrones

  • Confiar en la afirmación del agente (“ya está arreglado”) sin evidencia. Pide la prueba.
  • Verificar solo con tests que el propio agente escribió sin revisarlos.
  • Saltarse la verificación en cambios “triviales”: son los que se cuelan.

Temas relacionados

Cierra el agentic loop, se apoya en permisos para actuar con red, y en los coding agents se materializa en flujos de review y ejecución.