Totemize
  • Rutas totémicas
  • Precios
  • Quiénes somos
Iniciar sesiónÚnete gratis
Únete gratis
Ctrl+K
Modelo mental
  • Base de conocimiento
  • Cloud
    • Azure
      • Web Apps
        • App Service
        • App Service Plan
        • Configuración
        • Managed Identity
        • Deployment Slots
        • Networking
        • Observabilidad
      • Storage Accounts
        • Blob Storage
        • Containers
        • Azure Files
        • Queue Storage
        • Table Storage
        • Redundancia
        • Access Tiers
        • Lifecycle Management
        • Seguridad y red
  • Frontend
    • React
      • Componentes
      • Props y Estado
      • Hooks
      • Renderizado de listas
  • IA
    • Fundamentos
      • Determinismo y probabilismo
      • LLM
      • Proveedor
      • Modelos fundacionales
      • Plataforma
      • Mapa del ecosistema
      • Entrenamiento y fine-tuning
      • Tokens
      • Ventana de contexto
      • Inferencia y sampling
      • Alucinaciones y límites
    • Interacción con el modelo
      • Prompts e instrucciones
      • Context engineering
      • Salidas estructuradas
      • Validación
      • Evaluaciones
      • Tool calling
    • Economía de uso
      • API pricing
      • Tokens de entrada y salida
      • Tokens en caché
      • Créditos
      • Suscripciones
      • Límites de uso
      • Selección de modelo
    • Recuperación de conocimiento
      • Vectores
      • Embeddings
      • Chunking
      • Bases de datos vectoriales
      • Búsqueda semántica
      • Búsqueda híbrida y reranking
      • Retrieval
      • RAG
      • Citas y grounding
      • LlamaIndex
    • Agentes
      • Workflows
      • Anatomía de un agente
      • Harness
      • Agentic loop
      • Planificación y human-in-the-loop
      • Memory
      • Permisos
      • Verification
      • MCP
      • Orquestación
      • Multiagentes
      • A2A
      • Frameworks de agentes
        • Microsoft Agent Framework
        • OpenAI Agents SDK
        • Google ADK
        • LangGraph
    • Coding agents
      • Skills
      • Spec-Driven Development
      • Claude Code
        • CLAUDE.md
        • Commands
        • Hooks
        • Plugins
        • Permisos
        • Subagents
      • Codex
        • CLI
        • Extensión de IDE
        • Codex app
        • Cloud
        • AGENTS.md
        • Worktrees
      • Cursor
        • Agent mode
        • Rules
        • Models
        • Precio por uso
  • Soporte
  • Comentarios
  1. IA
  2. Agentes
Árbol de habilidades

Orquestación

1 min de lecturaActualizado el 9 jul 2026

La orquestación coordina pasos, herramientas o agentes: decide quién trabaja, con qué estado, en qué orden y qué ocurre al fallar. Puede ser completamente explícita como un workflow, o permitir decisiones del modelo dentro de límites.

Patrones básicos

  • Secuencial: la salida de un paso alimenta al siguiente.
  • Paralelo: tareas independientes se ejecutan a la vez y luego se combinan.
  • Routing: una regla o clasificador elige una rama.
  • Handoff: un agente transfiere control y contexto a otro.
  • Supervisor: un coordinador delega, revisa y decide el siguiente movimiento.
  • Map-reduce: varios workers procesan partes y un paso final sintetiza.

El patrón debe salir de las dependencias del problema, no del deseo de usar más agentes.

El problema difícil es el estado

Define un dueño para:

  • objetivo y plan actual;
  • resultados parciales;
  • contexto que recibe cada participante;
  • presupuesto de tiempo, tokens y llamadas;
  • permisos y credenciales;
  • criterio de finalización.

Copiar todo el historial a cada agente aumenta costo y ruido. Compartir nada obliga a repetir trabajo. Pasa contratos pequeños y artefactos explícitos.

Paralelo sólo cuando hay independencia

Dos tareas son paralelizables si ninguna necesita el resultado de la otra y sus efectos no entran en conflicto. Para escrituras, usa aislamiento, locks o una fase de integración. El paralelismo reduce tiempo de pared, no consumo total.

Diseña semántica de fallo

  • ¿se reintenta el paso o todo el flujo?;
  • ¿la operación es idempotente?;
  • ¿qué resultados parciales se conservan?;
  • ¿se puede cancelar a los workers restantes?;
  • ¿quién decide fallback o escalamiento?;
  • ¿cómo se reanuda después de un proceso caído?

Un LLM no debe improvisar estas garantías. Pertenecen al runtime o al workflow.

Cuándo mantenerlo simple

Para muchas tareas basta un agente con varias tools y un loop acotado. Añade orquestación multiagente cuando especialización, aislamiento o paralelismo medido superen el costo de coordinar.

Temas relacionados

La orquestación prepara Multiagentes y A2A. Los Frameworks de agentes implementan distintos subconjuntos de estos patrones.