Totemize
  • Rutas totémicas
  • Precios
  • Quiénes somos
Iniciar sesiónÚnete gratis
Únete gratis
Ctrl+K
Modelo mental
  • Base de conocimiento
  • Cloud
    • Azure
      • Web Apps
        • App Service
        • App Service Plan
        • Configuración
        • Managed Identity
        • Deployment Slots
        • Networking
        • Observabilidad
      • Storage Accounts
        • Blob Storage
        • Containers
        • Azure Files
        • Queue Storage
        • Table Storage
        • Redundancia
        • Access Tiers
        • Lifecycle Management
        • Seguridad y red
  • Frontend
    • React
      • Componentes
      • Props y Estado
      • Hooks
      • Renderizado de listas
  • IA
    • Fundamentos
      • Determinismo y probabilismo
      • LLM
      • Proveedor
      • Modelos fundacionales
      • Plataforma
      • Mapa del ecosistema
      • Entrenamiento y fine-tuning
      • Tokens
      • Ventana de contexto
      • Inferencia y sampling
      • Alucinaciones y límites
    • Interacción con el modelo
      • Prompts e instrucciones
      • Context engineering
      • Salidas estructuradas
      • Validación
      • Evaluaciones
      • Tool calling
    • Economía de uso
      • API pricing
      • Tokens de entrada y salida
      • Tokens en caché
      • Créditos
      • Suscripciones
      • Límites de uso
      • Selección de modelo
    • Recuperación de conocimiento
      • Vectores
      • Embeddings
      • Chunking
      • Bases de datos vectoriales
      • Búsqueda semántica
      • Búsqueda híbrida y reranking
      • Retrieval
      • RAG
      • Citas y grounding
      • LlamaIndex
    • Agentes
      • Workflows
      • Anatomía de un agente
      • Harness
      • Agentic loop
      • Planificación y human-in-the-loop
      • Memory
      • Permisos
      • Verification
      • MCP
      • Orquestación
      • Multiagentes
      • A2A
      • Frameworks de agentes
        • Microsoft Agent Framework
        • OpenAI Agents SDK
        • Google ADK
        • LangGraph
    • Coding agents
      • Skills
      • Spec-Driven Development
      • Claude Code
        • CLAUDE.md
        • Commands
        • Hooks
        • Plugins
        • Permisos
        • Subagents
      • Codex
        • CLI
        • Extensión de IDE
        • Codex app
        • Cloud
        • AGENTS.md
        • Worktrees
      • Cursor
        • Agent mode
        • Rules
        • Models
        • Precio por uso
  • Soporte
  • Comentarios
  1. IA
  2. Recuperacion
Árbol de habilidades

Vectores

2 min de lecturaActualizado el 9 jul 2026

Un embedding es un vector: una lista ordenada de números. Para entender por qué eso captura significado, hay que imaginar el espacio donde viven esos vectores.

La intuición del espacio vectorial

Imagina un mapa donde cada texto es un punto. Cosas con significado parecido quedan cerca; distintas, lejos. La diferencia con un mapa de papel es la cantidad de dimensiones: no 2, sino cientos o miles. Cada número del vector es una coordenada en una dimensión. No podemos visualizar 1536 dimensiones, pero la regla se mantiene: posición ≈ significado.

Lo notable es que las relaciones se vuelven aritmética de direcciones. El ejemplo clásico:

vec(rey) − vec(hombre) + vec(mujer) ≈ vec(reina)

Funciona porque en el espacio hay “direcciones” que corresponden a conceptos —género, realeza, tiempo verbal— aprendidas a partir de los datos.

Medir la distancia: similitud coseno

Para saber si dos vectores están “cerca” no se suele usar distancia en línea recta, sino la similitud coseno: el ángulo entre ellos.

  • Coseno cercano a 1 → apuntan casi en la misma dirección → significado muy parecido.
  • Cercano a 0 → perpendiculares → sin relación.
  • Negativo → direcciones opuestas.

Se usa el ángulo y no la magnitud porque lo que importa es hacia dónde apunta el significado, no cuán “largo” es el vector.

Por qué esto habilita el resto de la ruta

Buscar “los textos más parecidos a esta consulta” se convierte en “los vectores con mayor similitud coseno respecto al vector de la consulta”. Hacer eso rápido sobre millones de vectores es justamente el trabajo de las bases de datos vectoriales, y el motor de la búsqueda semántica y el RAG.

Errores comunes

  • Comparar vectores de modelos distintos: el espacio es otro; los ángulos no significan nada entre mapas diferentes.
  • Olvidar normalizar: varias implementaciones asumen vectores normalizados para que el coseno sea comparable.

Temas relacionados

El vector es la forma de un embedding. Su aplicación directa está en Recuperación de conocimiento.