La búsqueda semántica encuentra significado parecido, pero puede fallar con identificadores, siglas, nombres de funciones o frases exactas. La búsqueda léxica hace lo contrario: encuentra coincidencias de términos aunque no entienda su intención. La búsqueda híbrida combina ambas señales.
consulta
├── búsqueda léxica ───┐
└── búsqueda vectorial ├── fusión ── candidatos ── reranking ── top-k
┘La rama léxica favorece coincidencias exactas y rareza de términos. La vectorial usa embeddings para recuperar conceptos cercanos. La fusión puede normalizar scores o combinar posiciones —por ejemplo mediante reciprocal rank fusion— sin suponer que ambos motores puntúan en la misma escala.
La primera búsqueda debe ser rápida y recuperar suficientes candidatos. Un reranker más caro evalúa después cada par consulta-fragmento y reordena una lista pequeña con mayor precisión. Puede ser un modelo especializado o, en conjuntos muy acotados, un LLM.
Esto separa dos objetivos:
Tenant, permisos, idioma, fecha, producto o tipo de documento son restricciones, no preferencias semánticas. Aplícalas en el motor de búsqueda antes de entregar candidatos. Un resultado muy parecido sigue siendo incorrecto si el usuario no puede verlo.
La búsqueda híbrida suele ayudar en documentación técnica, catálogos y código, donde conviven conceptos con IDs exactos. Añade latencia y parámetros, así que valida con consultas reales: top-k, pesos de fusión y número de candidatos del reranker deben salir de una evaluación.
Combina Búsqueda semántica con señales léxicas y alimenta la etapa de Retrieval.