Un modelo fundacional es un modelo grande preentrenado con datos amplios para servir como base reutilizable de muchas tareas. No nace para una sola pantalla o clasificación: se adapta mediante instrucciones, herramientas, recuperación de conocimiento o entrenamiento adicional.
Un LLM es un tipo de modelo fundacional centrado en lenguaje. No todos los modelos fundacionales son LLM: también los hay de imagen, audio, video y multimodales.
preentrenamiento amplio
↓
modelo fundacional
↓
post-training / instrucciones / herramientas / RAG
↓
aplicación concretaEl modelo aporta capacidades generales y patrones aprendidos. La aplicación añade el contexto actual, las reglas de negocio, las fuentes autorizadas y las acciones que puede ejecutar.
El entrenamiento fija patrones y conocimiento estadístico hasta un punto temporal. Tus datos actuales, permisos y estado de negocio no aparecen mágicamente. Se entregan en tiempo de inferencia mediante contexto, RAG o herramientas.
El modelo tampoco incluye por sí solo una interfaz, memoria persistente ni un sistema de permisos. Esas capacidades pertenecen a la plataforma, el producto o el harness.
Empieza por el modelo más pequeño que cumpla tus evaluaciones. Sube de capacidad sólo cuando la mejora justifique costo y latencia; considera despliegue propio sólo si control, residencia o economía a escala compensan la operación.
El Proveedor crea u ofrece el modelo; la Plataforma lo sirve. El Entrenamiento y fine-tuning explica cómo se obtiene y adapta.