Un LLM é un modelo de intelixencia artificial adestrado con enormes cantidades de texto para predicir e xerar linguaxe de forma coherente. O seu funcionamento baséase na arquitectura Transformer, que lle permite analizar as relacións entre palabras dentro dun contexto e anticipar cal é a continuación máis probable dunha secuencia. O adjectivo «grande» (large) fai referencia tanto ao volume de datos de adestramento como ao número de parámetros, que poden contarse por miles de millóns.
A súa importancia radica en que constitúen a base dos asistentes conversacionais actuais, como ChatGPT, Gemini ou Claude. Máis aló da conversación, empréganse para tarefas moi diversas:
- Redacción e resumo de textos.
- Tradución entre idiomas.
- Xeración e depuración de código.
Convén lembrar un matiz práctico: un LLM non «entende» en sentido humano nin consulta unha base de datos de verdades, senón que xera texto estatisticamente plausible. Por iso pode producir alucinacións, é dicir, afirmacións falsas expresadas con total seguridade, algo que obriga a verificar sempre a información sensible.