Um LLM é um modelo de inteligência artificial treinado com enormes quantidades de texto para prever e gerar linguagem de forma coerente. O seu funcionamento baseia-se na arquitetura Transformer, que lhe permite analisar as relações entre palavras dentro de um contexto e antecipar qual é a continuação mais provável de uma sequência. O adjetivo «grande» (large) faz referência tanto ao volume de dados de treino como ao número de parâmetros, que podem contar-se por milhares de milhões.
A sua importância reside no facto de constituírem a base dos assistentes conversacionais atuais, como ChatGPT, Gemini ou Claude. Para além da conversação, são utilizados para tarefas muito diversas:
- Redação e resumo de textos.
- Tradução entre idiomas.
- Geração e depuração de código.
Convém recordar uma nuance prática: um LLM não «entende» no sentido humano nem consulta uma base de dados de verdades, mas gera texto estatisticamente plausível. Por isso pode produzir alucinações, ou seja, afirmações falsas expressas com total segurança, algo que obriga a verificar sempre a informação sensível.