Un LLM est un modèle d'intelligence artificielle entraîné avec d'énormes quantités de texte pour prédire et générer du langage de manière cohérente. Son fonctionnement repose sur l'architecture Transformer, qui lui permet d'analyser les relations entre les mots au sein d'un contexte et d'anticiper la suite la plus probable d'une séquence. L'adjectif « grand » (large) fait référence tant au volume de données d'entraînement qu'au nombre de paramètres, qui peuvent se compter par milliards.
Leur importance réside dans le fait qu'ils constituent la base des assistants conversationnels actuels, tels que ChatGPT, Gemini ou Claude. Au-delà de la conversation, ils sont utilisés pour des tâches très diverses :
- Rédaction et résumé de textes.
- Traduction entre langues.
- Génération et débogage de code.
Il convient de rappeler une nuance pratique : un LLM ne « comprend » pas au sens humain et ne consulte pas une base de données de vérités, mais génère du texte statistiquement plausible. C'est pourquoi il peut produire des hallucinations, c'est-à-dire des affirmations fausses exprimées avec une assurance totale, ce qui vous oblige à toujours vérifier les informations sensibles.