Ein LLM ist ein Modell der künstlichen Intelligenz, das mit enormen Textmengen trainiert wurde, um Sprache kohärent vorherzusagen und zu generieren. Seine Funktionsweise basiert auf der Transformer-Architektur, die es ihm ermöglicht, die Beziehungen zwischen Wörtern innerhalb eines Kontextes zu analysieren und die wahrscheinlichste Fortsetzung einer Sequenz zu antizipieren. Das Adjektiv „groß“ (large) bezieht sich sowohl auf das Volumen der Trainingsdaten als auch auf die Anzahl der Parameter, die in die Milliarden gehen können.
Ihre Bedeutung liegt darin, dass sie die Grundlage für aktuelle dialogbasierte Assistenzsysteme wie ChatGPT, Gemini oder Claude bilden. Über die Konversation hinaus werden sie für sehr vielfältige Aufgaben eingesetzt:
- Verfassen und Zusammenfassen von Texten.
- Übersetzung zwischen Sprachen.
- Generierung und Fehlerbehebung von Code.
Es ist wichtig, eine praktische Nuance zu beachten: Ein LLM „versteht“ nicht im menschlichen Sinne und greift auch nicht auf eine Datenbank mit Fakten zu, sondern generiert statistisch plausiblen Text. Daher kann es Halluzinationen hervorrufen, das heißt falsche Behauptungen, die mit absoluter Sicherheit geäußert werden, was eine ständige Überprüfung sensibler Informationen erforderlich macht.