KI-Agenten sind Systeme, die in der Lage sind, mehrstufige Aufgaben zu planen und auszuführen, um ein Ziel zu erreichen, ohne dass bei jeder Aktion menschliche Aufsicht erforderlich ist. Im Gegensatz zu einem Sprachmodell, das lediglich auf eine Anfrage antwortet, entscheidet ein Agent, was zu tun ist, in welcher Reihenfolge und welche Werkzeuge dafür zu nutzen sind.
Ihre Funktionsweise stützt sich in der Regel auf drei Schlüsselfähigkeiten:
- Schlussfolgerung: Sie zerlegen ein komplexes Ziel in handhabbare Teilaufgaben.
- Nutzung von Werkzeugen: Sie rufen APIs, Suchmaschinen oder Datenbanken auf oder führen Code aus.
- Gedächtnis: Sie bewahren den Kontext zwischen den Schritten, um die Kohärenz zu wahren.
Sie sind von Bedeutung, da sie die Reichweite der KI von der einfachen Textgenerierung hin zu autonomen Handlungen erweitern, was die Automatisierung ganzer Arbeitsabläufe ermöglicht. Ein praktisches Beispiel wäre ein Agent, der den Auftrag erhält, eine Reise zu organisieren: Er sucht Flüge, vergleicht Preise, bucht Unterkünfte und erstellt einen Reiseplan, wobei er eigenständig Entscheidungen verkettet. Die relevante Nuance besteht darin, dass diese Autonomie auch Risiken durch kumulierte Fehler birgt, weshalb es ratsam ist, Grenzen und Kontrollpunkte zu definieren.