Die Temperature ist ein numerischer Parameter, der den Grad der Zufälligkeit in den Antworten eines Sprachmodells reguliert. Technisch gesehen passt sie die Wahrscheinlichkeitsverteilung über die möglichen nächsten Wörter an: Niedrige Werte führen dazu, dass das Modell fast immer die wahrscheinlichsten Optionen wählt, während hohe Werte die Wahrscheinlichkeit gleichmäßiger verteilen und so weniger vorhersehbare Ausgaben ermöglichen.
Sie bewegt sich üblicherweise in einem Bereich von 0 bis 2, und ihre Wahl hängt von der jeweiligen Aufgabe ab:
- Niedrige Werte (0–0,3): deterministische und präzise Antworten, ideal für die Datenextraktion, Code oder sachliche Zusammenfassungen.
- Mittlere Werte (0,5–0,8): Ausgewogenheit zwischen Kohärenz und Vielfalt, nützlich für allgemeine Unterstützung.
- Hohe Werte (1–2): höhere Kreativität und Diversität, geeignet für literarisches Schreiben oder Brainstorming.
In der Praxis sollte bedacht werden, dass eine hohe Temperature nicht das „Wissen“ des Modells verbessert, sondern nur dessen Variabilität: Sie kann sowohl die Originalität als auch das Risiko inkohärenter oder erfundener Antworten erhöhen. Zur Reproduzierbarkeit wird sie üblicherweise auf 0 oder einen sehr nahen Wert festgelegt.