A temperature é um parâmetro numérico que regula o grau de aleatoriedade nas respostas de um modelo de linguagem. Tecnicamente, ajusta a distribuição de probabilidade sobre as possíveis palavras seguintes: valores baixos fazem com que o modelo escolha quase sempre as opções mais prováveis, enquanto valores altos repartem a probabilidade de forma mais uniforme, dando lugar a resultados menos previsíveis.
Geralmente move-se num intervalo de 0 a 2, e a sua escolha depende da tarefa:
- Valores baixos (0–0,3): respostas deterministas e precisas, ideais para extração de dados, código ou resumos factuais.
- Valores médios (0,5–0,8): equilíbrio entre coerência e variedade, útil para assistência geral.
- Valores altos (1–2): maior criatividade e diversidade, adequados para escrita literária ou brainstorming.
Na prática, convém recordar que uma temperature elevada não melhora o «conhecimento» do modelo, apenas a sua variabilidade: pode aumentar tanto a originalidade como o risco de respostas incoerentes ou inventadas. Para reprodutibilidade, costuma fixar-se em 0 ou num valor muito próximo.