Temperatur

Konzept
Auch bekannt als: Temperature, Sampling-Temperatur
Einstellung, die steuert, wie vorhersehbar oder variantenreich ein Sprachmodell Token auswählt
Die vom Modell berechneten Bewertungen für mögliche Fortsetzungen bleiben von der Temperatur unberührt - sie verändert erst, wie stark sich diese Bewertungen in der resultierenden Wahrscheinlichkeitsverteilung und damit bei der Auswahl des tatsächlichen Tokens auswirken. Niedrige Werte führen zu vorhersehbaren, hohe Werte zu variantenreicheren Antworten.

Was ist Temperatur?

Temperatur ist eine Einstellung, die steuert, wie vorhersehbar oder variantenreich ein Sprachmodell bei der Token-Auswahl vorgeht. Die vom Modell berechneten Bewertungen für mögliche Fortsetzungen bleiben dabei gleich - die Temperatur verändert erst, wie stark sich diese Bewertungen in der resultierenden Wahrscheinlichkeitsverteilung und damit bei der Auswahl des tatsächlichen Tokens auswirken.

Wie es funktioniert

Für jedes Token berechnet das Modell zunächst Bewertungen für mögliche Fortsetzungen - diese Bewertungen bleiben von der Temperatur unberührt. Erst bei der Umwandlung dieser Bewertungen in eine Wahrscheinlichkeitsverteilung und der anschließenden Auswahl wirkt die Temperatur: Bei niedriger Temperatur wird nahezu immer das wahrscheinlichste Token gewählt, die Ausgabe wirkt dadurch deterministisch. Bei höherer Temperatur erhalten auch weniger wahrscheinliche Token eine reale Chance, ausgewählt zu werden.

Warum dieselben Bewertungen zu unterschiedlichen Antworten führen

Die vom Modell berechneten Bewertungen selbst ändern sich durch die Temperatur nicht - erst daraus entsteht, je nach Temperatur, eine unterschiedlich geformte Wahrscheinlichkeitsverteilung und damit eine andere Auswahlregel. Genau deshalb kann derselbe Prompt bei höherer Temperatur bei jeder Ausführung zu einer anderen, aber jeweils plausiblen Antwort führen.

Eine Analogie: Wie ein Mensch, der bei jemandem noch nicht “warm geworden” ist, reagiert ein Modell bei niedriger Temperatur zurückhaltend und wählt fast immer die sichere, naheliegende Antwort. Höhere Temperatur lässt das Modell auch auf Ungewöhnlicheres eingehen. Technischer ausgedrückt: Bei niedriger Temperatur entscheidet sich das Modell fast immer für die naheliegendste Fortsetzung, mit steigender Temperatur werden auch weniger wahrscheinliche Alternativen berücksichtigt.

Warum Temperatur praktische Auswirkungen hat

  • Konsistenz: Niedrige Temperatur liefert bei wiederholten Anfragen fast identische Antworten - wichtig für reproduzierbare Aufgaben
  • Kreativität: Höhere Temperatur eignet sich für Textsorten, bei denen Variation gewünscht ist
  • Kohärenz-Grenze: Sehr hohe Werte lassen zunehmend unwahrscheinliche Token zu und können die Ausgabe bis zur Inkohärenz auffächern

Typisches Beispiel

Sehr niedrige Temperatur-Werte führen zu repetitiven, wenig lebendigen Texten, weil immer dieselben wahrscheinlichsten Token gewählt werden. Sehr hohe Werte können dagegen dazu führen, dass die Ausgabe den roten Faden verliert.

Weiterführend

GrundlagenPrompts: Warum Formulierungen die Antwort verändern

Verwandte BegriffeToken
Inferenz

Weiterführender Artikel

Prompts: Warum Formulierungen die Antwort verändern

Tokenisierung, System-Prompts, Temperatur und die Grenzen von Prompt Engineering

Quellen

Quellen archiviert am: 2026-08-02