Test-Time Compute

Zusätzliche Rechenleistung beim Antworten einer Frage, zur Inferenzzeit, nicht nur beim Training; ein Hebel für schwierigere Reasoning-Aufgaben.

Test-Time Compute bedeutet, einem Modell beim Beantworten einer Frage mehr Verarbeitung zu geben, nicht nur beim Training. Systeme für Reasoning wie OpenAI o1 und DeepSeek-R1 verbringen zur Antwortzeit länger mit Gedankenketten und tauschen Tempo und Kosten gegen Genauigkeit bei schweren Aufgaben.

Es ergänzt die Skalierung von Trainingsdaten und Parametern: eine zweite Fortschrittsachse neben der reinen Modellgröße. Wettbewerbs-Benchmarks wie das IMO-Gold 2025 zeigten, wie weit dieser Hebel in einem Jahr gewandert war.