Test-Time Compute
Zusätzliche Rechenleistung beim Antworten einer Frage, zur Inferenzzeit, nicht nur beim Training; ein Hebel für schwierigere Reasoning-Aufgaben.
Test-Time Compute bedeutet, einem Modell beim Beantworten einer Frage mehr Verarbeitung zu geben, nicht nur beim Training. Systeme für Reasoning wie OpenAI o1 und DeepSeek-R1 verbringen zur Antwortzeit länger mit Gedankenketten und tauschen Tempo und Kosten gegen Genauigkeit bei schweren Aufgaben.
Es ergänzt die Skalierung von Trainingsdaten und Parametern: eine zweite Fortschrittsachse neben der reinen Modellgröße. Wettbewerbs-Benchmarks wie das IMO-Gold 2025 zeigten, wie weit dieser Hebel in einem Jahr gewandert war.