Gerald Tesauro
IBM-Forscher, der 1992 TD-Gammon baute, ein neuronales Netz, das Backgammon durch Selbstspiel lernte.
TD-Gammon nutzte temporale Differenzen im verstärkenden Lernen, um starkes Backgammon ohne handgeschriebene Regeln zu erreichen. Es zeigte, dass neuronale Netze durch Erfahrung lernen konnten, in den ruhigen Jahren nach dem zweiten KI-Winter.