Gerald Tesauro
Investigador de IBM que construyó TD-Gammon en 1992, una red neuronal que aprendió backgammon por autojuego.
TD-Gammon de Tesauro usó aprendizaje por diferencias temporales en aprendizaje por refuerzo para alcanzar un nivel fuerte de backgammon sin reglas diseñadas a mano. Demostró que las redes neuronales podían mejorar con la experiencia en los años tranquilos tras el segundo invierno de la IA.