Tag: #verstaerkendes-lernen
-
DeepSeek-R1 und der Effizienzschock (2025)
Ein chinesisches Start-up veröffentlichte ein Reasoning-Modell mit offenen Gewichten, das den Besten ebenbürtig war, zu einem Bruchteil der angegebenen Kosten, und ließ am 27. Januar 2025 einen Rekordbetrag von Nvidias Wert verschwinden.
-
AlphaGo gegen Lee Sedol: die Maschine, die spielen lernte (2016)
DeepMinds AlphaGo schlug einen der größten Go-Spieler 4:1, und zwar nicht durch Brute-Force-Suche wie Deep Blue, sondern durch aus Daten und Selbstspiel gelernte Intuition.