Tag: #grosses-sprachmodell
-
Das Stargate-Projekt: eine 500-Milliarden-Wette auf KI-Infrastruktur (2025)
Im Januar 2025 kündigten OpenAI, SoftBank, Oracle und MGX Stargate an, einen Plan, bis zu 500 Milliarden Dollar in US-Rechenzentren für KI zu investieren, gerade als DeepSeek die Kosten der Rechenleistung infrage stellte.
-
Gemini 2.0 und der Beginn der Agenten-Ära (2024)
Googles Gemini 2.0, veröffentlicht im Dezember 2024, wurde als Modell für die Agenten-Ära präsentiert: Systeme, die nicht nur antworten, sondern in mehreren Schritten für dich handeln.
-
OpenAI o1: Modelle, die denken, bevor sie antworten (2024)
OpenAI zeigte eine Modellreihe, die trainiert wurde, Probleme Schritt für Schritt zu durchdenken, bevor sie antwortet, tauscht Tempo gegen Genauigkeit und belebt die Idee, dass längeres Nachdenken sich lohnen kann.
-
Gemini 1.0: Googles multimodale Antwort (2023)
Google bündelte seine KI-Bemühungen unter dem Namen Gemini, einer nativ multimodalen Familie als Rivale zu GPT-4, und lernte, wie genau Launch-Demos nun geprüft würden.
-
Llama 2: (halb) offene Gewichte verändern das Spiel (2023)
Meta veröffentlichte ein fähiges Sprachmodell, dessen Gewichte jeder herunterladen und darauf aufbauen konnte, und rückte die Debatte über 'offene' KI ins Zentrum der Branche.
-
GPT-4: das Flaggschiff, das die Messlatte hob (2023)
OpenAIs GPT-4 konnte Bilder wie Text lesen und schnitt bei Prüfungen für Menschen gut ab. Es festigte ein hartes kommerzielles Rennen und eine Geheimhaltung, die Forscher beunruhigte.
-
GPT-3: als Skalierung zur Strategie wurde (2020)
OpenAIs Modell mit 175 Milliarden Parametern zeigte, dass ein ausreichend großes Sprachmodell neue Aufgaben aus wenigen Beispielen im Prompt lernen kann, ganz ohne Nachtraining.