Tag: #grand-modele-langage
-
Le projet Stargate : un pari à 500 milliards de dollars sur l'infrastructure d'IA (2025)
En janvier 2025, OpenAI, SoftBank, Oracle et MGX ont annoncé Stargate, un plan pour investir jusqu'à 500 milliards de dollars dans des centres de données d'IA aux États-Unis, juste au moment où DeepSeek remettait en cause le coût du calcul.
-
Gemini 2.0 et le début de l'ère des agents (2024)
Gemini 2.0 de Google, sorti en décembre 2024, a été présenté comme un modèle pour l'ère des agents : des systèmes qui ne se contentent pas de répondre, mais accomplissent des actions en plusieurs étapes pour vous.
-
OpenAI o1 : des modèles qui réfléchissent avant de répondre (2024)
OpenAI a présenté une gamme de modèles entraînés à raisonner les problèmes étape par étape avant de répondre, échangeant la vitesse contre la précision et ravivant l'idée que réfléchir plus longtemps peut payer.
-
Gemini 1.0 : la réponse multimodale de Google (2023)
Google a regroupé ses efforts d'IA sous le nom de Gemini, une famille nativement multimodale destinée à rivaliser avec GPT-4, et a appris à quel point les démos de lancement seraient désormais scrutées.
-
Llama 2 : des poids (presque) ouverts changent la donne (2023)
Meta a publié un modèle de langage capable dont chacun pouvait télécharger les poids et bâtir dessus, plaçant le débat sur l'IA 'ouverte' au centre de l'industrie.
-
GPT-4 : le vaisseau amiral qui a relevé la barre (2023)
GPT-4 d'OpenAI savait lire les images autant que le texte et obtenait de bons scores à des examens conçus pour les humains, scellant une course commerciale féroce et un secret qui a troublé les chercheurs.
-
GPT-3 : quand l'échelle est devenue la stratégie (2020)
Le modèle à 175 milliards de paramètres d'OpenAI a montré qu'un modèle de langage assez grand pouvait apprendre de nouvelles tâches à partir de quelques exemples dans la consigne, sans réentraînement.