Tag: #modelo-lenguaje
-
El Proyecto Stargate: una apuesta de 500.000 millones por la infraestructura de IA (2025)
En enero de 2025, OpenAI, SoftBank, Oracle y MGX anunciaron Stargate, un plan para invertir hasta 500.000 millones de dólares en centros de datos de IA en EE. UU., justo cuando DeepSeek cuestionaba el coste del cómputo.
-
Gemini 2.0 y el inicio de la era de los agentes (2024)
Gemini 2.0 de Google, lanzado en diciembre de 2024, se presentó como un modelo para la era de los agentes: sistemas que no solo responden, sino que realizan acciones de varios pasos en tu nombre.
-
OpenAI o1: modelos que piensan antes de responder (2024)
OpenAI presentó una línea de modelos entrenada para razonar los problemas paso a paso antes de responder, cambiando velocidad por precisión y reviviendo la idea de que pensar más tiempo puede compensar.
-
Gemini 1.0: la respuesta multimodal de Google (2023)
Google reunió sus esfuerzos de IA bajo el nombre Gemini, una familia nativamente multimodal pensada para rivalizar con GPT-4, y aprendió con cuánto detalle se examinarían ya las demos de lanzamiento.
-
Llama 2: los pesos (casi) abiertos cambian el juego (2023)
Meta lanzó un modelo de lenguaje capaz cuyos pesos cualquiera podía descargar y sobre los que construir, situando el debate sobre la IA 'abierta' en el centro de la industria.
-
GPT-4: el buque insignia que subió el listón (2023)
GPT-4 de OpenAI podía leer imágenes además de texto y obtuvo buenas notas en exámenes hechos para humanos, afianzando una feroz carrera comercial y un secretismo que inquietó a los investigadores.
-
GPT-3: cuando la escala se volvió la estrategia (2020)
El modelo de 175 mil millones de parámetros de OpenAI mostró que un modelo de lenguaje lo bastante grande podía aprender tareas nuevas con unos pocos ejemplos en la consigna, sin reentrenar.