Geek de la semana
Una zona de juego semanal donde la IA se desata: pequeños gadgets interactivos sobre cómo funciona la IA.
-
Multi-armed bandit: ¿explorar o explotar?
y26w40
Cinco tragaperras esconden distintas tasas de pago. Tira tú mismo o mueve Explorar y mira epsilon-greedy aprender qué brazo paga mejor. El dilema clásico del aprendizaje por refuerzo en una fila de palancas.
-
Atención: mira cómo las palabras deciden a quién escuchar
y26w39
Haz clic en una palabra y mira los arcos abrirse hacia las demás, más gruesos donde presta más atención, y siempre sumando 100 por ciento. Arrastra palabras para que se atiendan. Es el mecanismo detrás de todo LLM moderno.
-
Red neuronal: mira cómo una recta aprende a curvarse
y26w38
Una neurona solo traza una recta, así que se atasca con XOR y el círculo. Añade una capa oculta, pulsa Entrenar y mira al descenso de gradiente doblar la frontera en curvas. Por esto el aprendizaje profundo necesita profundidad.
-
k-medias: mira cómo una máquina encuentra grupos sin que nadie le enseñe
y26w37
Dispersa unos puntos, elige cuántos grupos buscar y mira cómo los centroides se desplazan hasta que los grupos encajan. Sin etiquetas, sin maestro: aprendizaje no supervisado para ver.
-
Descenso de gradiente: mira cómo un modelo aprende cuesta abajo
y26w36
Suelta una bola en una curva de pérdida y mírala bajar paso a paso. Si la tasa de aprendizaje es muy alta, sale volando; un terreno con baches la atrapa. Así se entrena casi cualquier red neuronal.
-
Codificación por pares de bytes: mira cómo un modelo trocea el texto en tokens
y26w35
Escribe algo de texto y desliza de caracteres a palabras. Esto es la codificación por pares de bytes, la forma exacta en que los modelos tipo GPT convierten lo que escribes en los tokens que leen.
-
Q-learning: mira cómo un agente aprende de la recompensa
y26w34
Suelta un agente en una cuadrícula con una meta y una trampa. Empieza sin saber nada y aprende por ensayo y error hacia dónde ir, una recompensa cada vez. La idea detrás de AlphaGo y RLHF.
-
Convolución: la rejilla 3×3 donde empieza la visión artificial
y26w33
Dibuja una forma y mira cómo un diminuto filtro 3×3 encuentra sus bordes, la desenfoca o la enfoca. Es la operación exacta que impulsa las redes neuronales convolucionales.
-
Tres en raya con minimax: la máquina que se niega a perder
y26w32
Juega al tres en raya contra una máquina que lee todos los futuros posibles y nunca pierde. Míra cómo puntúa cada jugada, victoria, empate o derrota, antes de moverse.
-
Balbuceador de Markov: la máquina original de la próxima palabra
y26w31
Mucho antes de ChatGPT, las máquinas adivinaban la siguiente palabra contando. Dale a este modelo diminuto cualquier texto y míralo balbucear, una tirada de dados cada vez.
-
Zona de juego del perceptrón: enseña a una neurona de 1958 a trazar una línea
y26w30
Coloca puntos de dos colores en un campo y observa cómo un solo perceptrón mueve una recta hasta separarlos, o se atasca de forma gloriosa.