IA 360

Modelos de lenguaje

Qué hace falta de verdad para entrenar tu propio modelo: la cuenta que nadie te enseña
Modelos de lenguaje

Qué hace falta de verdad para entrenar tu propio modelo: la cuenta que nadie te enseña

«Cuánta GPU hace falta» es la pregunta equivocada. Cómputo, datos y conocimiento no se suman: son tres puertas en serie, y la que casi nadie pasa no es la del hardware. Con el precio real de hoy, el corpus real de un modelo abierto y el cuaderno de bitácora real de un entrenamiento de 175.000 millones de parámetros, esta pieza hace la cuenta completa — y te dice en qué escalón estás tú.

7 min
Le pidieron a ChatGPT repetir 'poema' y recitó a Poe: qué prueba eso, y qué no
Modelos de lenguaje

Le pidieron a ChatGPT repetir 'poema' y recitó a Poe: qué prueba eso, y qué no

En 2023, un equipo de investigadores le pidió a ChatGPT que repitiera la palabra 'poema' sin parar, y el modelo acabó recitando 'El cuervo' de Poe palabra por palabra. Eso no prueba que los modelos guarden una copia de internet, pero tampoco que nunca memoricen nada: las dos afirmaciones son ciertas según el caso. Las cuatro preguntas que separan una demanda seria de un titular vacío.

7 min
Anthropic dejó que tres expertos opinaran sobre su hallazgo en Claude — y los tres discrepan entre sí
Modelos de lenguaje

Anthropic dejó que tres expertos opinaran sobre su hallazgo en Claude — y los tres discrepan entre sí

El 6 de julio, Anthropic publicó un hallazgo real sobre cómo razona Claude por dentro (ya lo contamos). Lo inusual vino después: invitó a tres grupos de expertos a comentarlo, sin editarlos para que coincidieran, y no coinciden. Esto es lo que separa a los tres, por qué ninguno confunde un dato con una interpretación, y cómo aplicar ese mismo criterio la próxima vez.

7 min

Este sitio web utiliza cookies para mejorar la experiencia de navegación. Política de cookies.

↑↓ navegar ↵ abrir esc cerrar