Aprendizaje de Representaciones
El aprendizaje de representaciones es el conjunto de técnicas que permiten a un sistema descubrir por sí mismo las características útiles de los datos crudos, en lugar de que un humano las diseñe a mano. Explicamos su idea central, su contraste con la ingeniería manual de características, sus formas —de los embeddings al aprendizaje autosupervisado— y por qué es un pilar del aprendizaje profundo.
El aprendizaje de representaciones (o aprendizaje de características) es el conjunto de técnicas que permiten a un sistema descubrir automáticamente, a partir de los datos crudos, las representaciones o características útiles para resolver una tarea, en lugar de que un experto las diseñe a mano. Es uno de los pilares del aprendizaje profundo.
La idea central
La intuición es que el éxito de un modelo depende de cómo estén representados los datos. La misma información, expresada en un espacio distinto, puede volver una tarea trivial o imposible. El aprendizaje de representaciones busca precisamente esa buena representación: una en la que los factores de variación subyacentes a los datos queden «desenredados» y a la vista, de modo que clasificar, agrupar o predecir después resulte más fácil.
Frente a la ingeniería manual
Tradicionalmente, un experto de dominio diseñaba las características a mano —un trabajo laborioso y limitado por su intuición—. El aprendizaje profundo cambió el paradigma: aprende jerarquías de representaciones directamente de los datos. En una red de visión, las primeras capas detectan bordes; las siguientes, texturas y formas; las profundas, objetos completos. Cada nivel se construye a partir del anterior.
Sus formas
Adopta muchas caras. Las capas de una red profunda son, en sí mismas, representaciones aprendidas. Los embeddings convierten palabras en vectores densos —como word2vec (2013) o GloVe (2014)—, en los que las relaciones semánticas emergen como geometría. Los autoencoders aprenden a comprimir y reconstruir. Y hoy es central el aprendizaje autosupervisado y contrastivo, que aprende representaciones a partir de datos sin etiquetar. La referencia clásica del campo es la revisión de Yoshua Bengio, Aaron Courville y Pascal Vincent (2013).
Por qué importa
Sus ventajas explican buena parte del éxito de la IA moderna: mejores representaciones dan mejor generalización, permiten transferir lo aprendido de una tarea a otra y ahorran el costoso trabajo manual. Es, de hecho, el fundamento de los modelos fundacionales, que se entrenan sobre datos masivos para aprender representaciones generales reutilizables.
Piezas que usan este término
- Descifrando la "Caja Negra" de la IA (2024-01-01)
- Aplicaciones de aprendizaje automático en medicina y biología (2023-05-09)
- Aprendizaje no supervisado: métodos y técnicas (2023-05-09)
- Tendencias y avances en la investigación de modelos de lenguaje en la IA (2023-05-09)
- Técnicas de aprendizaje no supervisado en la inteligencia artificial general (2023-05-09)
Este artículo se ha elaborado con inteligencia artificial bajo supervisión editorial humana.