IA 360
Actualidad

OpenAI lanza o3-mini: razonamiento barato y por primera vez gratis

OpenAI estrena o3-mini, un modelo de razonamiento con esfuerzo ajustable y disponible por primera vez para usuarios gratuitos de ChatGPT.

Admin IA360 7 min de lectura Generado con IA Read in English
OpenAI lanza o3-mini: razonamiento barato y por primera vez gratis

OpenAI presentó el viernes 31 de enero de 2025 o3-mini, el modelo más reciente de su familia de sistemas de razonamiento, como su opción más eficiente en coste dentro de esa serie y, por primera vez, accesible para usuarios gratuitos de ChatGPT. La compañía lo había adelantado en diciembre junto a un sistema más capaz, o3. El anuncio oficial no atribuye el lanzamiento a un competidor concreto.

El propio emisor presenta el lanzamiento como una ampliación del acceso, pero su ficha de sistema obliga a separar disponibilidad de garantía: documenta riesgos de contenido no permitido, jailbreaks y alucinaciones, y clasifica antes de mitigaciones como medio el riesgo general, incluidos persuasión, CBRN y autonomía del modelo. Que más personas puedan usarlo no demuestra que cada respuesta sea correcta ni segura.

Qué es un modelo de razonamiento y por qué importa

Los modelos de razonamiento como o3-mini emplean cómputo adicional antes de producir la respuesta. Eso no equivale a comprobar los hechos ni garantiza que el resultado sea correcto: la propia ficha de sistema evalúa las alucinaciones como un riesgo. El intercambio real es entre esfuerzo, latencia y rendimiento medido en tareas concretas, no entre una respuesta sin revisar y otra certificada como verdadera.

o3-mini está optimizado para problemas STEM, es decir, programación, matemáticas y ciencia. La ficha oficial del modelo confirma que no admite entrada de imagen. OpenAI lo compara con la familia o1 bajo configuraciones concretas de esfuerzo y evaluación, no como una superioridad universal.

Según la evaluación publicada por la compañía, probadores expertos prefirieron las respuestas de o3-mini a las de o1-mini el 56% de las veces y observaron un 39% menos de errores graves en preguntas difíciles. En sus pruebas A/B, OpenAI midió respuestas un 24% más rápidas de media: 7,7 segundos frente a 10,16. Son resultados del protocolo del fabricante, no una tasa de acierto para cualquier consulta.

Razonamiento a la carta: bajo, medio y alto

La novedad más práctica de o3-mini es que permite regular cuánto "piensa". A través de la API, los desarrolladores pueden elegir entre tres niveles de esfuerzo de razonamiento —bajo, medio y alto— para que el modelo se esfuerce más o menos según la tarea y la tolerancia a la latencia.

Esa flexibilidad se traduce en un abanico de rendimiento sobre la propia familia anterior. "Con esfuerzo de razonamiento bajo, o3-mini logra un rendimiento comparable al de o1-mini, mientras que con esfuerzo medio alcanza un rendimiento comparable al de o1", explica OpenAI en su blog. "o3-mini con esfuerzo de razonamiento medio iguala el rendimiento de o1 en matemáticas, programación y ciencia entregando respuestas más rápidas. Y con esfuerzo alto, o3-mini supera tanto a o1-mini como a o1."

En ChatGPT, el modelo viene configurado por defecto en esfuerzo medio, lo que según la empresa ofrece "un equilibrio entre velocidad y precisión". Los usuarios de pago pueden seleccionar "o3-mini-high" en el selector de modelos para obtener "mayor inteligencia" a cambio de respuestas más lentas. Sea cual sea la versión elegida, el modelo puede trabajar con la búsqueda web para localizar respuestas actualizadas con enlaces a fuentes, aunque OpenAI advierte de que esa función es aún un "prototipo".

Gratis en ChatGPT, con límites por nivel

El otro golpe de efecto es el acceso. o3-mini llega este viernes a todos los usuarios de ChatGPT, incluidos los gratuitos, que pueden activarlo con el nuevo botón "Reason" en la barra de chat o pidiendo a ChatGPT que "regenere" una respuesta. Es la primera vez que un modelo de razonamiento de OpenAI se ofrece sin coste.

Los límites varían por suscripción:

  • ChatGPT Plus y Team: hasta 150 consultas diarias.
  • ChatGPT Pro: acceso ilimitado.
  • ChatGPT Enterprise y Edu: llegada prevista en una semana.

Sobre ChatGPT Gov, la compañía no dio indicaciones.

El precio: qué permite comparar el anuncio

OpenAI presentó o3-mini como su modelo de razonamiento más eficiente en coste y dijo que mantenía el bajo coste de o1-mini. Sin embargo, el anuncio primario conservado aquí no ofrece una tabla histórica con tarifas, unidades y fecha que permita comprobar la afirmación de que era un 63% más barato. Tampoco atribuye el lanzamiento a DeepSeek. «Más eficiente» es el posicionamiento del fabricante; una comparación de precio exige dos tarifas fechadas y expresadas en la misma unidad.

Las letras pequeñas: no es el modelo más potente

OpenAI es inusualmente clara sobre lo que o3-mini no es. No es su modelo más potente hasta la fecha, ni supera a R1 en todos los benchmarks.

Los gráficos del fabricante muestran que el resultado depende del esfuerzo seleccionado. En AIME 2024, una prueba de matemáticas de competición, la configuración baja se compara con o1-mini, la media con o1 y la alta supera a ambos en esa evaluación. En GPQA Diamond, de preguntas científicas de nivel doctoral, OpenAI afirma que la configuración alta ofrece un rendimiento comparable al de o1, no que lo supere.

También importa el arnés. Para SWE-bench Verified, OpenAI declara un subconjunto fijo de 477 tareas validado en su infraestructura. La ficha de sistema separa un 39% con el andamiaje abierto Agentless de un 61% con herramientas internas diseñadas para extraer la capacidad máxima. Son 22 puntos de diferencia sin cambiar el nombre del modelo. En FrontierMath, la compañía califica sus cifras de provisionales y distingue entre ejecuciones con Python y un gráfico sin herramientas ni calculadora. El propio anuncio remite a la ficha como fuente de verdad para SWE-bench. Una puntuación describe modelo, herramientas, muestra y reglas de ejecución; no al modelo aislado.

La lectura es que el argumento de venta de o3-mini no es batir récords absolutos, sino la ecuación coste-latencia-fiabilidad: responder bien, rápido y barato. "Mientras que o1 sigue siendo nuestro modelo de razonamiento de conocimiento general más amplio, o3-mini ofrece una alternativa especializada para dominios técnicos que requieren precisión y velocidad", escribió OpenAI.

Seguridad y disponibilidad

OpenAI afirma que o3-mini supera a GPT-4o en sus evaluaciones difíciles de seguridad y jailbreak, y atribuye parte del resultado a la alineación deliberativa: entrenar al modelo para razonar sobre especificaciones de seguridad escritas por personas. La ficha de sistema matiza el alcance: son evaluaciones y mitigaciones del fabricante, y el modelo alcanzó riesgo medio antes de mitigaciones en varias categorías. Fue el primer modelo que OpenAI situó en riesgo medio de autonomía, pero seguía rindiendo mal en pruebas de investigación de aprendizaje automático relacionadas con la auto-mejora, necesarias para una clasificación alta. No es una certificación de seguridad para todos los usos.

En la API, el modelo llegó ese viernes a desarrolladores seleccionados de los niveles de uso 3 a 5 mediante Chat Completions, Assistants y Batch. Admitía llamadas a funciones, salidas estructuradas, mensajes de desarrollador y streaming, pero no entrada de imagen. «Disponible en la API» describía por tanto un conjunto concreto de cuentas, interfaces y modalidades, no acceso universal.

Qué cambia a partir de ahora

El movimiento tiene dos derivadas concretas. Para el usuario final, poner razonamiento gratuito en ChatGPT rebaja la barrera de entrada a una capacidad que hasta ahora estaba reservada a quien pagaba. Para las empresas y desarrolladores, el esfuerzo ajustable permite calibrar el gasto: usar el nivel bajo para tareas rutinarias y reservar el alto para los problemas que lo justifiquen.

OpenAI enmarca o3-mini como "otro paso en su misión de empujar los límites de la inteligencia rentable", sin atribuir el calendario a un rival. La lección transferible está en separar las tres capas del lanzamiento: capacidad medida en un protocolo, acceso sujeto a plan y modalidad, y coste que solo puede compararse con tarifas fechadas en la misma unidad.

Este artículo se ha elaborado con inteligencia artificial bajo supervisión editorial humana.

Compartir este artículo

Este sitio web utiliza cookies para mejorar la experiencia de navegación. Política de cookies.

↑↓ navegar ↵ abrir esc cerrar