OpenAI o3 es un modelo de transformador generativo preentrenado (GPT) desarrollado por OpenAI como sucesor de OpenAI o1 para ChatGPT. Está diseñado para dedicar tiempo adicional de deliberación al abordar preguntas que requieren razonamiento lógico paso a paso. El modelo fue anunciado el 20 de diciembre de 2024 y posteriormente lanzado en varias variantes, incluyendo o3-mini, o3, o4-mini y o3-pro, con capacidades en programación, matemáticas y ciencia.
El nombre "o3" se eligió en lugar de "o2" para evitar un conflicto de marca con la operadora de telefonía móvil O2. OpenAI invitó a investigadores de seguridad y protección a solicitar acceso anticipado a los modelos hasta el 10 de enero de 2025. Similar a su predecesor o1, el anuncio inicial incluyó dos modelos: o3 y o3-mini.
Historia
El modelo OpenAI o3 fue anunciado el 20 de diciembre de 2024. El 31 de enero de 2025, OpenAI lanzó o3-mini para todos los usuarios de ChatGPT, incluidos los usuarios de nivel gratuito, y para algunos usuarios de API. OpenAI describió o3-mini como una "alternativa especializada" a o1 para "dominios técnicos que requieren precisión y velocidad". o3-mini presenta tres niveles de esfuerzo de razonamiento: bajo, medio y alto. La versión gratuita utiliza el nivel medio, mientras que una variante que usa más cómputo, llamada o3-mini-high, está disponible para suscriptores de pago. Los suscriptores del nivel Pro de ChatGPT tienen acceso ilimitado tanto a o3-mini como a o3-mini-high.
El 2 de febrero de 2025, OpenAI lanzó OpenAI Deep Research, un servicio de ChatGPT que utiliza una versión de o3 que elabora informes exhaustivos en un plazo de 5 a 30 minutos basados en búsquedas web. El 6 de febrero, en respuesta a la presión de rivales como DeepSeek R1, OpenAI anunció una actualización destinada a mejorar la transparencia del proceso de pensamiento en su modelo o3-mini. El 12 de febrero, OpenAI aumentó aún más los límites de tasa para o3-mini-high a 50 solicitudes por día (frente a 50 solicitudes por semana) para suscriptores de ChatGPT Plus e implementó soporte para carga de archivos e imágenes.
El 16 de abril de 2025, OpenAI lanzó o3 y o4-mini, un sucesor de o3-mini. El 10 de junio de 2025, OpenAI lanzó o3-pro, que la compañía afirma que es su modelo más capaz hasta la fecha. OpenAI declaró: "Recomendamos usarlo para preguntas desafiantes donde la fiabilidad importa más que la velocidad, y esperar unos minutos vale la pena". El 28 de mayo de 2026, OpenAI anunció que o3 sería retirado de ChatGPT el 26 de agosto de 2026, tras un período de retirada de 90 días. La compañía declaró que el cambio se aplicaba solo a ChatGPT y no afectaba a la API.
Capacidades
Se utilizó aprendizaje por refuerzo para enseñar a o3 a "pensar" antes de generar respuestas, utilizando lo que OpenAI denomina una "cadena de pensamiento privada". Este enfoque permite al modelo planificar con antelación y razonar sobre las tareas, realizando una serie de pasos de razonamiento intermedios para ayudar a resolver el problema, a costa de potencia computacional adicional y mayor latencia en las respuestas.
o3 demuestra un rendimiento significativamente mejor que o1 en tareas complejas, incluyendo programación, matemáticas y ciencia. OpenAI informó que o3 logró una puntuación del 87.7% en el punto de referencia GPQA Diamond, que contiene preguntas científicas de nivel experto no disponibles públicamente en línea. En SWE-bench Verified, un punto de referencia de ingeniería de software que evalúa la capacidad de resolver problemas reales de GitHub, o3 obtuvo un 71.7%, en comparación con el 48.9% de o1. En Codeforces, o3 alcanzó una puntuación Elo de 2727, mientras que o1 obtuvo 1891. En el punto de referencia ARC-AGI (Corpus de Abstracción y Razonamiento para Inteligencia General Artificial), que evalúa la capacidad de una IA para manejar nuevos problemas lógicos y de adquisición de habilidades, o3 alcanzó tres veces la precisión de o1.
Variantes del modelo
La familia o3 incluye varias variantes adaptadas a diferentes casos de uso. o3-mini es un modelo más pequeño y rápido diseñado para dominios técnicos que requieren precisión y velocidad, con niveles de esfuerzo de razonamiento ajustables. o3 es el modelo a gran escala con mayor rendimiento en puntos de referencia complejos. o4-mini, lanzado junto con o3 el 16 de abril de 2025, sirve como sucesor de o3-mini. o3-pro, lanzado el 10 de junio de 2025, se posiciona como el modelo más capaz, priorizando la fiabilidad sobre la velocidad.
Cada variante aprovecha la misma arquitectura subyacente de un modelo de lenguaje grande basado en la arquitectura transformer, con técnicas de aprendizaje profundo y redes neuronales para el razonamiento. Los modelos se entrenan utilizando aprendizaje por refuerzo e incorporan una cadena de pensamiento privada, que es una forma de razonamiento cadena de pensamiento que no es completamente transparente para los usuarios.
Rendimiento y puntos de referencia
Las métricas de rendimiento de o3 destacan sus avances sobre modelos anteriores. En GPQA Diamond, o3 obtuvo un 87.7%, lo que indica un fuerte rendimiento en preguntas científicas de nivel experto. En SWE-bench Verified, o3 logró un 71.7%, una mejora significativa respecto al 48.9% de o1, demostrando su capacidad para resolver problemas reales de ingeniería de software. En Codeforces, la calificación Elo de o3 de 2727 superó ampliamente la de o1 con 1891, reflejando habilidades superiores de programación competitiva. En ARC-AGI, o3 triplicó la precisión de o1, sugiriendo una capacidad mejorada para manejar tareas novedosas de lógica y adquisición de habilidades.
Estos resultados posicionan a o3 como un modelo de razonamiento líder en el campo de la inteligencia artificial, con aplicaciones en áreas como el aprendizaje automático y la IA generativa. La capacidad del modelo para razonar paso a paso lo hace adecuado para tareas que requieren deliberación cuidadosa, aunque conlleva mayores costos computacionales y latencia.
Comparación con otros modelos
En el panorama competitivo de los modelos de IA, o3 se compara a menudo con las ofertas de otras organizaciones. Anthropic y Google DeepMind han desarrollado sus propios modelos de razonamiento, y el rendimiento de o3 en puntos de referencia como SWE-bench Verified y Codeforces se ha utilizado para medir su posición. El lanzamiento de o3-mini en enero de 2025 fue en parte una respuesta a la presión competitiva, incluidos modelos como DeepSeek R1, que llevó a actualizaciones que mejoran la transparencia en el proceso de pensamiento.
El enfoque de OpenAI con o3 enfatiza el razonamiento deliberado, en contraste con modelos que priorizan la velocidad. Esta compensación se refleja en los diferentes niveles de esfuerzo de razonamiento disponibles en o3-mini, lo que permite a los usuarios equilibrar precisión y tiempo de respuesta. La integración del modelo en ChatGPT y los servicios de API lo ha hecho accesible a una amplia gama de usuarios, desde el nivel gratuito hasta suscriptores Pro.
Implementación y acceso
La implementación de las variantes de o3 se ha realizado por fases. o3-mini fue el primero en lanzarse ampliamente, seguido de o3 y o4-mini, y posteriormente o3-pro. El acceso se proporciona a través de ChatGPT, con diferentes niveles que ofrecen distintos grados de uso. Los usuarios del nivel gratuito obtienen o3-mini con esfuerzo de razonamiento medio, mientras que los suscriptores de pago pueden acceder a niveles de esfuerzo más altos y un uso más frecuente. Los suscriptores Pro tienen acceso ilimitado a o3-mini y o3-mini-high.
El acceso a la API para los modelos o3 se ha ampliado con el tiempo, con límites de tasa ajustados para satisfacer la demanda. La retirada de o3 de ChatGPT en agosto de 2026, según lo anunciado en mayo de 2026, indica un ciclo de vida planificado para el modelo, aunque el acceso a la API no se ve afectado. Esta estrategia de implementación refleja el enfoque de OpenAI para mejorar y actualizar iterativamente sus ofertas de modelos.
Véase también
- Modelo de razonamiento
- Lista de modelos de lenguaje grandes
Referencias
- Anuncios y documentación de OpenAI (2024-2026)
- Resultados de puntos de referencia informados por OpenAI
Enlaces externos
- Presentación de OpenAI o3 y o4-mini
- O3 es un 80% más barato y presentación de o3-pro