GPT-5 es un modelo de lenguaje grande multimodal desarrollado por OpenAI y el quinto de su serie de modelos fundacionales de transformador generativo preentrenado (GPT). Precedido en la serie por GPT-4, se lanzó el 7 de agosto de 2025. Es públicamente accesible para los usuarios de los productos de chatbot ChatGPT y Microsoft Copilot, así como para desarrolladores a través de la API de OpenAI.
GPT-5 representa un avance significativo en el campo de la inteligencia artificial generativa, basándose en los cimientos de los modelos de lenguaje grandes y las arquitecturas de transformador. Su lanzamiento marcó un hito en el desarrollo continuo de los sistemas de inteligencia artificial con capacidades mejoradas de razonamiento y multimodalidad.
Antecedentes
El 14 de abril de 2023, Sam Altman, el director ejecutivo de OpenAI, habló en un evento en el Instituto de Tecnología de Massachusetts y dijo que la empresa no estaba entrenando GPT-5 en ese momento. Declaró que OpenAI estaba "priorizando el desarrollo de GPT-4" y que "no estamos y no lo estaremos por algún tiempo" en lanzar GPT-5. El 18 de julio, OpenAI presentó una solicitud de marca comercial para "GPT-5" en los Estados Unidos. El 13 de noviembre, Altman confirmó al Financial Times que la empresa estaba trabajando en el desarrollo de GPT-5.
Según The Information, "[d]urante gran parte de la segunda mitad de 2024, OpenAI estuvo desarrollando un modelo conocido internamente como Orion y destinado a convertirse en GPT-5", "[p]ero el esfuerzo de Orion no logró producir un mejor modelo, y la empresa en su lugar lo lanzó como GPT-4.5 en febrero [de 2025]". A finales de julio de 2025, se anticipaba ampliamente que OpenAI planeaba lanzar GPT-5 a principios de agosto. El 30 de julio, The Verge informó que "Microsoft se está preparando para GPT-5" mientras que "fuentes familiarizadas con los planes de IA de Microsoft" dijeron a un editor que la empresa estaba probando un nuevo modo para su chatbot Copilot que ofrecería un modelo que "piensa profundamente o rápidamente según la tarea". El 5 de agosto, en la antesala del lanzamiento de GPT-5, OpenAI publicó GPT-OSS, un conjunto de dos modelos de pesos abiertos con capacidades de razonamiento. GPT-5 se presentó luego durante una transmisión en vivo el 7 de agosto.
Capacidades
En el momento de su lanzamiento, GPT-5 tenía un rendimiento de última generación en puntos de referencia que evalúan matemáticas, programación, finanzas y comprensión multimodal. Según OpenAI, las mejoras sobre sus modelos predecesores incluyen tiempos de respuesta más rápidos, mejores habilidades de codificación y escritura, respuestas más precisas a preguntas de salud y niveles más bajos de alucinación. Además, en comparación con modelos anteriores, GPT-5 tiene como objetivo dar respuestas seguras y de alto nivel a consultas potencialmente dañinas en lugar de rechazarlas directamente, un enfoque que OpenAI denomina "finalizaciones seguras", con el objetivo de lograr "que GPT-5 pueda rechazar más preguntas inseguras, mientras ofrece menos rechazos a usuarios que buscan información inofensiva". Además, GPT-5 fue entrenado para dar respuestas más críticas y "menos efusivamente complacientes" en comparación con sus modelos predecesores.
Días antes del lanzamiento de GPT-5, dos evaluadores tempranos del modelo afirmaron que estaban "impresionados" por su capacidad para codificar y resolver problemas matemáticos y científicos. Sugirieron que el modelo muestra una gran mejora respecto a GPT-4, pero no una ganancia tan grande como la de GPT-3 a GPT-4. Un día antes del lanzamiento de GPT-5, durante una sesión informativa para la prensa, Sam Altman, el director ejecutivo de OpenAI, llamó a GPT-5 "un paso significativo en el camino hacia la AGI", refiriéndose a la inteligencia artificial general, el nivel hipotético de inteligencia que OpenAI define como la capacidad de realizar cualquier tarea económicamente valiosa que un humano pueda hacer. Según Altman, GPT-5 es "significativamente mejor" que sus predecesores, ofreciendo habilidades de "nivel de doctorado" en una amplia gama de tareas.
El consumo exacto de energía del uso de GPT-5 no ha sido divulgado por OpenAI. Investigadores de la Universidad de Rhode Island estimaron que una respuesta de longitud media consume un poco más de 18 vatios-hora, equivalente a usar una bombilla incandescente durante 18 minutos.
Arquitectura
GPT-5 es un sistema que contiene un modelo rápido de alto rendimiento, un modelo de razonamiento más profundo y un enrutador en tiempo real que decide qué modelo usar según el tipo de conversación, la complejidad, las necesidades de herramientas y la intención explícita del usuario. Altman había criticado anteriormente el selector manual de modelos por ser demasiado complejo, sugiriendo la necesidad de una unificación. GPT-5 también incluye funcionalidad agéntica mediante la cual puede configurar su propio escritorio y usar su navegador para buscar de forma autónoma fuentes relacionadas con su tarea. La tarjeta de sistema de GPT-5 define dos modelos rápidos de alto rendimiento - gpt-5-main y gpt-5-main-mini - y dos modelos de pensamiento - gpt-5-thinking y gpt-5-thinking-mini. En la API de OpenAI, los desarrolladores pueden acceder al modelo de pensamiento, su versión mini y gpt-5-thinking-nano, una versión nano aún más pequeña y rápida del modelo de pensamiento. La versión de GPT-5 accesible a través de la API permite ajustar el razonamiento (alto, medio, bajo o mínimo) y la verbosidad (alta, media o baja). Además, ChatGPT proporciona acceso a gpt-5-thinking con una función que hace uso de cómputo paralelo en tiempo de prueba, denominada gpt-5-thinking-pro.
Limitaciones
Seguridad
Neuraltrust, una empresa de investigación en seguridad, afirmó haber comprometido con éxito GPT-5 dentro de su primer día de prueba del modelo. Según su informe, logró que GPT-5 generara instrucciones detalladas para fabricar dispositivos explosivos. SPLX, otra empresa, realizó pruebas similares y llegó a conclusiones parecidas sobre la seguridad de GPT-5. Sus evaluaciones sugieren que GPT-5 tiene brechas de seguridad significativas, lo que potencialmente lo hace inseguro para su uso en un entorno empresarial.
Entrenamiento
Según AIMultiple, GPT-5 es nativamente multimodal, lo que significa que fue entrenado desde cero en múltiples modalidades (como texto e imágenes) a la vez, sin depender de modelos preexistentes. Su proceso de entrenamiento implicó tres etapas: preentrenamiento no supervisado, ajuste fino supervisado y aprendizaje por refuerzo a partir de retroalimentación humana. El preentrenamiento utilizó un conjunto de datos a gran escala de libros, artículos, páginas web, trabajos académicos y fuentes de texto. Las capacidades visuales y de texto de GPT-5 se describieron como desarrolladas simultáneamente, a diferencia de GPT-4.
Uso
GPT-5 se utiliza en ChatGPT. Aunque GPT-5 es gratuito para todos los usuarios de ChatGPT, los usuarios Plus tienen límites de uso más altos y los usuarios Pro tienen acceso ilimitado a GPT-5, así como acceso limitado a GPT-5 Pro. Los límites estándar de respuestas por hora para usuarios de niveles inferiores aún se aplican. Además, con la introducción de GPT-5, el "Modo de voz estándar" de ChatGPT fue reemplazado por "ChatGPT Voice", que se supone que permite conversaciones con un sonido más natural. OpenAI declaró que "el Modo de voz estándar se retira el 9 de septiembre de 2025, unificando a todos los usuarios en ChatGPT Voice". El 24 de noviembre de 2025, se añadió a ChatGPT la función de investigación de compras, que se afirma que es un modelo mini postentrenado en gpt-5-thinking-mini.
GPT-5 también está disponible en Microsoft Copilot, y Microsoft declaró que incorporará GPT-5 en una amplia variedad de sus productos. Según 9to5Mac, Apple Inc. planea integrar el modelo en la función Apple Intelligence de sus sistemas operativos iOS 26, iPadOS 26 y macOS Tahoe. También es accesible a través de la API de OpenAI.