GPT-5 es un modelo de lenguaje grande multimodal desarrollado por OpenAI y el quinto de su serie de modelos fundacionales de transformador generativo preentrenado (GPT). Precedido en la serie por GPT-4, se lanzó el 7 de agosto de 2025. Es de acceso público para los usuarios de los productos de chatbot ChatGPT y Microsoft Copilot, así como para desarrolladores a través de la API de OpenAI. GPT-5 está diseñado como un sistema de razonamiento híbrido que combina respuestas rápidas y de alto rendimiento con un pensamiento más profundo y deliberado, y admite una ventana de contexto de 400.000 tokens, lo que permite procesar documentos extensos y tareas complejas.
Antecedentes
El desarrollo de GPT-5 estuvo marcado por una serie de declaraciones públicas y cambios internos. El 14 de abril de 2023, Sam Altman, director ejecutivo de OpenAI, habló en un evento en el Instituto de Tecnología de Massachusetts y dijo que la empresa no estaba entrenando GPT-5 en ese momento. Afirmó que OpenAI estaba "priorizando el desarrollo de GPT-4" y que "no estamos y no lo estaremos por algún tiempo" lanzando GPT-5. El 18 de julio, OpenAI solicitó una marca comercial "GPT-5" en Estados Unidos. El 13 de noviembre, Altman confirmó al Financial Times que la empresa estaba trabajando para desarrollar GPT-5.
Según The Information, "[d]urante gran parte de la segunda mitad de 2024, OpenAI estaba desarrollando un modelo conocido internamente como Orion y destinado a convertirse en GPT-5", "[p]ero el esfuerzo de Orion no logró producir un mejor modelo, y la empresa lo lanzó en su lugar como GPT-4.5 en febrero [de 2025]." A finales de julio de 2025, se anticipaba ampliamente que OpenAI planeaba lanzar GPT-5 a principios de agosto. El 30 de julio, The Verge informó que "Microsoft se está preparando para GPT-5", ya que "fuentes familiarizadas con los planes de IA de Microsoft" dijeron a un editor que la empresa estaba probando un nuevo modo para su chatbot Copilot que ofrecería un modelo que "piensa profundamente o rápidamente según la tarea". El 5 de agosto, en la antesala del lanzamiento de GPT-5, OpenAI publicó GPT-OSS, un conjunto de dos modelos de pesos abiertos con capacidades de razonamiento. GPT-5 se presentó luego durante un evento de transmisión en vivo el 7 de agosto.
Capacidades
En el momento de su lanzamiento, GPT-5 tenía un rendimiento de vanguardia en puntos de referencia que evalúan matemáticas, programación, finanzas y comprensión multimodal. Según OpenAI, las mejoras con respecto a sus modelos predecesores incluyen tiempos de respuesta más rápidos, mejores habilidades de codificación y escritura, respuestas más precisas a preguntas de salud y niveles más bajos de alucinación. Además, en comparación con modelos anteriores, GPT-5 apunta a dar respuestas seguras y de alto nivel a consultas potencialmente dañinas en lugar de rechazarlas por completo, un enfoque que OpenAI denomina "completados seguros", con el objetivo de que "GPT-5 pueda rechazar más preguntas inseguras, ofreciendo menos rechazos a usuarios que buscan información inofensiva". Asimismo, GPT-5 fue entrenado para dar respuestas más críticas y "menos efusivamente complacientes" en comparación con sus modelos predecesores.
Días antes del lanzamiento de GPT-5, dos probadores tempranos del modelo afirmaron estar "impresionados" por su capacidad para codificar y resolver problemas matemáticos y científicos. Sugirieron que el modelo muestra una gran mejora con respecto a GPT-4, pero no un avance tan grande como el de GPT-3 a GPT-4. Un día antes del lanzamiento de GPT-5, durante una sesión informativa para la prensa, Sam Altman, director ejecutivo de OpenAI, calificó a GPT-5 como "un paso significativo en el camino hacia la AGI", refiriéndose a la inteligencia artificial general, el nivel hipotético de inteligencia que OpenAI define como la capacidad de realizar cualquier tarea económicamente valiosa que un humano pueda hacer. Según Altman, GPT-5 es "significativamente mejor" que sus predecesores, ofreciendo capacidades de "nivel doctoral" en una amplia gama de tareas.
El consumo exacto de energía del uso de GPT-5 no ha sido divulgado por OpenAI. Investigadores de la Universidad de Rhode Island estimaron que una respuesta de longitud media consume algo más de 18 vatios-hora, equivalente a usar una bombilla incandescente durante 18 minutos.
Arquitectura
GPT-5 es un sistema que contiene un modelo rápido y de alto rendimiento, un modelo de razonamiento más profundo y un enrutador en tiempo real que decide qué modelo usar según el tipo de conversación, la complejidad, las necesidades de herramientas y la intención explícita del usuario. Altman había criticado previamente el selector manual de modelos por ser excesivamente complejo, sugiriendo la necesidad de una unificación. GPT-5 también incluye funcionalidad agéntica mediante la cual puede configurar su propio escritorio y usar su navegador para buscar de forma autónoma fuentes relacionadas con su tarea. La tarjeta del sistema de GPT-5 define dos modelos rápidos y de alto rendimiento - gpt-5-main y gpt-5-main-mini - y dos modelos de pensamiento - gpt-5-thinking y gpt-5-thinking-mini. En la API de OpenAI, los desarrolladores pueden acceder al modelo de pensamiento, su versión mini y gpt-5-thinking-nano, una versión nano aún más pequeña y rápida del modelo de pensamiento. La versión de GPT-5 accesible a través de la API tiene un esfuerzo de razonamiento ajustable (bajo, medio, alto o mínimo) y una verbosidad ajustable (baja, media o alta). Además, ChatGPT proporciona acceso a gpt-5-thinking con una configuración que utiliza cómputo paralelo en tiempo de prueba, denominado gpt-5-thinking-pro.
Limitaciones
Seguridad
Neuraltrust, una empresa de investigación en seguridad, afirmó haber comprometido con éxito GPT-5 dentro de su primer día de prueba del modelo. Según su informe, permitió que GPT-5 generara instrucciones detalladas para fabricar artefactos explosivos. SPLX, otra empresa, realizó pruebas similares y llegó a conclusiones similares sobre la seguridad de GPT-5. Sus evaluaciones sugieren que GPT-5 tiene brechas de seguridad significativas, lo que potencialmente lo hace inseguro para su uso en un entorno corporativo.
Entrenamiento
Según AIMultiple, GPT-5 es nativamente multimodal, lo que significa que fue entrenado desde cero en múltiples modalidades (como texto e imágenes) a la vez, sin depender de modelos de lenguaje o visión ya entrenados. Su proceso de entrenamiento implicó tres etapas: preentrenamiento no supervisado, ajuste fino supervisado y aprendizaje por refuerzo con retroalimentación humana. El preentrenamiento utilizó un conjunto de datos multilingüe a gran escala de libros, artículos, páginas web, documentos académicos y fuentes con licencia. Se describió que las capacidades visuales y de texto de GPT-5 se desarrollaron en conjunto a lo largo del entrenamiento, a diferencia de GPT-4.
Uso
GPT-5 se utiliza en ChatGPT. Aunque GPT-5 es gratuito para todos los usuarios de ChatGPT, los usuarios de Plus obtienen límites de uso más altos, mientras que los usuarios de Pro tienen acceso ilimitado a GPT-5, así como acceso limitado a GPT-5 Pro. Siguen aplicándose límites estándar para usuarios de niveles inferiores en cuanto a respuestas por hora. Además, con la introducción de GPT-5, el "Modo de voz avanzado" de ChatGPT fue reemplazado por "ChatGPT Voice", que se supone que permite conversaciones con un sonido más natural. OpenAI declaró que "El Modo de voz estándar se retira el 9 de septiembre de 2025, unificando a todos los usuarios en ChatGPT Voice". El 24 de noviembre de 2025, se añadió la función de investigación de compras a ChatGPT, que se afirma ser un modelo mini post-entrenado en gpt-5-thinking-mini.
GPT-5 también está disponible en Microsoft Copilot, y Microsoft declaró que incorporará GPT-5 en una amplia variedad de sus productos. Según 9to5Mac, Apple Inc. planea integrar el modelo en la función Apple Intelligence en sus sistemas operativos iOS 26, iPadOS 26 y macOS Tahoe. También es accesible a través de la API de OpenAI, lo que permite a los desarrolladores construir aplicaciones sobre el modelo.
Recepción e Impacto
El lanzamiento de GPT-5 generó una atención significativa dentro de la comunidad de inteligencia artificial. Las evaluaciones tempranas destacaron sus capacidades avanzadas de razonamiento y multimodalidad, posicionándolo como un modelo de lenguaje grande líder de su época. La arquitectura híbrida, que combina modelos rápidos y de pensamiento, se vio como una respuesta a la creciente demanda de sistemas de IA más eficientes y capaces. Sin embargo, las preocupaciones de seguridad planteadas por Neuraltrust y SPLX provocaron debates sobre la seguridad de desplegar modelos tan potentes en entornos empresariales. La integración con Microsoft Copilot y la integración planificada con Apple Intelligence subrayaron la tendencia de incrustar IA generativa en productos de consumo convencionales. A finales de 2025, GPT-5 sigue siendo un punto focal en las discusiones sobre la trayectoria del aprendizaje automático y el camino hacia la inteligencia general de inteligencia artificial.