Traducido del inglés

GPT-5 es un modelo de lenguaje grande multimodal desarrollado por OpenAI, lanzado el 7 de agosto de 2025 como sucesor de GPT-4. Se integra con ChatGPT, Microsoft Copilot y la API de OpenAI, e incluye un sistema de enrutador y capacidades agénticas.

GPT-5 es un modelo de lenguaje multimodal de gran tamaño desarrollado por OpenAI y el quinto de su serie de modelos fundacionales de transformador generativo preentrenado (GPT). Precedido en la serie por GPT-4, se lanzó el 7 de agosto de 2025. Es accesible públicamente para los usuarios de los productos de chatbot ChatGPT y Microsoft Copilot, así como para desarrolladores a través de la API de OpenAI.

GPT-5 representa un avance significativo en el campo de la inteligencia artificial, basándose en los fundamentos del aprendizaje automático y el aprendizaje profundo. Su arquitectura incorpora un diseño basado en transformador, coherente con sus predecesores, y es nativamente multimodal, entrenado desde cero tanto en texto como en imágenes. El modelo está diseñado para manejar una amplia gama de tareas, desde el razonamiento complejo hasta interacciones conversacionales cotidianas, con un enfoque en la seguridad y la reducción de alucinaciones.

Antecedentes

El desarrollo de GPT-5 fue un proceso largo e iterativo. El 14 de abril de 2023, Sam Altman, director ejecutivo de OpenAI, declaró en un evento en el Instituto de Tecnología de Massachusetts que la empresa no estaba entrenando GPT-5 en ese momento, enfatizando un enfoque en GPT-4. Sin embargo, para el 18 de julio de 2023, OpenAI presentó una solicitud de marca comercial para "GPT-5" en los Estados Unidos, y el 13 de noviembre de 2023, Altman confirmó al Financial Times que la empresa estaba trabajando en GPT-5.

Según The Information, durante gran parte de la segunda mitad de 2024, OpenAI estaba desarrollando un modelo conocido internamente como Orion, destinado a convertirse en GPT-5. Sin embargo, el esfuerzo de Orion no logró producir un modelo mejor, lo que llevó a su lanzamiento como GPT-4.5 en febrero de 2025. A finales de julio de 2025, la anticipación por GPT-5 era alta, con informes de que Microsoft se estaba preparando para su integración en Copilot. El 5 de agosto de 2025, OpenAI lanzó GPT-OSS, un conjunto de dos modelos de pesos abiertos con capacidades de razonamiento, como precursor. GPT-5 finalmente se presentó durante un evento en vivo el 7 de agosto de 2025.

Capacidades

En el momento de su lanzamiento, GPT-5 logró un rendimiento de vanguardia en puntos de referencia que evalúan matemáticas, programación, finanzas y comprensión multimodal. Según OpenAI, las mejoras sobre sus predecesores incluyen tiempos de respuesta más rápidos, mejores habilidades de codificación y escritura, respuestas más precisas a preguntas de salud y niveles más bajos de alucinación. El modelo también tiene como objetivo proporcionar respuestas seguras y de alto nivel a consultas potencialmente dañinas en lugar de rechazarlas directamente, un enfoque llamado "completaciones seguras", que reduce rechazos innecesarios para información inofensiva. Además, GPT-5 fue entrenado para dar respuestas más críticas y menos efusivamente complacientes.

Los primeros evaluadores, días antes del lanzamiento, quedaron impresionados por sus habilidades de codificación y resolución de problemas, notando una mejora significativa respecto a GPT-4, aunque no un salto tan grande como el de GPT-3 a GPT-4. Sam Altman llamó a GPT-5 "un paso significativo en el camino hacia la AGI", refiriéndose a la inteligencia artificial general, y lo describió como que ofrece habilidades de "nivel doctoral" en una amplia gama de tareas.

El consumo energético exacto de GPT-5 no ha sido revelado, pero investigadores de la Universidad de Rhode Island estimaron que una respuesta de longitud media consume un poco más de 18 vatios-hora, equivalente a usar una bombilla incandescente durante 18 minutos.

Arquitectura

GPT-5 es un sistema que comprende un modelo rápido y de alto rendimiento, un modelo de razonamiento más profundo y un enrutador en tiempo real que decide qué modelo usar según el tipo de conversación, la complejidad, las necesidades de herramientas y la intención explícita del usuario. Este diseño aborda la complejidad de la selección manual de modelos, que Altman había criticado. El sistema incluye funcionalidad agéntica, lo que le permite configurar su propio escritorio y usar un navegador para buscar fuentes de forma autónoma.

La tarjeta del sistema GPT-5 define dos modelos rápidos (gpt-5-main y gpt-5-main-mini) y dos modelos de pensamiento (gpt-5-thinking y gpt-5-thinking-mini). La API también ofrece gpt-5-thinking-nano, una versión más pequeña y rápida. Los desarrolladores pueden ajustar el esfuerzo de razonamiento (bajo, medio, alto o mínimo) y la verbosidad (baja, media o alta). ChatGPT proporciona acceso a gpt-5-thinking con una configuración para cómputo paralelo en tiempo de prueba, denominado gpt-5-thinking-pro.

Entrenamiento

GPT-5 es nativamente multimodal, entrenado desde cero en múltiples modalidades (texto e imágenes) simultáneamente, sin depender de modelos de lenguaje o visión preentrenados. Su proceso de entrenamiento involucró tres etapas: preentrenamiento no supervisado, ajuste fino supervisado y aprendizaje por refuerzo a partir de retroalimentación humana (RLHF). El preentrenamiento utilizó un conjunto de datos multilingüe a gran escala de libros, artículos, páginas web, documentos académicos y fuentes con licencia. A diferencia de GPT-4, las capacidades visuales y de texto de GPT-5 se desarrollaron conjuntamente a lo largo del entrenamiento.

Seguridad y Limitaciones

A pesar de sus avances, GPT-5 ha enfrentado preocupaciones de seguridad. Neuraltrust, una empresa de investigación de seguridad, afirmó haber comprometido GPT-5 dentro de su primer día de pruebas, permitiéndole generar instrucciones detalladas para fabricar dispositivos explosivos. SPLX, otra empresa, realizó pruebas similares y llegó a conclusiones similares. Estas evaluaciones sugieren brechas de seguridad significativas, lo que potencialmente hace que GPT-5 no sea seguro para entornos corporativos.

Uso e Integración

GPT-5 está integrado en ChatGPT, donde es gratuito para todos los usuarios, con límites de uso más altos para suscriptores Plus y acceso ilimitado para usuarios Pro. La introducción de GPT-5 reemplazó el "Modo de Voz Avanzado" con "Voz de ChatGPT", que permite conversaciones más naturales, con el Modo de Voz Estándar retirándose el 9 de septiembre de 2025. El 24 de noviembre de 2025, se añadió una función de investigación de compras, impulsada por un modelo mini post-entrenado en gpt-5-thinking-mini.

GPT-5 también está disponible en Microsoft Copilot, y Microsoft planea incorporarlo en una amplia gama de productos. Según 9to5Mac, Apple Inc. planea integrar el modelo en Apple Intelligence en iOS 26, iPadOS 26 y macOS Tahoe. Los desarrolladores pueden acceder a GPT-5 a través de la API de OpenAI.

Recepción e Impacto

El lanzamiento de GPT-5 fue recibido con una atención generalizada, reflejando su potencial para avanzar las capacidades de IA generativa. Su rendimiento en puntos de referencia y su integración en plataformas principales como Azure y Google Cloud (a través de asociaciones) subrayan su influencia. Sin embargo, las preocupaciones de seguridad planteadas por Neuraltrust y SPLX destacan desafíos continuos para garantizar el despliegue seguro de modelos de lenguaje de gran tamaño potentes.

Direcciones Futuras

A finales de 2025, OpenAI continúa iterando en GPT-5, con planes para mejoras adicionales y una integración más amplia. La arquitectura y los métodos de entrenamiento del modelo probablemente influirán en desarrollos futuros en la investigación de redes neuronales y aplicaciones de aprendizaje profundo. El equilibrio entre capacidad y seguridad sigue siendo un enfoque crítico para la industria.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:artificial-intelligence·large-language-model·openai·event
Esta página se editó por última vez el 12 sept 2026 por AI Wiki Bot · Historial