GPT Image 1.5 é um modelo de inteligência artificial generativa desenvolvido pela OpenAI para criação e edição de imagens. Lançado em 2025, é o sucessor do GPT Image 1 e está integrado no ChatGPT e na API da OpenAI, permitendo aos usuários gerar e modificar imagens a partir de instruções em linguagem natural. O modelo basea-se na arquitetura de modelo de linguagem de grande escala da OpenAI, combinando compreensão multimodal com síntesis de imagens baseada em difusión.
GPT Image 1.5 foi anunciado pela OpenAI no início de 2025, com lançamento público em março de 2025. Ficou disponível para assinantes do ChatGPT Plus, Pro e Team, bem como através da API para desenvolvedores. O modelo também é acessível através das ofertas empresariales da OpenAI, incluindo o Azure OpenAI Service da Microsoft.
Capacidades
GPT Image 1.5 introduz várias melhorias em relação ao seu predecessor, incluindo saída de maior resolução (até 2048x2048 píxeles), melhor aderência a instruções complexas e renderização mais precisa de texto dentro das imagens. O modelo suporta edição multi-turno, permitendo aos usuários refinar imagens através de instruções conversacionais. Também pode gerar imagens com personajes e estilos consistentes em múltiples saídas, uma funcionalidade dirigida a profissionais criativos.
Según a documentação técnica da OpenAI, GPT Image 1.5 usa uma abordagem híbrida que combina um transformador autorregresivo para layout e composición com um decodificador de difusión para detalhes a nível de píxel. Isto permite escenas mais coerentes e reduz artefactos comuns como manos distorsionadas ou texto ilegible.
Desempeño e Benchmarks
En evaluaciones internas, OpenAI informó que GPT Image 1.5 superó a GPT Image 1 no benchmark MMMU (Compreensão Multimodal Multidisciplinaria) e en pruebas de preferencia humana para fotorrealismo e alineación de instrucciones. Benchmarks independientes, como os do índice de inteligencia Artificial Analysis, colocaron a GPT Image 1.5 entre os principais modelos de generación de imágenes em 2025, rivalizando con sistemas de Google DeepMind e outros laboratorios.
O modelo também demostró capacidades mejoradas para generar imágenes con detalles finos, como texto pequeño, logotipos e diagramas científicos. OpenAI señaló que GPT Image 1.5 redujo los errores en la renderización de pasajes largos de texto en aproximadamente un 40% en comparación con la versión anterior.
API e Precios
GPT Image 1.5 está disponible a través de la API de OpenAI con una estructura de precios escalonada. A partir del lanzamiento, el modelo se preció en $0.02 por imagen para resolución estándar (1024x1024) y $0.08 por imagen para alta resolución (2048x2048). La API admite parámetros para calidad, tamaño y estilo, e integra con el endpoint de completaciones de chat existente.
Los desarrolladores pueden usar GPT Image 1.5 para aplicaciones que van desde la generación de contenido de marketing hasta la creación de prototipos de diseño. OpenAI también ofrece opciones de ajuste fino para clientes empresariales, permitiendo la personalización en conjuntos de datos específicos, aunque esta funcionalidad está limitada a socios seleccionados.
Seguridad y Limitaciones
OpenAI implementó varias medidas de seguridad para GPT Image 1.5, incluidos filtros de contenido para prevenir la generación de imágenes dañinas o engañosas. El modelo incluye una marca de agua C2PA para indicar contenido generado por IA, y OpenAI ha restringido la generación de rostros realistas de figuras públicas sin consentimiento. A pesar de estas medidas, el modelo aún puede producir representaciones sesgadas o inexactas, y OpenAI aconseja a los usuarios revisar los resultados para verificar su corrección factual.
Como con otros modelos de red neuronal, GPT Image 1.5 tiene limitaciones en la comprensión de conceptos abstractos y puede tener dificultades con instrucciones muy específicas o ambiguas. Los datos de entrenamiento del modelo incluyen imágenes y texto disponibles públicamente en internet, lo que puede introducir sesgos culturales.
Recepción
GPT Image 1.5 recibió críticas positivas de los medios tecnológicos y comunidades creativas por su mejor renderización de texto y capacidades de edición. Los críticos señalaron que, aunque no reemplaza completamente las herramientas de diseño profesional, reduce significativamente la barrera para la creación rápida de prototipos visuales. Se plantearon algunas preocupaciones sobre el potencial de uso indebido en la creación de imágenes engañosas, lo que llevó a OpenAI a actualizar sus políticas de uso.
A mediados de 2025, GPT Image 1.5 fue ampliamente adoptado en industrias como publicidad, comercio electrónico y educación. También se convirtió en una herramienta común en la investigación académica para generar figuras ilustrativas y visualizaciones de datos.