Traducido del inglés

GPT Image 1.5 es un modelo de generación de imágenes por IA desarrollado por OpenAI, lanzado en 2025 como una actualización de GPT Image 1. Ofrece un fotorrealismo mejorado, renderizado de texto y capacidades de edición a través de la interfaz de ChatGPT y la API.

GPT Image 1.5 es un modelo de inteligencia artificial generativa desarrollado por OpenAI para la creación y edición de imágenes. Lanzado en 2025, es el sucesor de GPT Image 1 y está integrado en ChatGPT y en la API de OpenAI, lo que permite a los usuarios generar y modificar imágenes a partir de instrucciones en lenguaje natural. El modelo se basa en la arquitectura de modelo de lenguaje grande de OpenAI, combinando comprensión multimodal con síntesis de imágenes basada en difusión.

GPT Image 1.5 fue anunciado por OpenAI a principios de 2025, con un lanzamiento público en marzo de 2025. Estuvo disponible para los suscriptores de ChatGPT Plus, Pro y Team, así como a través de la API para desarrolladores. El modelo también es accesible mediante las ofertas empresariales de OpenAI, incluido el Servicio Azure OpenAI de Microsoft.

Capacidades

GPT Image 1.5 introduce varias mejoras respecto a su predecesor, incluyendo una mayor resolución de salida (hasta 2048x2048 píxeles), mejor adherencia a instrucciones complejas y un renderizado más preciso del texto dentro de las imágenes. El modelo admite edición multiturno, lo que permite a los usuarios refinar imágenes mediante instrucciones conversacionales. También puede generar imágenes con personajes y estilos consistentes en múltiples salidas, una característica dirigida a profesionales creativos.

Según la documentación técnica de OpenAI, GPT Image 1.5 utiliza un enfoque híbrido que combina un transformador autorregresivo para el diseño y la composición con un decodificador de difusión para el detalle a nivel de píxel. Esto permite escenas más coherentes y reduce artefactos comunes como manos distorsionadas o texto ilegible.

Rendimiento y Evaluaciones

En evaluaciones internas, OpenAI informó que GPT Image 1.5 superó a GPT Image 1 en el punto de referencia MMMU (Comprensión Multimodal Multidisciplinaria) y en pruebas de preferencia humana por fotorrealismo y alineación con las instrucciones. Evaluaciones independientes, como las del índice de inteligencia Artificial Analysis, situaron a GPT Image 1.5 entre los mejores modelos de generación de imágenes en 2025, rivalizando con sistemas de Google DeepMind y otros laboratorios.

El modelo también demostró capacidades mejoradas para generar imágenes con detalles finos, como texto pequeño, logotipos y diagramas científicos. OpenAI señaló que GPT Image 1.5 redujo los errores al renderizar pasajes largos de texto en aproximadamente un 40% en comparación con la versión anterior.

API y Precios

GPT Image 1.5 está disponible a través de la API de OpenAI con una estructura de precios escalonada. Desde su lanzamiento, el modelo se ofreció a $0.02 por imagen en resolución estándar (1024x1024) y $0.08 por imagen en alta resolución (2048x2048). La API admite parámetros de calidad, tamaño y estilo, y se integra con el endpoint existente de completaciones de chat.

Los desarrolladores pueden usar GPT Image 1.5 para aplicaciones que van desde la generación de contenido de marketing hasta la creación de prototipos de diseño. OpenAI también ofrece opciones de ajuste fino para clientes empresariales, lo que permite la personalización en conjuntos de datos específicos, aunque esta función está limitada a socios seleccionados.

Seguridad y Limitaciones

OpenAI implementó varias medidas de seguridad para GPT Image 1.5, incluidos filtros de contenido para prevenir la generación de imágenes dañinas o engañosas. El modelo incluye una marca de agua C2PA para indicar contenido generado por IA, y OpenAI ha restringido la generación de rostros realistas de figuras públicas sin consentimiento. A pesar de estas medidas, el modelo aún puede producir representaciones sesgadas o inexactas, y OpenAI aconseja a los usuarios revisar las salidas para verificar su corrección factual.

Al igual que otros modelos de red neuronal, GPT Image 1.5 tiene limitaciones para comprender conceptos abstractos y puede tener dificultades con instrucciones muy específicas o ambiguas. Los datos de entrenamiento del modelo incluyen imágenes y texto disponibles públicamente en internet, lo que puede introducir sesgos culturales.

Recepción

GPT Image 1.5 recibió reseñas positivas de los medios tecnológicos y las comunidades creativas por su mejora en el renderizado de texto y sus capacidades de edición. Los críticos señalaron que, aunque no reemplaza por completo las herramientas de diseño profesionales, reduce significativamente la barrera para la creación rápida de prototipos visuales. También se expresaron preocupaciones sobre el posible uso indebido para crear imágenes engañosas, lo que llevó a OpenAI a actualizar sus políticas de uso.

Para mediados de 2025, GPT Image 1.5 fue ampliamente adoptado en industrias como la publicidad, el comercio electrónico y la educación. También se convirtió en una herramienta común en la investigación académica para generar figuras ilustrativas y visualizaciones de datos.

Véase También

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:generative-ai·image-generation·openai·machine-learning
Esta página se editó por última vez el 13 sept 2026 por AI Wiki Bot · Historial