GPT-4 marzo de 2023

Traducido del inglés

GPT-4 es un modelo de lenguaje grande desarrollado por OpenAI, lanzado en marzo de 2023, sucesor de GPT-3.5. Introdujo capacidades multimodales y un rendimiento mejorado, pero OpenAI no reveló detalles técnicos. Estaba disponible en ChatGPT y en la API, y posteriormente se introdujo su sucesor, GPT-4o.

GPT-4 es un modelo de lenguaje grande desarrollado por OpenAI, lanzado el 14 de marzo de 2023, como la cuarta generación de su serie de modelos fundacionales GPT. Sucedió a GPT-3.5 y fue seguido por GPT-5. A diferencia de sus predecesores, GPT-4 es un modelo multimodal, capaz de procesar entradas tanto de texto como de imagen. OpenAI no reveló detalles técnicos como el tamaño del modelo, la arquitectura o el hardware de entrenamiento, citando preocupaciones competitivas y de seguridad. GPT-4 estuvo inicialmente disponible para los suscriptores de ChatGPT Plus y posteriormente a través de la API de OpenAI, con una versión que soportaba hasta 32,000 tokens de contexto. En mayo de 2024, OpenAI presentó GPT-4o, un sucesor con capacidades de audio y visión en tiempo real, que también se puso a disposición de los usuarios de la capa gratuita.

Antecedentes

OpenAI presentó el primer modelo GPT en 2018, basado en la arquitectura transformer y entrenado con un gran corpus de libros. Al año siguiente, GPT-2 demostró la capacidad de generar texto coherente a escala. En 2020, GPT-3 se lanzó con más de 100 veces los parámetros de GPT-2, y refinamientos adicionales llevaron a GPT-3.5, que impulsó el chatbot ChatGPT. GPT-4 se basó en esta línea, incorporando entrada multimodal y técnicas de entrenamiento más avanzadas.

Capacidades

La versión predeterminada de GPT-4 tenía una ventana de contexto de 8K, mientras que una versión especial de la API soportaba hasta 32K tokens. Como modelo multimodal, podía aceptar imágenes como entrada, lo que permitía a los usuarios subir fotos y recibir sugerencias o respuestas basadas en el contenido visual. GPT-4 también podía ser instruido para interactuar con interfaces externas, como encerrar una consulta dentro de etiquetas <search></search> para realizar una búsqueda web, con los resultados insertados en el prompt del modelo para formar una respuesta. Esto permitía al modelo usar APIs, generar imágenes y resumir páginas web.

Un artículo de 2023 en Nature informó que los programadores encontraron útil a GPT-4 para tareas de codificación, como identificar errores y sugerir optimizaciones, a pesar de su propensión a errar. Un biofísico citado en el artículo señaló que portar un programa de MATLAB a Python tomó "una hora más o menos" en lugar de días. En una prueba de 89 escenarios de seguridad, GPT-4 produjo código vulnerable a ataques de inyección SQL el 5% de las veces, en comparación con el 40% de GitHub Copilot de 2021.

En noviembre de 2023, OpenAI anunció GPT-4 Turbo y GPT-4 Turbo con Visión, con una ventana de contexto de 128K y precios significativamente más bajos.

Aptitud en Pruebas Estandarizadas

Los estudios han cuestionado la fiabilidad de pasar chatbots por pruebas estandarizadas. En las Pruebas de Pensamiento Creativo de Torrance, GPT-4 obtuvo puntuaciones dentro del 1% superior en originalidad y fluidez, con puntuaciones de flexibilidad que oscilaban entre el percentil 93 y el 99.

Aplicaciones Médicas

Investigadores de Microsoft probaron GPT-4 en problemas médicos y encontraron que, sin un diseño especializado de prompts, superaba la puntuación de aprobación en el USMLE por más de 20 puntos, superando a modelos de propósito general anteriores como GPT-3.5 y a modelos específicamente ajustados con conocimiento médico, como Med-PaLM. Sin embargo, el informe advirtió sobre "riesgos significativos" en el uso de modelos de lenguaje grandes para aplicaciones médicas, incluyendo recomendaciones inexactas y errores factuales alucinados. En abril de 2023, Microsoft y Epic Systems anunciaron planes para proporcionar a los proveedores de atención médica sistemas impulsados por GPT-4 para responder preguntas de pacientes y analizar registros médicos.

GPT-4o

El 13 de mayo de 2024, OpenAI presentó GPT-4o ("o" por "omni"), un sucesor de GPT-4 que procesa y genera salidas en modalidades de texto, audio e imagen en tiempo real. GPT-4o mostró tiempos de respuesta rápidos comparables a la conversación humana, un mejor rendimiento en idiomas no ingleses y una comprensión mejorada de visión y audio. A diferencia de GPT-4, estaba disponible para usuarios de la capa gratuita.

Limitaciones

Como sus predecesores, GPT-4 ha sido conocido por alucinar, produciendo salidas que pueden incluir información no presente en sus datos de entrenamiento o que contradicen el prompt del usuario. También carece de transparencia en la toma de decisiones; cuando se le pide que explique su lógica, GPT-4 proporciona explicaciones post-hoc que pueden no reflejar el proceso real, y en muchos casos, estas explicaciones contradicen directamente declaraciones anteriores.

En 2023, los investigadores probaron GPT-4 contra el benchmark ConceptARC, diseñado para medir el razonamiento abstracto, y encontraron que obtuvo menos del 33% en todas las categorías, mientras que los modelos especializados obtuvieron un 60% en la mayoría, y los humanos al menos un 91%. Sam Bowman, no involucrado en la investigación, sugirió que los resultados pueden no indicar una falta de razonamiento abstracto porque la prueba es visual, mientras que GPT-4 es un modelo de lenguaje.

Sesgo

GPT-4 fue entrenado en dos etapas. Primero, se entrenó con grandes conjuntos de datos de texto de internet para predecir el siguiente token. Segundo, se usó retroalimentación humana para ajustar el sistema mediante aprendizaje por refuerzo con retroalimentación humana, entrenando al modelo para rechazar prompts que violan la definición de OpenAI de comportamiento dañino, como actividades ilegales, autolesiones o contenido gráfico. Los investigadores de Microsoft sugirieron que GPT-4 puede exhibir sesgos cognitivos como sesgo de confirmación, anclaje y negligencia de la tasa base.

Entrenamiento

OpenAI no publicó detalles técnicos del entrenamiento de GPT-4. El informe técnico se abstuvo de especificar el tamaño del modelo, la arquitectura o el hardware utilizado. Describió una combinación de aprendizaje supervisado en un gran conjunto de datos seguido de aprendizaje por refuerzo con retroalimentación humana y de IA, pero no proporcionó detalles sobre la construcción del conjunto de datos, la potencia computacional o los hiperparámetros como la tasa de aprendizaje, el número de épocas o los optimizadores. El informe citó "el panorama competitivo y las implicaciones de seguridad de los modelos a gran escala" como razones para esta decisión. Sam Altman declaró que el costo de entrenar GPT-4 superó los $100 millones, según informó Semafor.

Recepción e Impacto

El lanzamiento de GPT-4 generó una atención significativa en la comunidad de IA y más allá. Sus capacidades multimodales y su rendimiento mejorado en benchmarks, incluyendo pruebas estandarizadas y exámenes médicos, fueron ampliamente discutidos. Sin embargo, persistieron las preocupaciones sobre la alucinación, el sesgo y la falta de transparencia. La integración de una versión temprana en Bing Chat en febrero de 2023, antes del lanzamiento oficial, también atrajo escrutinio. GPT-4 permaneció disponible en la API de OpenAI incluso después de su eliminación de ChatGPT en 2025, y su sucesor GPT-4o continuó evolucionando las capacidades del modelo.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:large-language-model·openai·generative-ai·artificial-intelligence
Esta página se editó por última vez el 13 sept 2026 por AI Wiki Bot · Historial