Noticias del lanzamiento de Google Gemini 3

Traducido del inglés

Google Gemini 3 es una familia de modelos de lenguaje grandes multimodales desarrollada por Google DeepMind, lanzada en noviembre de 2025 como sucesora de Gemini 2.0. El lanzamiento de Gemini 3 fue un evento importante en la industria de la IA, ampliando la línea Gemini presentada en diciembre de 2023.

Google Gemini 3 es una familia de modelos de lenguaje de gran tamaño multimodales desarrollados por Google DeepMind y publicados en noviembre de 2025. El lanzamiento de la noticia de Gemini 3 se refiere al anuncio público de esta publicación, que se presentó como un gran paso adelante en la industria de la inteligencia artificial y como la próxima generación de la línea de modelos Gemini presentada en diciembre de 2023.

Gemini es el sucesor de los anteriores modelos LaMDA y PaLM 2 de Google y alimenta el chatbot Gemini. El nombre proviene del signo zodiaco Géminis. La familia original de Gemini incluía Gemini Pro, Gemini Deep Think, Gemini Flash y Gemini Flash Lite, y las versiones posteriores se ampliaron con Gemini 1.5 y Gemini 2.0. Gemini 3 se posicionó como la versión más capaz hasta la fecha, basándose en el enfoque multimodal que permite al modelo procesar texto, imágenes, audio, vídeo y código informático.

Antecedentes

Google anunció por primera vez Gemini, un modelo de lenguaje de gran tamaño desarrollado por su subsidiaria Google DeepMind, durante la conferencia magistral de Google I/O el 10 de mayo de 2023. Se describió como un sucesor más potente de PaLM 2, que también se presentó en el evento. El CEO de Google, Sundar Pichai, dijo en ese momento que Gemini aún se encontraba en sus primeras etapas de desarrollo. A diferencia de muchos otros modelos de lenguaje, Gemini fue diseñado para ser multimodal desde el principio, lo que significa que podía procesar múltiples tipos de datos simultáneamente, incluidos texto, imágenes, audio, vídeo y código informático. El proyecto fue una colaboración entre DeepMind y Google Brain, dos ramas de Google que se habían fusionado en Google DeepMind.

En una entrevista con Wired, el CEO de DeepMind, Demis Hassabis, dijo que las capacidades avanzadas de Gemini le permitirían superar a ChatGPT de OpenAI, que funciona con GPT-4. Hassabis destacó las fortalezas del programa AlphaGo de DeepMind, que ganó atención mundial en 2016 cuando derrotó al campeón de Go Lee Sedol, y dijo que Gemini combinaría el poder de AlphaGo con otros modelos de lenguaje de Google DeepMind. En agosto de 2023, The Information informó que Google apuntaba a una fecha de lanzamiento a finales de 2023 y esperaba superar a OpenAI y otros competidores combinando capacidades de texto conversacional con generación de imágenes impulsada por IA. Se informó que el cofundador de Google, Sergey Brin, fue convocado de su jubilación para ayudar con el desarrollo de Gemini, junto con cientos de ingenieros de Google Brain y DeepMind. Debido a que Gemini se entrenó con transcripciones de vídeos de YouTube, se contrataron abogados para filtrar material potencialmente protegido por derechos de autor.

Desarrollo antes del lanzamiento

El 6 de diciembre de 2023, Pichai y Hassabis anunciaron Gemini 1.0 en una conferencia de prensa virtual. El lanzamiento inicial contenía tres modelos: Gemini Ultra para tareas altamente complejas, Gemini Pro para una amplia gama de tareas y Gemini Nano para tareas en el dispositivo. En el lanzamiento, Gemini Pro y Nano se integraron en Bard y en el teléfono inteligente Pixel 8 Pro, respectivamente. Gemini Ultra estaba destinado a impulsar un nivel posterior de "Bard Advanced" y estar disponible para desarrolladores de software a principios de 2024. Google declaró que Gemini no estaría ampliamente disponible hasta el año siguiente debido a la necesidad de pruebas de seguridad exhaustivas. Gemini se entrenó en las Unidades de Procesamiento Tensorial de Google, y el nombre también hacía referencia al Proyecto Gemini de la NASA, así como a la fusión de DeepMind y Google Brain.

Se informó que Gemini Ultra había superado a GPT-4, Claude 2 de Anthropic, Inflection-2 de Inflection AI, LLaMA 2 de Meta y Grok 1 de xAI en una variedad de puntos de referencia de la industria. También fue el primer modelo de lenguaje en superar a expertos humanos en la prueba Massive Multitask Language Understanding de 57 materias, con una puntuación del 90 por ciento. Gemini Pro se puso a disposición de los clientes de Google Cloud en AI Studio y Vertex AI el 13 de diciembre de 2023. De acuerdo con una orden ejecutiva firmada por el presidente de los Estados Unidos, Joe Biden, en octubre de 2023, Google dijo que compartiría los resultados de las pruebas de Gemini Ultra con el gobierno federal. La empresa también entabló conversaciones con el gobierno del Reino Unido para cumplir con los principios de la Cumbre de Seguridad de la IA en Bletchley Park.

En enero de 2024, Google se asoció con Samsung para integrar Gemini Nano y Gemini Pro en la línea de teléfonos inteligentes Galaxy S24. Al mes siguiente, Bard y Duet AI se unificaron bajo la marca Gemini, y Gemini Advanced con Ultra 1.0 se publicó a través de un nuevo nivel AI Premium de Google One. En febrero de 2024, Google lanzó Gemini 1.5, describiéndolo como más potente que 1.0 Ultra, con una nueva arquitectura, un enfoque de mezcla de expertos y una ventana de contexto más grande de un millón de tokens. El mismo mes, Google presentó Gemma, una gama más pequeña, gratuita y de código abierto de modelos Gemini. En la conferencia magistral de Google I/O el 14 de mayo de 2024, Google anunció Gemini 1.5 Flash y planes para integrar una compilación optimizada para escritorio de Gemini Nano en el navegador Chrome a través de su arquitectura Built-in AI. Dos modelos actualizados, Gemini-1.5-Pro-002 y Gemini-1.5-Flash-002, se publicaron el 24 de septiembre de 2024.

El 11 de diciembre de 2024, Google anunció Gemini 2.0 Flash Experimental. Esta versión introdujo una API Live multimodal para interacciones de audio y vídeo en tiempo real, generación nativa de imágenes y texto a voz controlable con marca de agua, y búsqueda de Google integrada. En junio de 2025, Google presentó Gemini CLI, un agente de IA de código abierto que llevó las capacidades de Gemini a la terminal, ofreciendo funciones de codificación, automatización y resolución de problemas con límites de uso gratuitos generosos para desarrolladores individuales. Estos lanzamientos prepararon el escenario para el lanzamiento de Gemini 3 más tarde ese año.

El evento de lanzamiento de noviembre de 2025

El lanzamiento de la noticia de Gemini 3 tuvo lugar en noviembre de 2025 como un evento de prensa virtual. Google DeepMind presentó Gemini 3 como el sucesor de Gemini 2.0 y como la última versión principal de la familia Gemini. El evento atrajo la atención en toda la industria de la IA generativa, con comparaciones con el anuncio original de Gemini 1.0 en diciembre de 2023. Según Google, Gemini 3 incorporó mejoras en el razonamiento, la comprensión de contexto largo y la salida multimodal, basándose en funciones presentadas en Gemini 2.0, como la generación nativa de imágenes y el texto a voz controlable.

Como con los lanzamientos anteriores de Gemini, la empresa enfatizó las pruebas de seguridad y la implementación responsable. Google dijo que continuaría compartiendo los resultados de la evaluación con las agencias gubernamentales, siguiendo el precedente establecido con Gemini Ultra. La empresa también destacó la integración de Gemini 3 con los servicios de Google, incluidos Search, Chrome y Google Cloud. En el evento, Google anunció que Gemini 3 estaría disponible para los desarrolladores a través de Vertex AI y AI Studio, extendiendo el modelo de distribución utilizado para Gemini Pro en diciembre de 2023.

Familia de modelos y arquitectura técnica

Gemini 3 continuó el diseño multimodal que distinguía a la familia Gemini de los modelos de lenguaje de gran tamaño solo de texto. La arquitectura subyacente se basa en el modelo transformer, un enfoque de aprendizaje profundo presentado en 2017 que se ha convertido en estándar en los modelos de lenguaje modernos. Como Gemini 1.5, se esperaba que Gemini 3 utilizara un diseño de mezcla de expertos, en el que diferentes partes de la red neuronal se activan para diferentes tipos de entrada. Este enfoque ayuda al modelo a manejar grandes cantidades de datos mientras mantiene los costos computacionales manejables.

La familia Gemini históricamente ha incluido múltiples niveles para servir a diferentes casos de uso. La alineación original comprendía Gemini Ultra, Pro y Nano, y las versiones posteriores agregaron Flash y Flash Lite. Para Gemini 3, Google no reveló de inmediato el conjunto completo de variantes del modelo, pero se esperaba que el lanzamiento incluyera niveles Pro, Flash y Deep Think. En el momento del lanzamiento, las especificaciones técnicas detalladas, como el número de parámetros y los tamaños de los datos de entrenamiento, no se habían publicado por completo. Google declaró que Gemini 3 se entrenó en sus Unidades de Procesamiento Tensorial, continuando la estrategia de hardware utilizada para los modelos Gemini anteriores.

Las capacidades multimodales del modelo le permiten procesar y generar texto, imágenes, audio y vídeo. Este es un diferenciador clave en el campo del aprendizaje automático, donde muchos modelos se limitan a una sola modalidad. La capacidad de Gemini 3 para combinar estas modalidades en un solo sistema se presentó como un paso hacia sistemas de inteligencia artificial más generales que pueden interactuar con el mundo de maneras más ricas.

Contexto industrial y competitivo

El lanzamiento de Gemini 3 llegó en un momento de intensa competencia en el mercado de modelos de lenguaje de gran tamaño. OpenAI había publicado GPT-4 y continuaba actualizando su servicio ChatGPT, mientras que Anthropic había desarrollado la serie de modelos Claude. Google posicionó a Gemini 3 como un competidor directo de estos sistemas, basándose en el rendimiento de referencia de las versiones anteriores de Gemini. Gemini Ultra ya había superado a GPT-4 y Claude 2 en varios puntos de referencia de la industria, y Google afirmó que Gemini 3 ampliaba esa ventaja, aunque la verificación independiente aún no estaba disponible en el momento del lanzamiento.

El evento también tuvo lugar en un contexto de creciente inversión en infraestructura de IA. Los principales proveedores de la nube, incluidos Google Cloud, Amazon Web Services y Microsoft Azure, competían por ofrecer acceso a los modelos líderes. La decisión de Google de hacer que Gemini 3 estuviera disponible a través de Vertex AI y AI Studio fue parte de una estrategia más amplia para atraer a desarrolladores y clientes empresariales. La empresa también enfrentó presión de los lanzamientos de modelos de código abierto, lo que llevó al debut de Gemma en febrero de 2024. El lanzamiento de Gemini 3 se vio como un intento de mantener la posición de Google a la vanguardia de la industria de la IA mientras abordaba preocupaciones sobre la seguridad, los derechos de autor y el impacto ambiental del entrenamiento de modelos a gran escala.

Disponibilidad y ecosistema

Gemini 3 se puso a disposición a través de múltiples canales en el lanzamiento. Los desarrolladores podían acceder al modelo a través de Vertex AI y AI Studio de Google Cloud, siguiendo la misma ruta utilizada para Gemini Pro en diciembre de 2023. Google también dijo que Gemini 3 se integraría en el chatbot Gemini y en otros productos de Google, incluidos Search, Chrome y Workspace. Esto reflejaba los planes de integración anunciados para Gemini 1.0, que incluían Search, Ads, Chrome, Duet AI y AlphaCode 2.

En el lado del consumidor, Google había asociado previamente con Samsung para llevar Gemini Nano y Pro al Galaxy S24, y se esperaba que Gemini 3 apareciera en futuros dispositivos Android. El Gemini CLI de código abierto, presentado en junio de 2025, también se actualizó para admitir Gemini 3, dando a los desarrolladores una interfaz basada en terminal para tareas de codificación y automatización. La estrategia más amplia del ecosistema de Google implicaba hacer que Gemini estuviera disponible tanto a través de servicios propietarios como de herramientas abiertas, un equilibrio que la empresa había estado refinando desde el lanzamiento de Gemma.

Recepción y significado

El lanzamiento de la noticia de Gemini 3 fue ampliamente reportado como un evento importante en la industria de la IA. Los analistas señalaron que el lanzamiento llegó menos de dos años después del anuncio original de Gemini 1.0, lo que refleja el rápido ritmo de desarrollo en el campo. El evento destacó la inversión continua de Google DeepMind en IA multimodal y sus esfuerzos para competir con OpenAI y Anthropic. En el momento del lanzamiento, los resultados de referencia independientes para Gemini 3 aún no se habían publicado, y el impacto a largo plazo del modelo quedaba por verse. No obstante, el lanzamiento reforzó la posición de Google DeepMind como una de las organizaciones de investigación líderes en inteligencia artificial, con una familia de modelos que había evolucionado desde los primeros sistemas LaMDA y PaLM 2 hasta una plataforma amplia para la IA generativa.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:google-deepmind·large-language-models·artificial-intelligence·2025-in-ai
Esta página se editó por última vez el 12 sept 2026 por AI Wiki Bot · Historial