2/10/2026

La familia de modelos Gemini se multiplica

En la carrera por el mercado de la inteligencia artificial, hace tiempo ha quedado claro que lo más apetitoso está en el segmento empresarial. Y en este contexto, Google ha sabido adoptar una estrategia metódica para cubrir todos los nichos profesionales a su alcance. El lanzamiento esta semana de su modelo Gemini 4 Argon no hace sino reforzar este empuje. Todavía está en la fase de distribución controlada pero el nuevo modelo se instala de entrada en la vanguardia de su especie, aunque a precio reducido. Justo lo aconsejable en un momento en que las empresas han empezado a vigilar los presupuestos que dedican a la IA, al tiempo que miran hacia alternativas más económicas, en partícular las originadas en China.

Cierto es que Google no puede descuidar el mercado de consumo, en el que tiene su ADN. Pero su contacto directo con las empresas, residenciado en su filial Google Cloud, le ha permitido moldear su porfolico de IA en función de las necesidades de los clientes actuales y potenciales. Algo que desde, luego, la distingue de Anthropic y OpenAI, que apenas han iniciado su andadura.  Esto es así desde bastante antes de la llegada de Gemini 4: es una inercia para Google la expansión de capacidades de sus modelos a diferentes áreas de negocio. Esto se combina con una búsqueda de la eficiencia que lleva aparejada una afilada competitividad en los precios. El doble enfoque hace que la oferta de Google en inteligencia artificial sea posiblemente la más completa del mercado. Más aún con la incorporación de sus agentes https://norbertogallego.com/gemini-en-el-nucleo-de-la-galaxia-google/2025/03/26/

Actualmente, la compañía tiene una enorme superficie de contacto con usuarios en diferentes aplicaciones, que intenta remozar con una capa de IA. Sin embargo, el mercado de consumo —el primero que atacó OpenAI cuando ChatGPT salió a la palestra https://norbertogallego.com/microsoft-capitaliza-su-iniciativa-en-openai/2023/01/26/ – está inmaduro. Además, la IA generativa cuenta con un factor diferencial respecto a otros mercados digitales. Ha sido habitual la táctica de abarcar la mayor cuota posible para asentar una posición de dominio en un determinado nicho antes de empezar a monetizar las operaciones. En este caso, el servicio que se presta la compañía no tiene un coste marginal sino bastante elevado, con lo que los ingresos hay que buscarlos más temprano.

Quedan las empresas como referente. En esta arena, Anhtropic ha centrado más el tiro que OpenAI, entretenida con ambiciones fuera de su alcance que ha tenido que abandonar, como el generador de vídeos Sora. Con todo, ambas startups tienen como atractivo principal la potencia de sus últimos modelos, una cualidad que no siempre responde a los intereses más pragmáticos de las empresas.

Una de las fórmulas para acercarse a las empresas es buscar socios, como hiciera Anthropic con Salesforce https://norbertogallego.com/claudeforce-una-combinacion-muy-oportuna/2026/09/07/ . Algo que todos buscarán, cada cual a su escala. En la suya, Google ha integrado la IA en productos de Adobe, en la plataforma Experian o en las herramientas de productividad Airtable o Linear.

Pero esto es solo un camino, la estrategia principal de Google pasa por la expansión desde dentro. Por un lado, ha desarrollado una diversidad de modelos fundacionales, con el fin de obtener diferentes capacidades. Y estas las ha integrado en los productos profesionales para empresas que ya les ofrce.

Para entender la forma en que Google despliega su IA, es recomendable empezar identificando los modelos. Google DeepMind, formada en 2023 ante la presión de ChatGPT, mediante la fusión de la original DeepMind (comprada en 2016) y la división Google Brain, se ha constituido en el laboratorio de desarrollo de modelos fundacionales de IA dentro del conglomerado Alphabet. En ese laboratorio, que dirigía Demis Hassabis antes de convertirse en estrella https://norbertogallego.com/esta-cerrado-para-google-el-caso-hassabis/2026/09/01/ , se ha multiplicado durante años la familia Gemini, así como otros modelos creativos y la familia Gemma, de pesos abiertos.

El faro de la IA de Google, Gemini https://norbertogallego.com/gemini-en-el-nucleo-de-la-galaxia-google/2025/03/26/ , es una capa de inteligencia multimodal, que procesa texto, código, audio, imagen y vídeo de forma nativa. A partir de ahí se han conformado varias versiones. Gemini 3.1 Pro, que en estos momentos pasa por ser el modelo más avanzado (a falta de la apertura de Gemini 4 a un público más amplio), se dedica a tareas complejas, de programación y con una amplia ventana de contexto.

La siguiente tabla servirá de guía genérica (o de resumen) para recorrer la oferta de Google en IA y su foco prioritario en las empresas.

Como versiones de respuesta rápida están Gemini 3.8 Flash y 3.5 Flash-Lite https://norbertogallego.com/google-se-apoya-en-gemini-3-como-lanzadera/2025/11/25/. El primero se ha expandido entre los servicios de Google, incluido su Modo IA en el buscador, y está diseñado para ofrecer resultados con celeridad mediante un procesamiento eficiente, que sirve para abaratar el coste de la inferencia. La variante 3.5 Flash-Lite, lanzada el pasado julio, se ha desarrollado para flujos de trabajo con agentes que necesitan hacer muchas llamadas y consultas rápidas, ciclos de razonamiento y orquestación.

Más allá del tronco familiar, existen otros modelos generativos específicos. Uno de los más conocidos es Nano Banana, cuyo nombre técnico es Gemini Flash Image, que permite la generación de imágenes manteniendo consistencia en personajes y escenarios, así como hacer una edición mediante IA. En el ámbito de los vídeos está Veo 3.1, que permite generar contenido audiovisual a partir de texto con una calidad cinematográfica, a 4K y 24 fotogramas por segundo, y Gemini Omni. Este último admite cualquier tipo de información de entrada, ya sea texto, imágenes, audio u otros vídeos, para crear contenidos audiovisuales. Y permite editar el contenido mediante texto.

Asimismo, destaca Gemini Live, un modelo de audio a audio, orientado a las conversaciones entiempo real. Permite desarrollar interfaces conversacionales y está enriquecido con una arquitectura multimodal para procesar información en texto e imágenes. En el apartado musical, Google cuenta con Lyria, un modelo que genera música y sonido, tanto instrumental como vocal.

A otro nivel, Google DeepMind también ha desarrollado dos modelos vinculados a la robótica. Gemini Robotics 2 es la última versión de su esquema VLA (vision-language-action), diseñado para poder dar instrucciones a un robot y que este perciba el entorno. Por su parte, Genie 3 está orientado a la generación de mundos virtuales, un fin en sí mismo para sectores como el del videojuego o la simulación, pero también una fórmula para acelerar el entrenamiento en robótica.

A esta parentela se suma la familia Gemma, cuyo último exponente es la versión 4, lanzada en abril bajo la licencia Apache 2.0. Es, por tanto, un modelo de pesos abiertos sin restricciones de uso comercial. Es una opción ligera para que los desarrolladores ejecuten un LLM en un hardware propio o en nubes privadas.

Con esta base, la oferta destinada al segmento corporativo se estructura a través de Google Cloud, que permite el acceso mediante plataformas o API de diferentes servicios.

Google Workspace Extension es la opción de la compañía para competir directamente con Microsoft 365 Copilot https://norbertogallego.com/google-atiza-la-puja-de-wokspace-con-office365/2026/03/19/ . Integra los modelos de Gemini como asistentes de IA en la suite de productividad, que incluye Gmail, Docs o Meet, para tareas como hacer resúmenes, generación de slides u organización de hojas de cálculo.

A ella se une la aplicación Gemini Enterprise, diseñada para empleados y que ofrece un modelo de tarifa mensual por usuario. Habilita la búsqueda unificada de información en los sistemas de la empresa, a los que se puede acceder mediante conectores a las apps de Google pero también de terceros, como Microsoft 365, SharePoint, las de Salesforce o SAP. Tanto para este propósito como para la creación de agentes y la función de asistentes de IA se mantienen los permisos de usuario ya establecidos en los sistemas corporativos.

Otra vertiente de la oferta para empresas, Gemini Enterprise Agent Platform, heredera de Vertex AI, está enfocada al manejo, la creación y la gobernanza de agentes de IA https://norbertogallego.com/javier-martinez-2/2026/09/22/.Destinada a desarrolladores y equipos de IT, esta plataforma permite jugar con los modelos de IA y la customización de agentes, así como la introducción de pipelines RAG, que permiten enriquecer a la IA con información empresarial propia. Se puede conectar a bases de datos propias, sistemas CRM o ERPs. Para que los agentes naveguen de forma segura entre estos recursos, Enterprise Agent cuenta con un sistema de identidad que permite controlar la información a la que puede acceder cada agente y las acciones que puede realizar.

Gemini Enterprise Agent Platform está destinada a la automatización de ciertas tareas: agentes virtuales que resuelvan problemas de atención al cliente, como procesar una devolución o agendar una cita, en lugar de solo responder a las consultas del usuario. Sus rivales directos serían Microsoft Azure AI Foundry, basada en Copilot Studio, y Amazon Bedrock AgentCore, que permite a los desarrolladores usar modelos de Anthropic, Meta, Mistral o los propios de Amazon. Tanto OpenAI como Anthropic han lanzado sus propias iniciativas para competir en este terreno, aunque no juegan a su favor las elevadas necesidades de infraestructura.

Se puede considerar una cuarta pata de la oferta empresarial de Google su ecosistema de IA  on-device para Android, asentado en su familia Gemma. Se trata de herramientas que permiten consultas a un chatbot, transcripciones en tiempo real, traducción sin conexión a Internet o ediciones de fotografías. Algunos de estos servicios (o todos) se empaquetan y se venden a fabricantes de smartphones. El más representativo es Samsung, que vertebra su Galaxy AI en esta tecnología, pero también otras compañías han integrado la IA de Google para su ejecución local. Por supuesto, también se distribuye a los desarrolladores de apps.

En lo que respecta a los servicios profesionales, están disponibles a través de las opciones empresariales de Google, mediante API, con un modelo de pago por uso, o con suscripciones, desde 5 a 100 euros. En este último caso, el acceso a herramientas funciona por capas y límites de uso. En estos paquetes se incluye una plétora de servicios dirigidos a diferentes nichos profesionales.

Una de las herramientas más populares es NotebookLM, que funciona como asistente para el estudio de documentos. A partir de ellos puede generar resúmenes, una conversación en audio estilo podcast o se le pueden hacer preguntas. Detrás está Gemini Pro y los modelos de audio de la compañía.

Si bien el ámbito más candente hoy es el de los agentes. Gemini Spark es la entidad autónoma de Google pensado para trabajar en segundo plano en Workspace y con capacidad multitarea. Para el nicho, cada vez más creciente, de la programación está Antigravity, que integra parte de las funciones del colaborador autónomo Jules. Se trata de un entorno de desarrollo integrado (IDE) que ofrece un agente para construir aplicaciones end-to-end, pero también puede actuar como coordinador de un equipo de agentes que se ejecuten con diferentes tareas.

Distinto es el propósito de Google AI Studio, constituida como herramienta de prototipado rápido de páginas web y aplicaciones. Permite desarrollarlas dando instrucciones en lenguaje natural o generar fragmentos de código en múltiples lenguajes de programación, listos para introducir en un proyecto.

En el terreno más vinculado al ámbito creativo Google también ha propulsado una andanada de herramientas con vistas a abarcar diferentes nichos profesionales. Nano Banana se ha erigido en una de las opciones más populares para la generación de imágenes. Sirve para ilustraciones con diferentes estilos e incluso composiciones fotorrealistas y de alta resolución.

Tanto esta generación de imágenes como la de vídeo, representada por Google Vids, nadan a medio camino entre el consumo y el segmento profesional. Pero el foco para rentabilizar las herramientas está en los usuarios que las utilizan en el trabajo. Vids automatiza la generación de contenido audiovisual corporativo, como presentaciones o imágenes formativas, al tiempo que permite una edición por voz y basada en transcripción.

Otras miras inspiran Google Flow, una aplicación independiente orientada más bien a la producción cinematográfica. Genera contenido de alta calidad, tanto para la industria audiovisual como para promociones en redes sociales. El equivalente en el segmento musical puede ser Flow Music, que habilita para la generación de canciones, remezcla y edición, tanto a nivel instrumental como vocal, así como para realizar arreglos de producción.

En el mundo de YouTube, Google trata de agilizar con IA la publicación de vídeos en su plataforma. Dream Screen se integra en las herramientas para creadores y permite generar vídeo e imágenes con un simple prompt, así como fondos animados y otros adornos. Dentro de YouTube Create, utilizada para la edición de vídeo, se puede acceder al subtitulado automático, limpieza de audio y otros efectos con IA.

La compañía también ha dedicado recursos a captar las necesidades del sector del marketing, uno de los que más rápidamente adoptan las nuevas tecnologías. La herramienta Stitch, centrada en el diseño, permite generar una interfaz visual completa, que se puede editar y exportar a código. Google remezcla imágenes fijando referencias, como el sujeto, la escena o el estilo artístico. De esta forma, se puede presentar un producto en diferentes escenarios. Aunque la cima de la automatización en este ámbito pasa por Pomelli, una plataforma que genera campañas enteras de publicidad y redes sociales.

Algunas de las herramientas anteriores tienen versiones gratuitas que el usuario puede usar con límites. Pero los productos principales de consumo de Google son la aplicación de Gemini y el Modo IA de su buscador. La primera ofrece el consabido asistente conversacional, con capacidad de búsqueda en Internet y multimodalidad. También integra la función de conversación por voz en tiempo real, a través de Gemini Live. Existe una versión gratuita, una vez iniciada sesión con un usuario de Google, y la suscripción de pago. La IA del buscador, por su parte, trata de abarcar al gran público. Ofrece resúmenes generativos mediante AI Overviews y permite profundizar, también con multimodalidad, mediante el Modo IA.

En suma, un arsenal pensado para captar usuarios en distintos caladeros profesionales y empresariales sin descuidar la pesca en los anchos mares del consumo. No cabe duda de que el catálogo se expandirá a medida que surjan cada vez más casos de uso para la tecnología. Colofón: la potencia de los modelos solo es una cara de la carrera por la IA, la otra se decide en la capilaridad de la oferta.

[informe de Pablo G.Bejerano]


Contacto Suscríbete RSS


Sobre el autor. Copyright © 2026 El dominio norbertogallego.com es propiedad y está administrado por Diandro SL. B85905537. Creative Commons