Modelos de Google Gemini (2026): Todas las versiones y para qué sirve cada una

Los modelos de IA de Google abarcan todo tipo de tareas, desde razonamiento profundo y programación hasta procesamiento multimodal rápido, generación de imágenes, vídeo, audio y representaciones vectoriales (embeddings). Echa un vistazo a la lista de modelos de Gemini a continuación y elige el que mejor se adapte a tus necesidades y a tu flujo de trabajo.

Prueba los modelos de Gemini en Lorka
Gemini
Ask anything...

Los modelos de IA de Google de un vistazo

Esta comparativa rápida te ayudará a identificar las principales diferencias entre los modelos de Google Gemini según el tipo de tarea, los formatos de entrada, la capacidad de contexto y otras características.

La familia Gemini 3 (los modelos más avanzados)

🚀

Gemini 3.5 Flash

El mejor para la ejecución rápida de tareas complejas con agentes

Mayo de 2026

Gemini 3.5 Flash funciona como un motor pensado para bucles de ejecución autónomos que prioriza la acción y la eficiencia iterativa por encima de la conversación tipo chat.

Inputs: Texto, imagen, vídeo, audio, PDF
Outputs: Texto
Context: hasta 1,048 M tokens
Price (input): 1,50 $ por cada millón de tokens
Price (output): 9,00 $ por cada millón de tokens
🎧

Gemini 3.1 Flash Live Preview

🎙️Perfecto para voz y conversación en tiempo real

Marzo de 2026

Gemini 3.1 Flash Live Preview está optimizado para interacciones de voz fluidas y de baja latencia, así como para aplicaciones de IA centradas en la voz. Puedes utilizarlo para crear asistentes en tiempo real, agentes de atención al cliente y experiencias interactivas en las que se necesitan respuestas naturales y rápidas.

Inputs: entradas de texto, audio y multimodales al instante
Outputs: respuestas en tiempo real basadas en audio y texto
Context: específico del modelo
Price (input): 0,75 $ (texto) / 3,00 $ (audio) / 1,00 $ (vídeo) por cada millón de tokens
Price (output): 4,50 $ (texto) / 12,00 $ (audio) por cada millón de tokens
💡

Gemini 3.1 Flash-Lite Preview

Ideal para automatización a gran escala y bajo coste

Marzo de 2026

Gemini 3.1 Flash-Lite Preview está diseñado para procesar rápidamente y a bajo coste grandes volúmenes de solicitudes. Es ideal para tareas de clasificación, extracción simple, etiquetado, reconocimiento de voz (ASR), así como automatizaciones en las que el coste es determinante.

Inputs: texto, imagen, vídeo, audio, PDF
Outputs: Texto
Context: hasta 1,048 M tokens
Price (input): 0,25 $ (texto/imagen/vídeo) / 0,50 $ (audio) por cada millón de tokens
Price (output): 1,50 $ por cada millón de tokens
🧠

Gemini 3.1 Pro Preview

El mejor modelo de IA de Google para razonamiento avanzado y trabajo con agentes

Febrero de 2026

Gemini 3.1 Pro es la opción más potente para tareas que exigen razonamiento complejo, programación avanzada o flujos de trabajo con agentes de IA y diversos pasos. Es especialmente útil cuando necesitas alta precisión y profundidad en la planificación.

Inputs: texto, imagen, vídeo, audio, PDF
Outputs: Texto
Context: hasta 1,048 M tokens
Price (input): 2,00 $ / 4,00 $ (contexto ≤ 200 000 / > 200 000) por cada millón de tokens
Price (output): 12,00 $ / 18,00 $ (contexto ≤ 200 000 / > 200 000) por cada millón de tokens
⚡

Gemini 3

✨ Excelente para razonamiento multimodal, aprendizaje y creación

Noviembre de 2025

Gemini 3 está diseñado para un razonamiento más profundo con texto, imágenes, vídeo, audio y código. Es especialmente útil para aprender temas complejos, crear herramientas interactivas, planificar proyectos y analizar información multimodal.

Inputs: texto, imagen, vídeo, audio, código
Outputs: texto, código, resultados interactivos en función del producto
Context: hasta 1 millón de tokens
Price (input): 0,50 $ (texto/imagen/vídeo) / 1,00 $ (audio) por cada millón de tokens
Price (output): 3,00 $ por cada millón de tokens

La familia Gemini 2.5: rendimiento equilibrado

🧠

Gemini 2.5 Pro

🧠 Pensado para programación compleja y análisis profesional

Junio de 2025

Gemini 2.5 Pro es una buena elección si necesitas un modelo para revisar código, analizar documentos técnicos o trabajar con grandes conjuntos de datos, sin necesidad de recurrir a las capacidades de Gemini 3.1.

Inputs: texto, imagen, vídeo, audio, PDF
Outputs: texto
Context: hasta 1 millón de tokens
Price (input): 1,25 $ / 2,50 $ (contexto ≤200 000 / >200 000) por cada millón de tokens
Price (output): 10,00 $ / 15,00 $ (contexto ≤200 000 / >200 000) por cada millón de tokens
⚡

Gemini 2.5 Flash

⚡Ideal para tareas diarias de redacción e investigación

Junio de 2025

Para contenidos cotidianos, resúmenes, investigación y experiencias de chat interactivas, Gemini 2.5 Flash ofrece un equilibrio práctico entre velocidad y calidad, lo que lo convierte en uno de los mejores modelos de IA de Google para equipos que necesitan resultados fiables a escala de producción.

Inputs: texto, imágenes
Outputs: texto
Context: hasta 1 millón de tokens
Price (input): 0,30 $ (texto/imagen/vídeo) / 1,00 $ (audio) por cada millón de tokens
Price (output): 2,50 $ por cada millón de tokens

Modelos multimedia y especializados de Google

🎥

Gemini Omni Flash

🎬 Ideal para generar vídeo de alta calidad y editarlo con lenguaje natural

Mayo de 2026

Gemini Omni Flash une capacidad de razonamiento con generación de contenido multimedia para crear y editar vídeo de alta resolución a partir de cualquier tipo de entrada.

Inputs: texto, imágenes, audio, vídeo
Outputs: Vídeo de alta calidad y alta resolución con audio sincronizado
Context: hasta 1 millón de tokens
📸

Nano Banana 2 (Gemini 3.1 Flash Image)

🍌 Ideal para la generación profesional de imágenes con gran precisión y rapidez

Febrero de 2026

Combina conocimientos y capacidades de razonamiento avanzados con la velocidad de la familia Flash de Gemini para producir imágenes de alta calidad en menos tiempo. Integra información procedente de búsquedas y mantiene la coherencia visual de hasta cinco personajes.

Inputs: texto e imágenes (con verificación en búsquedas web)
Outputs: imágenes (hasta 4K) y texto
Context: razonamiento equilibrado (niveles de mínimo a alto)
Price (input): 0,50 $ por cada millón de tokens
Price (output): 3,00 $ (texto) / 60,00 $ (imágenes) por cada millón de tokens
📸

Nano Banana Pro (Gemini 3 Pro Image)

🍌 Perfecto para crear recursos profesionales con un elevado nivel de control creativo

Noviembre de 2025

Este modelo avanzado utiliza la función "Thinking" para razonar a partir de indicaciones detalladas, lo que da como resultado textos de alta fidelidad y composiciones complejas. Admite hasta 4K de resolución y generación de imágenes con datos en tiempo real de Google Search.

Inputs: texto y hasta 14 imágenes de referencia
Outputs: imágenes (hasta 4K) y texto
Context: razonamiento avanzado ("Thinking")
Price (input): 2,00 $ / 4,00 $ (contexto ≤ 200.000 / > 200.000) por cada millón de tokens
Price (output): 12,00 $ / 18,00 $ (texto) / 120,00 $ (imágenes) por cada millón de tokens
📸

Nano Banana (Gemini 2.5 Flash Image)

🍌 Ideal para la creación a gran escala y edición conversacional de baja latencia

Agosto de 2025

Este modelo está pensado para iterar rápidamente sobre ideas creativas y trabajar con grandes volúmenes de contenido. Sus capacidades multimodales nativas le permiten comprender mejor la relación entre una idea y el resultado visual deseado.

Inputs: texto, imágenes
Outputs: imágenes y texto
Context: hasta 65.500 tokens
Price (input): 0,30 $ (texto/imagen/vídeo) por cada millón de tokens
Price (output): 2,50 $ (texto) / 30,00 $ (imágenes) por cada millón de tokens
🔍

Gemini Embedding 2

Pensado para búsqueda y recuperación multimodal

Abril de 2026

Gemini Embedding 2 impulsa procesos de búsqueda, clustering, coincidencia semántica y flujos de RAG (generación aumentada por recuperación). Es ideal cuando necesitas que tu producto entienda el significado de grandes volúmenes de contenido, en lugar de limitarse a buscar coincidencias de palabras clave.

Inputs: texto y contenido multimodal, dependiendo de la implementación
Outputs: representaciones vectoriales (embeddings)
Context: específico del modelo
⚙️

Gemma 4

🛠️ Ideal para flujos de trabajo de código abierto

Abril de 2026

Gemma 4 está diseñado para flujos de trabajo de IA de código abierto, experimentación personalizada y equipos que desean un mayor control sobre la implementación. Es una opción útil para desarrolladores que crean sistemas de inteligencia artificial ligeros, personalizables o autogestionados.

Inputs: depende del modelo
Outputs: depende del modelo
Context: específico del modelo
Price (input): abierto/depende del modelo
Price (output): abierto/depende del modelo
🎥

Veo 3.1

🎬 Ideal para la generación de vídeos de alta fidelidad

Octubre de 2025

Veo 3.1 está diseñado para generar vídeos con IA de estilo cinematográfico, crear storyboards y producir contenido visual más refinado. Sumar esta herramienta a tu equipo te ayudará a crear anuncios, imágenes de producto, vídeos para redes sociales o clips conceptuales a partir de prompts de texto e imagen.

Inputs: texto, imagen, vídeo prompts
Outputs: vídeo
Context: específico del modelo
🖼️

Imagen 4 y los modelos de imagen de Gemini

🎨 Perfectos para la generación nativa de imágenes

Mayo de 2025

Imagen 4 y los modelos de imagen Gemini están diseñados para ofrecer imágenes de alta calidad y facilitar flujos de trabajo de producción creativa. También admiten la edición conversacional y la generación de imágenes basadas en datos reales.

Inputs: texto, referencias de imagen
Outputs: Imágenes
Context: específico del modelo

Cómo elegir el modelo adecuado de Google Gemini

Aprovecha esta guía para encontrar el modelo de Gemini en Lorka AI que mejor se adapte a tus necesidades y te permita agilizar tareas como redactar, programar, investigar, automatizar procesos o crear contenido.

  • Para razonamiento avanzado: elige Gemini 3.1 Pro Preview para análisis complejos, programación y flujos de trabajo agénticos.
  • Para automatización a gran escala: utiliza Gemini 3.1 Flash-Lite Preview para clasificar, extraer o etiquetar información y automatizar tareas repetitivas de bajo coste.
  • Para trabajar con voz en tiempo real: opta por Gemini 3.1 Flash Live Preview si trabajas con asistentes en directo, agentes de atención al cliente o conversaciones de baja latencia.
  • Para tareas profesionales que requieren un buen equilibrio: prueba Gemini 2.5 Pro para revisar documentos, hacer investigación técnica y analizar grandes volúmenes de información.
  • Para la productividad del día a día:: utiliza Gemini 2.5 Flash para escribir, resumir, generar ideas o investigar rápidamente.
  • Para generar imágenes con IA: Aprovecha el generador de imágenes con IA de Lorka AI con Nano Banana o Nano Banana 2 para crear y mejorar tus recursos visuales.

Modelos de IA de Google antiguos o en desuso

Es posible que los modelos de Gemini más antiguos sigan apareciendo en los flujos de trabajo existentes, aunque estos progresivamente se van sustituyendo por las versiones más recientes.

  • Gemini 2.0 Flash y Gemini 2.0 Flash-Lite: Ha dejado de estar disponible el 1 de junio de 2026. Es necesario migrar a los modelos Gemini 2.5 o Gemini 3 antes de esa fecha.

Con Lorka, puedes alternar entre los mejores modelos de IA de Google en un solo lugar, utilizando modelos Gemini avanzados para razonamiento y modelos multimedia especializados para tareas creativas.


Prueba los modelos de IA de Google en Lorka AI para programación avanzada, redacción, generación de imágenes y mucho más

Probar Gemini ahora

Preguntas frecuentes sobre los modelos de Google Gemini

A fecha de mayo de 2026, el modelo más reciente de Google Gemini es Gemini 3.1 Pro Preview.. Está diseñado para tareas de razonamiento avanzado, programación, análisis de contextos extensos y flujos de trabajo agénticos que requieren una mayor capacidad de planificación y precisión.