Google lanza Gemini Omni Flash, nuevo modelo de IA para generar vídeos conversacionales

EL Géminis Omni Flashel nuevo modelo de inteligencia artificial generativa de Google DeepMind, debutó este martes (19) durante el Google I/O 2026 y ya está disponible en Aplicación Géminis y en Flujo de Google para suscriptores de los planes Google AI Plus, Pro y Ultra.
El sistema genera videos de hasta 10 segundos con audio sincronizado a partir de combinaciones de texto, imagen, audio y video, y permite al usuario afinar el resultado mediante comandos en la conversación.
El lanzamiento de YouTube Shorts y la aplicación YouTube Create comenzó en paralelo, sin costo adicional, en una estrategia que rápidamente pone la tecnología en manos de los creadores de contenido. En las próximas semanas se ha prometido acceso a la API para desarrolladores y clientes empresariales.
Google posicionó el Géminis Omni Flash como el primer modelo de la familia Omni, que combina la inteligencia conversacional de Gemini con los generadores de medios existentes de DeepMind, incluidos Veo, Nano Banana y Genie.
Acceso liberado: cómo ingresar a Omni Flash ahora
La disponibilidad mundial de Géminis Omni Flash Así lo confirmó la propia presentación de la compañía en Mountain View. Cualquiera que mantenga una de las tres suscripciones al paquete Google AI, Plus, Pro o Ultra, encontrará la función activa en la aplicación Gemini y en Google Flow, una plataforma centrada en la producción cinematográfica con IA.
La entrada gratuita es a través de YouTube. Shorts gana modelo de forma escalonada y la aplicación YouTube Create ya ha recibido los primeros recursos. La iniciativa funciona como escaparate masivo: Géminis superó 900 millones de usuarios activos mensuales a nivel mundial, según datos publicados por Sundar Pichai durante el evento, y el volumen diario de mensajes creció más de siete veces en un año.
La ventana de uso actual tiene un límite. EL Géminis Omni Flash ofrece clips de hasta 10 segundos, una restricción que Google describió en el escenario como “una decisión de implementación, no una limitación del modelo”. La versión Pro de Omni, con vídeos más largos y mayor control, aún no tiene fecha de lanzamiento.

Física, edición de chat e identidad preservada.
La propuesta técnica del Géminis Omni Flash se apoya en tres frentes:
- El primero es la simulación de fenómenos físicos: El sistema demostró una mejor comprensión de la gravedad, la energía cinética y la dinámica de fluidos, según Koray Kavukcuoglu, CTO de Google DeepMind. La demostración presentada en I/O incluyó escenas con canicas en pistas de reacción en cadena y explicaciones de plastilina sobre el plegamiento de proteínas.
- El segundo frente es la edición conversacional: cada comando se basa en el anterior, sin que el personaje o la escena pierdan continuidad entre turnos. Los modelos anteriores tendían a perder la identidad de los personajes entre ediciones, un problema que DeepMind afirma haber resuelto con la integración entre el razonamiento Gemini y la generación de medios.
- El tercer frente es el uso del conocimiento mundial de Géminis.: En lugar de operar únicamente mediante reconocimiento de patrones, el Géminis Omni Flash logra conectar lenguaje, imagen y significado, transformando descripciones conceptuales complejas en escenas coherentes.
«Es nuestro nuevo modelo, capaz de crear cualquier cosa a partir de cualquier entrada. Combina la inteligencia de Gemini con nuestros mejores modelos de medios generativos para un nuevo nivel de comprensión, multimodalidad y edición del mundo».
Demis Hassabis, CEO de Google DeepMind, durante la presentación.
Uno de los recursos liberados es el modo avatar: el usuario puede grabar su propia voz y apariencia para crear vídeos en los que aparece como protagonista. El proceso de registro requiere una grabación inicial en la que la persona dice una secuencia de números en voz alta, según afirma Krithika Brichtova, de Google DeepMind, en una entrevista con TechCrunch.
El sistema recuerda a Cameos, una función de la aplicación Sora de OpenAI que se suspendió a principios de este año. La diferencia es que Google adoptó el protocolo de verificación de números como barrera contra la creación no autorizada de avatares de terceros.
La edición de audio y voz dentro de los videos existentes quedó fuera del lanzamiento. La compañía afirmó explícitamente que todavía está probando esta funcionalidad para entender cómo lanzarla de manera “responsable”, en una clara referencia a los riesgos de los deepfakes que involucran sincronización de voz y labios.
SynthID por defecto y verificación en Chrome
Cada vídeo generado por Géminis Omni Flash cargar el SynthIDuna marca de agua digital imperceptible desarrollada por la propia DeepMind. El usuario puede comprobar si Omni creó un clip a través de la aplicación Gemini, Gemini en Chrome o la Búsqueda de Google.
La infraestructura es la misma que adoptó OpenAI a principios de año bajo el estándar abierto C2PA. Hoy en día sirve como referencia de la industria por la procedencia del contenido generado por IA. Pichai informó que SynthID ya obtuvo más de 100 mil millones de imágenes y vídeos generado por IA y que socios como OpenAI, ElevenLabs y el surcoreano Kakao adopten el estándar.
YouTube también ha ampliado la herramienta de detección de identidad a todos los creadores mayores de 18 años. La función escanea la plataforma en busca de copias generadas por IA de la cara o la voz del usuario y le permite solicitar su eliminación.
Cómo se compara Omni Flash con sus rivales
La entrada a la Géminis Omni Flash Ocurre en un momento de aceleración del segmento.
La siguiente tabla compara el nuevo modelo con los principales competidores actuales:
| Modelo | Empresa | Duración máxima | Edición conversacional | audio sincronizado | API pública |
|---|---|---|---|---|---|
| Géminis Omni Flash | Google DeepMind | 10 segundos | Si, multiturno | Sí | Dentro de poco |
| Veo 3.1 | Google DeepMind | Varios segundos | Limitado | Sí | Sí |
| sora 2 | AbiertoAI | Hasta 60 segundos | No | No | Sí |
| Semilla 2.0 | ByteDanza | Varios segundos | No | Limitado | Sí |
| kling 3.0 | Kuaishou | Varios segundos | No | No | Sí, ~$0,075/s |
| Pista Gen-4.5 | Pista | Varios segundos | Herramientas propias | Limitado | Sí |
La sorprendente diferencia con Géminis Omni Flash No está en la duración o la nitidez bruta, sino en el flujo de edición. El modelo acepta instrucciones en lenguaje natural sobre clips ya generados sin necesidad de una nueva generación desde cero en cada turno.
Veo 3.1 mantiene la ventaja en escenas cinematográficas largas, mientras que Sora 2 sigue liderando la simulación física pura de deformaciones y fluidos complejos.
Seedance 2.0 de ByteDance, lanzado en febrero de este año, sigue siendo el modelo con mayor puntuación en el Artificial Analysis Video Arena, con un Elo de 1269 en texto para video y 1351 en imagen para video. El Omni aún no ha sido evaluado en este ranking, dado el poco tiempo que lleva en uso público.
Costos y lo que aún no se ha revelado.
La estructura de precios por clip no fue anunciada… Google tampoco reveló el consumo computacional por generación, ni los resultados de las pruebas internas de Google. Géminis Omni Flash contra Veo 3 o rivales. El calendario de lanzamiento de Omni Pro, una versión de nivel superior con clips más largos, permanece abierto.
El lanzamiento de Géminis Omni Flash viene en un paquete más grande anunciado en I/O 2026, que incluye el Géminis 3.5 Flashel agente persistente Chispa de Géminisla aplicación de edición de imágenes Fotos de Google basado en Nano Banana y la plataforma de codificación Antigravedad 2.0.
Pichai describió la fase actual de la empresa como la “era del Géminis agente”, en referencia a la transición de los modelos de IA del rol de asistente al de agente autónomo.
Lea también:
Los recursos liberados en Brasil dependen de la firma
Cualquier persona que viva en Brasil y tenga una suscripción activa a Google AI Plus, Pro o Ultra puede utilizar el Géminis Omni Flash en la aplicación Gemini y Google Flow inmediatamente.
Los planes cuestan, respectivamente, 19,99 dólares, 49,99 dólares y 249,99 dólares al mes en Estados Unidos. La conversión a reales al tipo de cambio actual de R$ 5,07 es de aproximadamente 101 reales, 253 reales y 1.267 realessin incluir IOF ni impuestos cobrados en transacciones internacionales.
La versión gratuita de Gemini en Brasil aún no ha recibido la Géminis Omni Flash. Para aquellos que crean contenido para YouTube Shorts, la integración gratuita se lanzará gradualmente en las próximas semanas, según Google.
El siguiente paso observable es la llegada de la API: cuando los endpoints se entreguen a desarrolladores y empresas, la estructura de precios por clip y los límites de duración en los planes pagos se harán públicos, dando la dimensión competitiva real del Géminis Omni Flash frente a opciones ya consolidadas en el mercado profesional.
Fuente(s): Google
