Google revoluciona a xeración de vídeo con Gemini Omni: así funciona a nova IA presentada no Google I/O

Google deu un dos golpes máis importantes do Google I/O 2026 coa presentación de Gemini Omni, unha nova xeración de intelixencia artificial capaz de crear e editar vídeos a partir de practicamente calquera tipo de contido: texto, imaxes, audio ou vídeos previos.

A compañía define Gemini Omni como o seguinte gran salto da familia Gemini, un modelo onde a capacidade de razoamento da IA únese coa creación multimedia avanzada. O resultado é unha ferramenta que non só xera vídeos espectaculares, senón que tamén entende contexto, física, narrativa e continuidade visual.

Gemini Omni: a IA que crea vídeos falando contigo

O primeiro modelo presentado é Gemini Omni Flash, xa dispoñible para os usuarias de Google AI Plus, Pro e Ultra a través da app Gemini, Google Flow e tamén en YouTube Shorts.

A gran novidade é que os vídeos poden editarse simplemente mediante conversacións en linguaxe natural. Así, as usuarias poden pedir cambios, engadir elementos ou modificar escenas falando coa IA, mantendo sempre coherencia entre planos, personaxes e movementos.

Google asegura que Omni consegue algo especialmente complexo: que os vídeos manteñan continuidade realista sen romper leis físicas nin perder coherencia narrativa.

Crear vídeos a partir de imaxes, audio ou texto

Un dos puntos máis potentes de Gemini Omni é a súa natureza multimodal. A IA pode combinar diferentes tipos de entradas para crear un único vídeo cohesionado.

Por exemplo, é posible facer cousas como xerar un vídeo a partir dunha simple descrición escrita, combinar unha imaxe, unha música e un vídeo como referencia; transformar vídeos existentes; aplicar estilos visuais cinematográficos ou crear animacións explicativas complexas

A diferenza doutros xeradores de vídeo, Gemini Omni non se limita a producir imaxes espectaculares. Segundo Google, o modelo tamén razoa sobre o que debería ocorrer dentro da escena. Deste modo, a IA comprende conceptos como a gravidade, o movemento, a enerxía cinética e a dinámica de fluídos, o que permite crear vídeos máis realistas e naturais, especialmente en escenas complexas con movementos rápidos ou interaccións físicas.

Edición avanzada sen coñecementos técnicos

Outro dos grandes cambios que introduce Gemini Omni é a simplificación da edición audiovisual. Até o de agora, modificar vídeos complexos requiría software profesional e coñecementos técnicos avanzados.

Co novo sistema de Google, bastará con pedir os cambios mediante comandos de texto. Así, as usuarias poden cambiar fondos, modificar accións, engadir novas personaxes ou alterar estilos, mantendo sempre a coherencia da escenar orixinal.

Avatares dixitais creados coa nosa propia voz

Google tamén anunciou a función Avatar, que permitirá crear versións dixitais das usuarias utilizando a súa propia voz e aparencia. A compañía insiste en que o desenvolvemento destas ferramentas estará acompañado de medidas de seguridade e control para evitar usos indebidos.

Para evitar usos mal intencionados, todos os vídeos creados con Gemini Omni incluirán a marca de auga dixital SynthID, deseñada para identificar contido xerado por intelixencia artificial.

Sobre o autor

Reply