Generador de vídeo con IA Gemini Omni Flash

El modelo de vídeo multimodal nativo de Google, que acepta texto, imágenes, vídeo y audio como entrada, ofrecido en Virse como opciones basadas en fotogramas y basadas en referencias.

Abre esta página en un navegador de escritorio para empezar a crear.

Omni en el nombre se refiere al lado de las entradas

Gemini Omni Flash es el modelo de vídeo rápido de Google, anunciado en junio de 2026, y la parte que merece la pena entender es qué aceptará.

La mayoría de los modelos de vídeo reciben una imagen y un párrafo. Este es multimodal de forma nativa: texto, imágenes, vídeo y audio entran todos a través de la misma interfaz, en lugar de mediante adaptadores separados añadidos después. Se trata de una propiedad arquitectónica más que de una lista de funciones, y se nota en la coherencia con la que el modelo concilia entradas que apuntan en direcciones distintas. Google también lo ha creado para el refinamiento conversacional, donde un clip se ajusta continuando la conversación en vez de reescribir el briefing.

Usa Gemini Omni Flash cuando tus entradas sean variadas y tu pipeline de imágenes ya sea de Google. Anima imágenes estáticas de Nano Banana o de modelos de imagen de Gemini, dirige tomas a partir de material de referencia e itera sobre un clip respondiendo a él.

The Omni in the Name Is the Input Side

¿Qué es Gemini Omni Flash?

Gemini Omni Flash es un modelo de generación de vídeo con IA desarrollado por Google DeepMind, parte de la línea Gemini Flash, en la que la velocidad de entrega es la prioridad de diseño. Se anunció en junio de 2026 como una opción rentable para la generación de vídeo y la edición de vídeo conversacional.

El modelo se basa en tres grandes puntos fuertes:

  • Multimodalidad nativa, con aceptación de entradas de texto, imagen, vídeo y audio
  • Refinamiento conversacional, ajustando un clip mediante instrucciones continuadas
  • Procedencia SynthID integrada en cada salida

Virse enumera dos entradas. Gemini Omni Flash toma un primer fotograma, un último fotograma o ambos, además de un resumen escrito. Gemini Omni Flash Reference funciona en cambio a partir de imágenes de ejemplo suministradas. La entrada ofrecida en Virse es la configuración 720P, que renderiza audio nativo en cada generación, por lo que la dirección de audio no forma parte del resumen aquí.

What Is Gemini Omni Flash?

Especificaciones de Gemini Omni Flash de un vistazo

Multimodal de forma nativa

Texto, imagen, vídeo y audio aceptados a través de una sola interfaz.

Dos opciones

Basada en fotogramas y basada en referencias, listadas por separado en Virse.

720P Output

Salida 720P

El tamaño ofrecido en Virse. El audio se genera de forma nativa con la imagen.

Velocidad de clase Flash

Un modelo de la línea Flash, que en vídeo importa más que en imágenes fijas.

Refinamiento conversacional

Ajusta un resultado continuando la instrucción en lugar de reescribirla.

Procedencia SynthID

Una señal imperceptible incrustada en cada clip generado.

Funciones clave del generador de vídeo con IA Gemini Omni Flash

Two Entries

Una interfaz para cada tipo de entrada

La multimodalidad nativa significa que el texto, las imágenes, el vídeo y el audio son gestionados por el mismo modelo en lugar de pasarse por codificadores separados. Las entradas que entrarían en conflicto en un sistema ensamblado se concilian en su lugar.

Refinement by Conversation

Una opción de referencia que el buque insignia no tiene

Veo 3.1, el modelo de vídeo más pesado de Google, funciona por fotogramas. Gemini Omni Flash añade una vía de imagen de referencia, que es la única ruta hacia ese tipo de control de continuidad dentro de la familia de Google.

Refinement by Conversation

Refinamiento mediante conversación

En lugar de reescribir un briefing desde cero para corregir una cosa, el modelo está diseñado para el ajuste iterativo: la premisa de diseño es que el primer resultado es un punto de partida.

Speed as the Design Target

La velocidad como objetivo de diseño

La línea Flash optimiza el tiempo de respuesta. En vídeo, donde una generación lenta rompe por completo la concentración, eso importa más que en las imágenes fijas.

Refinement by Conversation

Coherencia con los modelos de imagen de Google

Los fotogramas producidos por Nano Banana Pro, Nano Banana 2 o Gemini 2.5 Flash Image proceden de la misma familia, lo que mantiene el carácter visual continuo en el traspaso de imagen fija a movimiento.

Speed as the Design Target

Procedencia sin configuración

SynthID se integra automáticamente en cada clip, identificándolo como generado por IA sin nada visible en la imagen y sin nada que activar.

Crea con Gemini Omni Flash en Virse

Mantenerse dentro de una misma familia de modelos a lo largo de una canalización parece una preferencia hasta que cambias de proveedor en mitad del proyecto y pasas una tarde averiguando por qué la versión animada no coincide con la imagen fija. Virse convierte la ruta de la misma familia en el camino de menor resistencia. Un fotograma generado por cualquier modelo de imagen de Google en el lienzo pasa directamente a Gemini Omni Flash sin exportación, de modo que la transferencia de imagen fija a movimiento ocurre en el mismo lugar.

Anima la imagen fija que acabas de generar

Envía un fotograma de imagen de Nano Banana o Gemini directamente al modelo de vídeo en el mismo lienzo.

Provenance Without Configuration

Mantén visible el hilo de iteración

Cada refinamiento se sitúa junto a la versión de la que procede, que es lo que hace que un flujo de trabajo conversacional sea revisable después.

Animate the Still You Just Generated

Accede a más de 30 modelos creativos

Cambia entre Gemini Omni Flash y más de 30 modelos de imagen y vídeo sin salir del lienzo ni reescribir el briefing.

Keep the Iteration Thread Visible

Compáralo con la opción más potente

Ejecuta el mismo fotograma en Veo 3.1 junto a él cuando necesites saber si el peso extra merece la pena.

Compare Against the Heavier Option

¿Qué puedes crear con Gemini Omni Flash?

Animated Stills

Imágenes fijas animadas

Movimiento añadido a imágenes generadas en otros lugares de la familia de Google.

Reference-Driven Clips

Clips basados en referencias

Planos en los que un sujeto se define mediante imágenes de ejemplo en lugar de describirse.

Short Social Video

Vídeo corto para redes sociales

Clips rápidos en los que el tiempo de respuesta importa más que la resolución.

Product Motion

Movimiento de producto

Revelaciones y rotaciones sencillas a partir de un fotograma inicial definido.

Concept Previz

Previz de concepto

Referencia en movimiento para una idea de plano antes de comprometerse con nada.

Iterative Sequences

Secuencias iterativas

Clips refinados a lo largo de varias rondas en lugar de especificarse perfectamente desde el principio.

Cómo usar Gemini Omni Flash en Virse

  1. Decide qué entrada encaja

    Si ya tienes los fotogramas, usa la opción estándar. Si necesitas que un sujeto se mantenga entre clips, usa Reference.

  2. Carga tus entradas

    Añade las composiciones, o el conjunto de ejemplos con una tarea indicada para cada imagen.

  3. Di qué sucede

    Describe el movimiento en la escena, el comportamiento de la cámara y el ritmo. El audio se renderiza con la imagen, así que merece la pena incluir indicaciones de diálogo y ambiente.

  4. Refina en lugar de empezar de nuevo

    Ajusta el resultado con una instrucción de seguimiento en lugar de reescribir el briefing original.

Cómo escribir un prompt de Gemini Omni Flash

Un prompt útil de Gemini Omni Flash suele incluir cuatro elementos:

  • Estado inicial
  • Qué se mueve
  • Cámara
  • Estado final

En lugar de escribir

Una persona abriendo una ventana, movimiento natural agradable, cinematográfico.

Escribe

Una persona está de pie junto a una ventana de guillotina con ambas manos en el marco inferior, vista desde atrás a la altura de la cintura. Empuja la ventana hacia arriba con un movimiento suave hasta que queda totalmente abierta y luego baja las manos. La cámara permanece fija durante todo el tiempo, sin acercamiento ni desplazamiento. Termina con la ventana abierta y los brazos a los lados.

Ejemplos de prompts de Gemini Omni Flash

gemini-omni-flash-prompt-examples-tea-curtain-19.jpg

De fotograma a fotograma

Empieza en la Imagen 1: una taza de té en el alféizar de una ventana, con vapor elevándose y la cortina quieta. Una brisa levanta la cortina desde la derecha durante la primera mitad del clip y luego se posa. El vapor sigue elevándose durante todo el clip. La cámara mantiene un primer plano estático, sin movimiento y sin cortes. Termina en la Imagen 2: la cortina posada, la taza sin cambios.

Reference-Driven Continuity

Continuidad guiada por referencia

Usa la persona de la Imagen 1, el delantal de la Imagen 2 y el mostrador de la panadería de la Imagen 3. Él coloca una bandeja de hogazas sobre el mostrador, se endereza y se limpia las manos en el delantal. Un plano medio fijo desde el lado del cliente del mostrador, con la cámara inmóvil. Conserva su rostro, su pelo y el color y el corte del delantal exactamente como se muestran. Termina con sus manos a los lados.

Simple Camera Move

Movimiento de cámara sencillo

Una bicicleta apoyada contra una pared de ladrillo pintada, vista de frente. Nada en la escena se mueve. La cámara se desplaza lentamente hacia la izquierda a una velocidad constante, manteniendo la bicicleta en el encuadre y revelando una puerta a su derecha. Luz uniforme de cielo nublado durante toda la escena. Termina con la bicicleta en el borde derecho y la puerta centrada.

Gemini Omni Flash frente a Veo 3.1

DimensiónGemini Omni FlashVeo 3.1
Tipos de entradaTexto, imagen, vídeo y audioTexto y fotogramas
Entrada ReferenceSí, aparece por separadoNo
Salida en Virse720P, sin sonidoDe 720p a 4K, audio opcional
Objetivo de diseñoVelocidad de entregaLímite de salida
Construcción de secuenciasRefinamiento conversacionalExtensión de escena
Elígelo cuandoLas entradas son variadas o un sujeto debe mantenerseLa pieza necesita duración, audio o 4K

Consejos para obtener mejores resultados con Gemini Omni Flash

Una acción delimitada por clip

Da al movimiento un inicio y un final claros en lugar de una descripción abierta.

Nombra los roles de referencia

En la entrada Reference, indica qué imagen aporta el sujeto y cuál aporta el entorno.

Permanece en la familia para los fotogramas

Las imágenes de Nano Banana o Gemini 2.5 Flash Image se transfieren a este modelo sin ningún cambio en su carácter visual.

Refina, no reescribas

El modelo está diseñado para instrucciones de seguimiento. Reescribir todo el briefing descarta lo que ya funcionaba.

Preguntas frecuentes sobre Gemini Omni Flash

¿Qué es Gemini Omni Flash?
Gemini Omni Flash es el modelo de vídeo multimodal de forma nativa de Google DeepMind, anunciado en junio de 2026 para la generación rápida de vídeo y la edición conversacional. Acepta entradas de texto, imagen, vídeo y audio.
¿Qué significa aquí "multimodal de forma nativa"?
Que el texto, las imágenes, el vídeo y el audio los gestiona un único modelo a través de la misma interfaz, en lugar de componentes separados ensamblados entre sí. Las entradas se concilian en vez de procesarse de forma aislada.
¿Gemini Omni Flash es gratis y cuánto cuesta?
Gemini Omni Flash está disponible en los planes de pago de Virse. La generación se factura por segundo a partir de una asignación mensual de créditos, y los planes superiores la ofrecen sin medición dentro de un uso razonable. Las tarifas actuales de los planes figuran en la página de precios de Virse.
¿Gemini Omni Flash genera audio?
Sí. Gemini Omni Flash genera audio nativo junto con la imagen, y la opción ofrecida en Virse lo renderiza en cada generación: no hay ninguna configuración silenciosa que elegir.
¿Qué es Gemini Omni Flash Reference?
Una opción independiente que utiliza imágenes de referencia en lugar de fotogramas, para trabajos en los que un sujeto debe mantenerse reconocible a lo largo de una serie de clips.
¿En qué se diferencia de Veo 3.1?
Veo 3.1 alcanza 4K, genera audio y crea duración mediante la extensión de escenas. Gemini Omni Flash es más rápido, acepta más tipos de entrada y ofrece una opción de referencia que Veo 3.1 no tiene.
¿Añade una marca de agua?
Incorpora SynthID, una señal de procedencia imperceptible. No se marca nada en la imagen visible.
¿Cómo uso Gemini Omni Flash en Virse?
Selecciona cualquiera de las dos opciones, aporta fotogramas o imágenes de referencia, describe el movimiento y genera.

Misma familia, de fotograma a movimiento

Anima los fotogramas que ya han producido tus modelos de imagen de la familia de Google, o dirige la toma a partir de un conjunto de referencia, sin salir del lienzo en ningún caso.