Biblioteca de modelos
Todos los modelos disponibles dentro de Virse, agrupados por lo que crean. Elige uno para abrir su página o empieza a crear con él directamente en el lienzo.
Vídeo7 modelos
El modelo de vídeo multimodal nativo de Google, que acepta texto, imágenes, vídeo y audio como entrada, ofrecido en Virse como opciones basadas en fotogramas y basadas en referencias.
GoogleEl modelo de vídeo con IA Happy Horse 1.0 necesita una imagen fija y una frase, y genera movimiento a partir del fotograma que ya tienes.
AlibabaKling 3.0 de Kuaishou habla: diálogo sincronizado con los labios en cinco idiomas, una voz distinta por personaje y un modo storyboard que estructura una secuencia completa.
KuaishouEl modelo Hailuo 03 de MiniMax produce vídeo 2K silencioso, impulsado ya sea por un primer y último fotograma o por un conjunto de imágenes de referencia.
MiniMaxSeedance 2.0 de ByteDance produce imagen y sonido en una sola pasada, a partir de un primer y último fotograma o de imágenes de referencia, en tamaños que van de 480P a 4K nativo.
ByteDanceGenera vídeos cinematográficos de 30 segundos con Seedance 2.5, con audio sincronizado, referencias multimodales y un control creativo preciso.
ByteDanceVeo 3.1 de Google DeepMind genera clips cortos con audio sincronizado de 48kHz y los amplía en secuencias más largas llevando los fotogramas finales hacia delante.
GoogleImagen14 modelos
ChatGPT Images 2.5 de OpenAI llega a Virse en sus dos ediciones de API, GPT Image 2.5 Flare y GPT Image 2.5 Sunburst, con seis grados de calidad y salida de hasta 4K.
OpenAILa generación de la línea FLUX de Black Forest Labs que precedió a FLUX 2, mantenida disponible como dos entradas: el modelo estándar y Ultra.
Black Forest LabsEl modelo de producción de Black Forest Labs lee briefs de hasta 32.000 tokens, por lo que las normas de marca, los valores de color y las restricciones de composición pueden incluirse todos a la vez.
Black Forest LabsLos modelos de edición de Black Forest Labs, FLUX Kontext Pro y Kontext Max, creados para aplicar un único cambio descrito mientras el resto del encuadre permanece intacto.
Black Forest LabsGPT Image 2.0 de OpenAI lee un briefing de cien palabras e intenta cumplirlo por completo, con controles independientes de calidad y resolución de 1K a 4K.
OpenAIGemini 2.5 Flash Image de Google — el Nano Banana original — genera y edita imágenes a la velocidad de una conversación, de modo que una corrección requiere una frase en lugar de una sesión.
GoogleUn modelo fundacional de texto a imagen entrenado desde cero en torno a la maquetación, con colocación mediante cuadros delimitadores, condicionamiento por color hexadecimal y salida nativa en 2K.
IdeogramNano Banana 2 de Google combina una calidad de imagen de nivel insignia con una velocidad de clase Flash, en cuatro tamaños de salida que van desde prototipos rápidos en 0.5K hasta resultados finales en 4K.
GoogleGenera imágenes 4K con calidad de estudio con Nano Banana Pro, combinando varias referencias y manteniendo la coherencia de personajes, productos y tipografía.
GoogleQwen Image 3.0 Pro de Alibaba renderiza la tipografía como lenguaje en una docena de sistemas de escritura, manteniendo la legibilidad hasta diez píxeles en diseños densos.
AlibabaEl modelo de segunda generación de Reve AI construye un diseño direccionable de elementos posicionados antes de renderizar, de modo que una disposición especificada vuelve dispuesta correctamente.
ReveSeedream 4.0 y Seedream 4.5 de ByteDance generan a partir de descripciones escritas y de imágenes que proporciones, convirtiendo una imagen de origen en tantas direcciones como necesite un proyecto.
ByteDanceLa generación más reciente de Seedream de ByteDance, disponible como Seedream 5.0 Pro y Seedream V5 Lite, ambas aceptan el mismo brief escrito.
ByteDanceUn modelo de 6.000 millones de parámetros comprimido en un proceso de inferencia de ocho pasos, creado para devolver una imagen utilizable antes de que pierdas el hilo de tus pensamientos.
Alibaba