Salida 4K nativa
Renderiza directamente en 4K en lugar de reescalar después una imagen más pequeña.
Genera imágenes 4K con calidad de estudio con Nano Banana Pro, combinando varias referencias y manteniendo la coherencia de personajes, productos y tipografía.
Abre esta página en un navegador de escritorio para empezar a crear.
Nano Banana Pro es el modelo de imagen insignia de Google, creado para ofrecer imágenes que resisten el examen profesional, en lugar de imágenes que simplemente resultan impresionantes a primera vista.
En lugar de reinterpretar tus instrucciones en cada ejecución, el modelo conserva lo que has fijado. Los rostros siguen siendo el mismo rostro en todo un conjunto, un producto mantiene su forma exacta y las palabras que has escrito aparecen como palabras, no como texturas con forma de letras. Una sola generación puede basarse en varias imágenes de referencia a la vez y mantener a más de una persona reconocible dentro de la misma escena.
Utiliza Nano Banana Pro cuando la imagen tenga que llegar a producción. Crea imágenes clave para campañas, maquetas de packaging, conjuntos de personajes, diagramas anotados, imágenes editoriales y hero shots listos para impresión con la coherencia que exige un plazo de producción.

Nano Banana Pro es un modelo de generación de imágenes con IA desarrollado por Google DeepMind, lanzado como Gemini 3 Pro Image. Genera y edita imágenes siguiendo instrucciones detalladas sobre los sujetos, la composición, la iluminación, la posición de la cámara, la tipografía y el papel de cada referencia que proporciones.
El modelo se basa en tres grandes fortalezas:
Nano Banana Pro genera de forma nativa en niveles 1K, 2K y 4K. Combina varias imágenes de entrada en una sola pasada y mantiene la coherencia de múltiples sujetos dentro de una escena, con evaluaciones comparativas de terceros que sitúan su precisión de renderización de texto en torno al 94 por ciento.

Renderiza directamente en 4K en lugar de reescalar después una imagen más pequeña.
Combina sujetos, productos, entornos y estilos de varias fuentes en una sola generación.
Preserva la identidad de más de una persona dentro de una misma escena.
Recortes cuadrados, verticales, horizontales o panorámicos a partir del mismo briefing escrito.
Renderiza titulares, etiquetas y pasajes largos de forma legible, incluidos diseños multilingües.
Ajusta una región, la iluminación, el enfoque o la posición de la cámara sin regenerar el fotograma.

El texto aparece como lenguaje, no como decoración, y funciona en pósteres, embalajes, maquetas de interfaz y señalización. Se admiten pasajes largos y composiciones multilingües, lo que elimina el paso habitual de generar una composición en blanco y colocar el texto encima a mano.

Combina varias imágenes en un único briefing y asigna una función a cada una. Una referencia define un rostro, otra una prenda, otra un entorno o una dirección de iluminación, y el modelo las integra todas en el resultado en lugar de promediarlas.

Mantén a varias personas reconocibles dentro de una escena y a lo largo de una serie de generaciones. Esto es lo que hace prácticos los conjuntos de campaña, en los que el mismo talento debe aparecer en seis escenarios distintos sin convertirse en seis personas diferentes.

Cambia una sola región, vuelve a iluminar la escena, desplaza el enfoque o mueve la posición de la cámara, todo mediante instrucciones escritas. Las partes que no mencionaste permanecen como estaban, sin necesidad de máscaras ni selecciones.

Los detalles finos, el texto pequeño y la textura de los materiales se conservan en 4K porque la imagen se renderiza a ese tamaño en lugar de ampliarse a posteriori.

Como las etiquetas vuelven legibles, los gráficos, las secciones transversales anotadas y los gráficos explicativos están al alcance, una categoría que la mayoría de los modelos de imagen no puede abordar.
Este modelo pide más información de la que cabe en un cuadro de prompt. Hay que reunir y etiquetar un conjunto de referencias. Un rostro debe mantenerse durante seis generaciones en lugar de una. Un titular debe revisarse a tamaño completo antes de que alguien lo apruebe. Virse ofrece a ese trabajo un lugar donde estar. Las referencias, las versiones y los fotogramas finales permanecen juntos en un mismo lienzo, de modo que un conjunto creado durante una tarde sigue siendo un conjunto en lugar de una carpeta de exportaciones sin relación.
Reúne los rostros, productos y paneles de estilo una vez y, después, ejecuta cada generación de la campaña con las mismas entradas en lugar de volver a subirlas cada vez.

Abre el renderizado a tamaño completo en el lienzo y lee allí el titular, en lugar de descubrir un carácter roto después de exportar.

Cambia entre Nano Banana Pro y más de 30 modelos de imagen y vídeo sin salir del lienzo ni reescribir el briefing.

Entrega un fotograma 4K terminado directamente a Seedance 2.0, Kling 3.0 o Veo 3.1 como plano de apertura o de cierre.


Crea imágenes principales con tipografía de marca, talento coherente y resolución lista para impresión.

Coloca nombres de producto, descriptores y volúmenes precisos en envases plausibles de una sola vez.

Genera la misma persona en múltiples escenas, conjuntos y ángulos de cámara sin desviaciones.

Compón imágenes y titulares tipográficos juntos, en lugar de superponer uno sobre el otro.

Produce secciones transversales, gráficos y elementos explicativos con etiquetas que se lean correctamente.

Vuelve a iluminar, recomponer o cambiar el estilo de una fotografía existente conservando exactamente el sujeto.
Incorpora las fotografías, tomas de personajes, imágenes de producto o paneles de estilo a partir de los que debe trabajar el modelo.
Indica qué debe tomar el modelo de cada imagen: el rostro de una, la paleta de otra.
Describe el sujeto, el entorno y la iluminación, y escribe las palabras exactas que deben aparecer en el encuadre.
Elige 2K para trabajos en pantalla y presentaciones, y 4K cuando la imagen se vaya a imprimir en gran formato o se vaya a recortar.
Un prompt útil de Nano Banana Pro suele incluir seis elementos:
En lugar de escribir
Una foto profesional de producto de una bolsa de café, alta calidad, 8k, galardonada.
Escribe
Una bolsa de café de color negro mate colocada de pie sobre una superficie de hormigón clara, fotografiada desde un ángulo ligeramente superior en tres cuartos. Luz suave de ventana desde la izquierda, con una sombra visible proyectada hacia la derecha. La etiqueta dice BLACKWOOD ROASTERS en una sans-serif condensada, con «Origen único — Etiopía» debajo en un tamaño menor. Poca profundidad de campo, con el fondo desenfocándose. Toma la forma de la bolsa de la Imagen 1 y la paleta de colores de la Imagen 2.
Usando la persona de la Imagen 1, genera un retrato de estudio contra un fondo continuo gris medio. Luz principal a 45 grados desde la izquierda de la cámara con relleno suave desde la derecha. El sujeto mira directamente a la cámara con una expresión neutra. Mantén los rasgos faciales, el pelo y el detalle de la piel de la referencia sin alteraciones. Cambia solo la iluminación, el fondo y el encuadre. Tomado a 85mm, de cintura para arriba, poca profundidad de campo.
Una botella cilíndrica de cuidado de la piel de vidrio esmerilado con un tapón de aluminio cepillado, centrada sobre una superficie cálida de arenisca. La etiqueta frontal dice AURELIA en el centro con una tipografía serif de espaciado amplio, con "Sérum hidratante · 30ml" debajo en versalitas. Luz cenital difusa, sombra suave acumulándose directamente bajo la botella, paleta apagada de arena y crema en toda la imagen. Composición cuadrada con amplio espacio sobre la botella para añadir texto más adelante.
Un diagrama limpio en sección transversal del movimiento de un reloj mecánico sobre fondo blanco. Etiqueta cinco componentes con líneas guía finas y texto breve: muelle real, volante, escape, tren de engranajes, rotor. Usa un único color de acento para las líneas guía y mantén todas las etiquetas en la misma tipografía sans-serif pequeña con un tamaño uniforme. Estilo vectorial plano, sin sombreado ni textura.
| Dimensión | Nano Banana 2 | Nano Banana Pro |
|---|---|---|
| Niveles de resolución | 0.5K, 1K, 2K, 4K | 1K, 2K, 4K |
| Imágenes de referencia | Maneja bien una sola referencia | Combina varias fuentes en una sola generación |
| Coherencia de identidad | Bueno para sujetos individuales | Mantiene varios sujetos a lo largo de una serie |
| Renderizado de texto | Viable para cadenas cortas | Textos extensos y maquetaciones multilingües, ~94% de precisión |
| Control de edición | Ajuste a nivel de indicación | Ediciones localizadas, reiluminación, enfoque y transformaciones de cámara |
| Más adecuado para | Trabajo en volumen y exploración | Recursos finales, impresión y trabajos de cara al cliente |
Escribe las palabras exactas que deben aparecer en la imagen. Describir la presencia de texto sin proporcionarlo genera relleno.
Nombrar lo que aporta cada imagen produce un resultado distinto a subir varias y esperar. El modelo sigue la asignación cuando la haces.
Con varias personas en el encuadre, coloca a cada una según su referencia: "la mujer de la Imagen 1 a la izquierda, el hombre de la Imagen 2 detrás de ella". La identidad se mantiene mucho mejor cuando el modelo sabe quién va dónde.
Cuando un detalle esté mal, vuelve a subir el resultado y nombra solo ese detalle. Una edición localizada protege todo lo que ya está aprobado; una indicación reescrita regenera todo el encuadre.
Trae tus referencias, tu briefing y tus intentos anteriores a un solo lienzo, y deja que Nano Banana Pro se encargue de la pasada que tiene que salir bien. Combina varias fuentes, mantén estables tus personajes y tu tipografía, y exporta en 4K en el mismo espacio de trabajo.