Google actualizó su modelo de generación de imágenes y lanzó una nueva generación de Nano Banana Pro, que tiene capacidades mejoradas de edición de imágenes, mayor resolución, representación de texto más precisa y búsqueda en línea.

Este nuevo modelo se basa en Gemini 3, el último modelo de lenguaje grande lanzado por Google a principios de esta semana. Google dijo que, en comparación con la generación anterior Nano Banana, Nano Banana Pro puede generar imágenes más detalladas y texto más preciso, y admite la generación de contenido de texto en diferentes estilos, fuentes e idiomas.
Una imagen de ejemplo mostrada por Google muestra que Nano Banana Pro puede generar una infografía sobre cómo preparar té con leche de cardamomo (elaichi chai).
Cabe mencionar que el nuevo modelo cuenta con capacidades de búsqueda web. Los usuarios pueden permitirle buscar recetas en línea primero y luego generar tarjetas de aprendizaje y otro contenido basado en los resultados de la búsqueda.
Google dijo que Nano Banana Pro está más orientado a usuarios profesionales y enfatiza el control preciso de las imágenes. Los usuarios pueden ajustar muchos parámetros como el ángulo de la cámara, la iluminación de la escena, la profundidad de campo, el enfoque y la gradación de color. Nano Banana Pro admite la generación de imágenes con resolución 2K o 4K, en comparación con el límite de resolución máxima de Nano Banana de la generación anterior de 1024×1024 píxeles.

Sin embargo, Google también señaló que, si bien proporciona imágenes de mayor calidad, Nano Banana Pro es más lento de generar y más caro que su predecesor. Anteriormente, Nano Banana costaba $0,039 para producir una imagen de 1024 píxeles, mientras que Nano Banana Pro costaba $0,139 para producir una imagen de 1080p o 2K, y $0,24 para producir una imagen de 4K.
En términos de capacidades generativas, el nuevo modelo puede generar hasta 6 fotografías de alta fidelidad o fusionar hasta 14 objetos en la misma imagen. Al mismo tiempo, puede mantener la coherencia y similitud de hasta 5 caracteres en el cuadro. Google ha lanzado una aplicación de demostración donde los usuarios pueden experimentar estas funciones.
En términos de integración de productos, Nano Banana Pro se está integrando gradualmente con las herramientas de inteligencia artificial existentes de Google. La aplicación Gemini utilizará este nuevo modelo para la generación de imágenes de forma predeterminada. Sin embargo, los suscriptores gratuitos pueden utilizar Nano Banana Pro para generar una cantidad limitada de imágenes. Una vez que se excede el límite, volverá automáticamente al modelo Nano Banana original.
Los suscriptores pagos de Google AI Plus, Pro y Ultra recibirán cuotas de generación más altas, pero Google no reveló límites específicos. Estos suscriptores también pueden llamar al modelo en Notebook LM.
Además, Google también brindará soporte para Nano Banana Pro en "modo AI" a los suscriptores de AI Pro y Ultra en los Estados Unidos en sus productos de búsqueda. Los usuarios de Ultra también pueden llamar al modelo en la herramienta de video de la compañía Flow; Los clientes empresariales de Workspace pueden utilizar Nano Banana Pro en Presentaciones y vídeos de Google.
Los desarrolladores pueden acceder y llamar a Nano Banana Pro a través de la API Gemini, Google AI Studio y el nuevo entorno de desarrollo integrado (IDE) de Google, Antigravity.
En términos de seguridad e identificación, Google anunció que integrará su tecnología de marca de agua de imágenes con IA SynthID en la aplicación Gemini. Los usuarios pueden cargar imágenes y el chatbot determina si la imagen fue generada o modificada por el modelo de imagen de Google.
Google no ha revelado si planea admitir otros estándares de marcas de agua de IA, como C2PA.