lunes, 3 de agosto de 2026

IA y modelos

Google añade generación de imágenes impulsada por Nano Banana a Gemini

Google está integrando la generación de imágenes impulsada por Nano Banana en Gemini, lo que permite a los usuarios crear visuales basados en sus datos de Gmail y Google Photos sin necesidad de instrucciones explícitas.

Google adds Nano Banana-powered image generation to Gemini
Foto: Google

El jueves, Google anunció que está añadiendo la generación de imágenes impulsada por Nano Banana a Personal Intelligence, una función dentro de su plataforma de inteligencia artificial (IA) Gemini. Esta integración permite a la IA generar imágenes utilizando contexto personalizado derivado de las conexiones de cuenta de Google existentes del usuario. En lugar de requerir que los usuarios escriban explícitamente sus preferencias, gustos o intereses personales dentro de un prompt, Gemini puede hacer referencia automáticamente a las fuentes de datos conectadas. Específicamente, la función extrae información de:

  • Gmail
  • Google Photos

Al vincular estas cuentas, Gemini puede generar visuales altamente personalizados a partir de comandos simples. Por ejemplo, en lugar de escribir un prompt detallado como “Genera una imagen de la casa de mis sueños, mis intereses son el tenis y la música”, un usuario puede simplemente ingresar “Diseña la casa de mis sueños”. La conexión impulsada por Nano Banana también puede interpretar etiquetas dentro de Google Photos para entender descripciones de grupos, como “Familia”. Esto permite a los usuarios generar imágenes con prompts como “Genera una imagen de mi familia y yo haciendo nuestra actividad favorita”, con la IA identificando automáticamente a las personas e intereses correctos de la biblioteca de fotos del usuario.

Sin embargo, Google señaló que, al igual que otras conexiones de cuenta, Gemini podría interpretar incorrectamente el contexto durante el proceso de generación de imágenes. Para mitigar esto, la empresa ha incluido varias funciones de control para el usuario. Los usuarios pueden hacer clic en un botón de “fuentes” para ver exactamente cómo Gemini derivó el contexto para una imagen generada. Si la IA comete un error, los usuarios pueden proporcionar comentarios directos para corregirlo. Además, los usuarios pueden cargar manualmente fotos de referencia para guiar la generación de imágenes haciendo clic en un icono de más dentro de la interfaz.

La nueva capacidad de generación de imágenes está programada para implementarse para los suscriptores de Gemini Plus, Pro y Ultra en EE. UU. en los próximos días. Google planea llevar la función a Gemini en la versión de escritorio de Chrome y a otros usuarios pronto. Esta actualización sigue al lanzamiento inicial de la función Personal Intelligence a principios de este año, que Google puso a disposición de todos los usuarios de EE. UU. en marzo. A principios de esta semana, la empresa expandió la función a más usuarios en países como India y Japón.

Por qué importa

Esta actualización cambia la generación de imágenes por IA de prompts genéricos a resultados personalizados al aprovechar la huella digital existente del usuario, aunque introduce nuevos desafíos con respecto a la precisión del contexto.