Written by

Picture of فريقنا

فريقنا

Communications Consultant

Google lanzó el modelo Nano Banana 2.1 diseñado para generar y editar imágenes con gran precisión y a un costo financiero que se reduce a la mitad en comparación con la versión anterior. El nuevo modelo se basa en la arquitectura Gemini 3.6 Flash, ofreciendo saltos cualitativos en la consistencia visual y el procesamiento de máscaras gráficas.

Google lanzó el modelo Nano Banana 2.1 diseñado para generar y editar imágenes con gran precisión y a un costo financiero que se reduce a la mitad en comparación con la versión anterior. El nuevo modelo se basa en la arquitectura Gemini 3.6 Flash, ofreciendo saltos cualitativos en la consistencia visual y el procesamiento de máscaras gráficas.

Reducción de costos y actualización de la arquitectura Gemini Flash

Google anunció oficialmente el 6 de octubre de 2026 el lanzamiento de su modelo más avanzado en el campo de la inteligencia artificial visual bajo el nombre «Nano Banana 2.1», un modelo diseñado para generar y editar imágenes digitales que se basa directamente en la arquitectura de alta eficiencia «Gemini 3.6 Flash». La sorpresa más destacada de este lanzamiento es la imposición de tarifas operativas equivalentes a la mitad del costo anterior establecido en la segunda generación, lo que brinda a los desarrolladores y nuevas empresas una oportunidad excepcional para reducir los gastos de computación visual mientras se benefician de saltos cualitativos en la calidad del diseño, la edición de máscaras y la consistencia de apariencia de los elementos y personajes representados.

Esta versión avanzada reemplaza al modelo anterior Nano Banana lanzado en febrero pasado, ya que Google estableció una fecha límite que finaliza el 29 de octubre para descontinuar definitivamente el modelo antiguo, lo que requiere que los desarrolladores se apresuren a actualizar sus interfaces de programación. La compañía confirmó a través de sus cuentas oficiales que el modelo nuevo supera a sus predecesores en todos los indicadores estándar, especialmente en la integración de textos complejos dentro de los diseños y la eliminación de los defectos de repetición de cuadrícula que solían aparecer en imágenes panorámicas anchas.

Detalles de precios y nuevas ventajas de ingeniería

Los documentos de precios de las API de Gemini muestran que el costo de generación de imágenes con el nuevo modelo Nano Banana se estableció en 30 dólares por millón de tokens de salida. Esto se traduce en la práctica en un costo aproximado de 3.4 centavos para imágenes con resolución 1K, 5 centavos para resolución 2K y 7.6 centavos para imágenes de ultra alta definición 4K, en comparación con los precios anteriores de 6.7, 10.1 y 15.1 centavos para las mismas dimensiones. A pesar del aumento en el costo de los tokens de entrada a 1.50 dólares por millón de tokens en comparación con los 0.50 dólares anteriores y la ausencia de la categoría gratuita, la opción de procesamiento por lotes permite reducir nuevamente a la mitad el costo total de las imágenes.

En el plano funcional, Google añadió mejoras tangibles en el diseño de infografías, permitiendo el uso de hasta 14 imágenes de referencia en una sola solicitud para guiar el estilo visual, además de dotar al modelo de tres niveles ajustables de «estilos de pensamiento» deliberativo antes de la generación. Aunque Google presenta el modelo como el hermano económico de la versión «Pro», las pruebas de campo independientes indican que la versión profesional todavía produce detalles hiperrealistas superiores en escenarios complejos.

Pruebas de rendimiento humano y clasificaciones en plataformas competitivas

Google presentó los resultados de las evaluaciones de preferencia humana en la ficha técnica del modelo, donde Nano Banana registró en el modo de pensamiento una clasificación estándar de 1050 puntos según el estándar de calificación Elo, superando claramente a la segunda generación que logró 990 puntos y a la versión Pro que obtuvo 935 puntos. Sin embargo, las evaluaciones independientes en las plataformas globales fueron menos entusiastas que las estimaciones internas de la empresa; la tabla de clasificación general de la plataforma de inteligencia artificial Kenji ubicó al nuevo modelo en el quinto lugar mundial el día de su lanzamiento, quedando por detrás de los modelos «GPT Image 2.5» de OpenAI y el modelo «MAI» de Microsoft.

Esta discrepancia se debe a los diferentes criterios de evaluación, ya que los desarrolladores independientes se centran en la precisión estricta al ejecutar instrucciones compuestas complejas y en no distorsionar los rasgos faciales en ángulos agudos, mientras que las pruebas corporativas se centran en el equilibrio general entre la velocidad de procesamiento, la estética del color y la iluminación general en escenas cotidianas simples.

Mapa de despliegue, limitaciones técnicas y fechas de cierre

Google comenzó a poner a disposición el nuevo modelo a través de un amplio ecosistema de sus servicios, que incluye la aplicación de chat Gemini, el modo de inteligencia artificial en el motor de búsqueda, Google AI Studio, las plataformas Flow, Stitch y Google Ads, además de la plataforma empresarial para corporaciones. Robbie Stein, vicepresidente de gestión de productos para el buscador, declaró que el modelo ya ha comenzado a operar de manera efectiva en las interfaces de búsqueda inteligente, señalando que los resúmenes generativos generales aún no han adoptado completamente la nueva versión.

Los documentos técnicos reconocen la existencia de algunas deficiencias que aún están bajo mejora, como la alucinación de elementos visuales en escenas concurridas, la borrosidad de los textos de tamaños pequeños, ligeras variaciones en la estabilidad de los rasgos de los personajes al generar de forma repetida, así como errores posicionales en la edición basada en máscaras. Los expertos también detectaron un conflicto técnico en la documentación sobre la capacidad de la ventana de contexto, que se mencionó como un millón de tokens en la tarjeta del modelo, mientras que las especificaciones de la API la fijaron en unos 131 072 tokens, lo que exige a los desarrolladores realizar pruebas de software exhaustivas antes de la fecha límite de cierre definitivo el 29 de octubre.

Preguntas frecuentes

Pregunta: ¿Cuál es el costo de generar imágenes con el nuevo modelo Nano Banana?
Respuesta: El costo es de 30 dólares por millón de tokens de salida, lo que equivale a 3.4 centavos para imágenes con resolución 1K y alrededor de 7.6 centavos para imágenes 4K.

Pregunta: ¿Cuál es la principal actualización en la arquitectura de software del modelo?
Respuesta: El modelo fue construido sobre la arquitectura Gemini 3.6 Flash, con soporte para múltiples niveles de pensamiento y el uso de hasta 14 imágenes de referencia para la guía.

Pregunta: ¿Cuándo se descontinuarán las versiones visuales anteriores de la API?
Respuesta: Google estableció el 29 de octubre de 2026 como fecha límite para retirar el modelo anterior Flash Image, instando a los desarrolladores a migrar a la versión actualizada.

شارك هذا الموضوع:

شارك هذا الموضوع:

اترك رد

الفئات

المنشورات الأخيرة

Discover more from Buzzinga

Subscribe now to keep reading and get access to the full archive.

Continue reading