Google обновила Nano Banana 2.1: улучшены редактирование и консистентность

Google представила обновление модели для генерации и редактирования изображений Nano Banana. Версия 2.1 построена на Gemini 3.6 Flash и сохраняет ключевую особенность Flash-линейки — быстрый инференс при более низкой стоимости по сравнению с моделями Pro.
Модель уже доступна в Gemini, AI Studio и Gemini API. Основной акцент в обновлении сделан на редактировании изображений: Google заявляет об улучшении консистентности персонажей и объектов, а также о более удобной работе с несколькими изображениями, масками и эскизами.
Редактирование нескольких изображений и инфографика
Nano Banana 2.1 поддерживает multi-image editing и позволяет использовать до 14 изображений в качестве референсов. По данным Google, модель способна сохранять консистентность до четырёх персонажей и точность до десяти объектов в составе сцены.
Отдельное направление — генерация инфографики. При подготовке таких изображений модель может использовать знания Gemini и данные веб-поиска. Это должно помогать не только создавать визуально оформленный материал, но и точнее работать с фактическим содержанием.
Контекст и параметры генерации
Модель получила контекстное окно объёмом до 1 млн токенов для текста и изображений. На выходе заявлена поддержка до 4K токенов для изображения и до 64K токенов для текста. При этом для Gemini API опубликованы отдельные ограничения: до 131 072 входных и до 32 768 выходных токенов.
Для генерации доступны разрешения 1K, 2K и 4K, включая широкие и панорамные соотношения сторон. Это позволяет использовать модель как для обычных иллюстраций, так и для более крупных композиций и визуальных материалов.
В Nano Banana 2.1 также появилась настраиваемая глубина режима Thinking. Пользователь может выбрать уровень minimal, medium или high, причём средний уровень установлен по умолчанию. Такой подход позволяет балансировать между скоростью обработки и глубиной анализа задачи.


