Google представила модель генерации изображений Nano Banana 2.1

Google выпустила обновлённую модель для генерации и редактирования изображений Nano Banana 2.1. Она пришла на смену Nano Banana 2, также известной как Gemini 3.1 Flash Image, и сохранила ключевые преимущества предшественницы — высокую скорость работы и низкую стоимость вычислений.
При этом разработчики заявляют о заметном улучшении реализма и детализации изображений. Модель умеет создавать результаты в разрешениях 1K, 2K и 4K, причём по умолчанию используется режим 1K. Отдельно была доработана генерация панорам с экстремальными пропорциями: Nano Banana 2.1 устраняет артефакты сегментации при соотношении сторон до 1:8 и 8:1.
Работа с текстом и несколькими изображениями
Одним из направлений обновления стала работа с текстом внутри изображений. Нейросеть стала лучше формировать читаемые надписи и размещать элементы сложной инфографики, что должно повысить качество постеров, схем и других визуальных материалов с большим количеством текста.
Nano Banana 2.1 также получила поддержку мультиреференсного слияния. Модель может одновременно анализировать до 14 изображений, сохраняя узнаваемую внешность до четырёх персонажей и точные особенности до десяти отдельных объектов в серии кадров.
Поиск, рассуждения и доступность
В обновлённой версии появилась возможность заземлять результаты на данных поиска Google и Google Картинок. Кроме того, пользователи могут выбирать уровень рассуждений модели: минимальный, средний или высокий.
На вход Nano Banana 2.1 принимает текст, изображения, видео и документы PDF. Контекстное окно поддерживает до 131 072 входных токенов и до 32 768 выходных токенов, что позволяет работать с объёмными мультимедийными запросами.
Модель уже доступна разработчикам в Google AI Studio и через официальный API. Обычные пользователи могут обращаться к Nano Banana 2.1 непосредственно через интерфейс Gemini.


