Google представила Nano Banana 2.1 для генерации и редактирования изображений

Google выпустила обновлённую модель генерации и редактирования изображений Nano Banana 2.1. Она пришла на смену Nano Banana 2, также известной как Gemini 3.1 Flash Image, и сохраняет её высокую скорость работы и низкую стоимость вычислений.
При этом разработчики заявляют о заметном улучшении реализма и детализации изображений. Модель умеет создавать результаты в разрешениях 1K, 2K и 4K, причём по умолчанию используется режим 1K. Отдельно была доработана генерация панорам с экстремальными пропорциями: до 1:8 и 8:1. В таких сценах система устраняет артефакты, возникающие на границах сегментации.
Работа с текстом и несколькими изображениями
Nano Banana 2.1 стала лучше справляться с читаемостью текста внутри изображений. Улучшения также затронули компоновку элементов сложной инфографики, где важны точное расположение подписей, блоков и других визуальных компонентов.
Ещё одной особенностью стала поддержка мультиреференсного слияния. Модель может одновременно анализировать до 14 изображений, сохраняя узнаваемую внешность до четырёх персонажей и точные черты до десяти отдельных объектов в серии кадров. Это позволяет использовать несколько референсов при создании согласованных сцен и изображений.
Поиск, рассуждения и доступность
В новой версии появилась привязка к результатам поиска Google и Google Картинки. Кроме того, пользователи могут выбирать уровень рассуждений Thinking: минимальный, средний или высокий. Модель принимает текстовые запросы, изображения, видео и документы в формате PDF.
Контекстное окно Nano Banana 2.1 вмещает до 131 072 входных токенов, а максимальный объём ответа составляет до 32 768 выходных токенов. Это позволяет обрабатывать крупные наборы входных данных в рамках одной задачи.
Модель уже доступна разработчикам в Google AI Studio и через официальный API. Обычные пользователи могут работать с Nano Banana 2.1 непосредственно в интерфейсе Gemini.


