
Google представила Nano Banana 2.1 — инструмент для создания и редактирования изображений. Он способен обрабатывать разрешение вплоть до 4K и объединять в одном запросе до 14 референсных изображений.
Модель уже доступна в Gemini, Google AI Studio и Gemini API. Кроме того, Google внедрила её в ряд других продуктов, таких как Google Search AI Mode, Google Ads, Flow и Stitch. Более подробная информация представлена в материале Postium.
Также читайте: 25 нейросетей для генерации изображений
Возможности нейросети Nano Banana 2.1
Google улучшила взаимодействие модели с текстом, изображениями персонажей и объектами. При редактировании Nano Banana 2.1 должна лучше сохранять облик персонажей и объектов при множественных изменениях.
В одном запросе можно использовать максимум 14 изображений. Модель поддерживает согласованность до четырёх персонажей и до десяти объектов. Это может быть полезно, например, для переноса нескольких героев или предметов из референсов в одну сцену.
Nano Banana 2.1 также может осуществлять поиск в Google по веб-страницам и изображениями. Это позволяет учитывать актуальные данные при выполнении запросов, требующих внешней информации.
Как воспользоваться
Перейдите в Gemini, выберите режим «Создание изображений» и модель Gemini 3.6 Flash. Введите запрос и, если необходимо, прикрепите референсы. Затем нажмите «Отправить».

Для разработчиков Nano Banana 2.1 доступна через Gemini API под идентификатором gemini-nano-banana-2.1. Модель принимает текст, изображения, видео и PDF, а результатом может быть как изображение, так и текст.
При этом Google отмечает наличие проблем с мелким текстом и некоторые ошибки во время редактирования. Модель может неправильно сохранить характеристики персонажей или неверно интерпретировать пространственные указания, такие как «слева» и «справа».
В заключение: Nano Banana 2.1 добавила возможность работы с 14 референсами, генерацию изображений до 4K и более точное редактирование текста, персонажей и объектов.


