Google · model directory
Что такое Nano Banana? Объясняем модель редактирования изображений Google
Nano Banana — прозвище модели изображений Gemini от Google, созданной для диалогового редактирования с сохранением одного и того же объекта при изменениях.
Nano Banana at a glance
- Разработчик
- Семейство
- Gemini
- Доступ
- Приложение Gemini и API
- Известна благодаря
- Редактированию с сохранением персонажа
- Веса
- Закрытые
- Интерфейс
- Диалоговый
Откуда взялось название
Изначально это было не продуктовое имя. Анонимная модель появилась на публичных аренах сравнений, где пользователи оценивают выходы без указания системы, под временной меткой «nano banana». Она часто выигрывала, это заметили, и недели ушли на догадки, пока Google не подтвердил авторство.
Затем Google сделал нетипичное — оставил прозвище, поэтому серьёзная инфраструктура публично известна под шутливым названием. Формально это образная модель семейства Gemini; искомый же термин — banana.
Эта история важна для понимания поиска: интерес возник до маркетинга, поэтому люди спрашивали как про слух — что это, кто сделал, правда ли это — а не как про продукт.
Что именно она делает иначе
Большинство моделей строятся вокруг генерации картинки по описанию. Nano Banana заточена под изменение уже имеющегося изображения, и сложность здесь — в том, чего Вы менять не просили.
Если попросить универсальную модель «надеть на человека в этом фото красное пальто», часто получится человек в красном пальто, но не совсем тот же — другой овал челюсти, иная посадка глаз, лицо «как у родственника». Идентичность держится одну правку и расползается через несколько. Nano Banana сконструирована удерживать именно эту идентичность на серии последовательных шагов.
Из этого следует и способ работы. Вы не пишете один развернутый prompt и не принимаете результат как есть; Вы ведёте диалог, где каждый ход правит предыдущий. «Сдвиньте свет. Теперь сделайте вечер. Теперь вынесите его на улицу». Этот цикл — и есть продукт.
Где это практически полезно
Везде, где один и тот же объект должен появляться многократно. Предметная съёмка в разных сетапах, персонаж через последовательность кадров, набор вариаций одного портрета, мокап комнаты в четырёх цветовых решениях.
Модель также проще для тех, кто не хочет учить синтаксис prompt. Поскольку инструкция — это правка, а не полное ТЗ, работают обычные фразы, а провал от расплывчатого запроса — это небольшое изменение, а не неузнаваемая картинка.
Слабее она в сценарии «с чистого листа». Когда нет исходника и нечего сохранять, механизму консистентности нечего делать, и модели, заточенные под text-to-image, обычно дают больше контроля над кадрированием, оптикой и стилем на старте.
Как она соотносится с альтернативами
С Midjourney различие — в авторстве эстетики. Midjourney накладывает выраженный «домашний стиль» и чаще используется, чтобы сделать зрелищное; Nano Banana старается не трогать картинку там, где Вы не просили. Одна — стилист, другая — ретушёр.
С открытыми моделями — Stable Diffusion и FLUX — различие в том, где живёт контроль. Открытые веса позволяют прикручивать ControlNet, LoRA и inpainting-конвейеры для точности — ценой сборки пайплайна. Nano Banana прячет узкую часть этого контроля за одной фразой: быстрее дотянуться, труднее «продавить дальше».
С gpt-image-1 они ближе друг к другу, чем к остальным: обе закрытые, следуют инструкциям, работают диалогово и привязаны к большому ассистенту. Практическая разница, о которой чаще всего сообщают, — кто лучше держит лицо через несколько итераций. Это стоит проверить на своих материалах, а не по таблице лидеров.
Причём здесь LaFoto
Никакой коммерческой связи — мы не аффилированы с Google и не перепродаём его модели. Эта страница существует, потому что люди спрашивают «что это», и честный ответ короткий, а каталог, описывающий только любимые нами модели, не был бы каталогом.
Её полезно читать вместе со страницами про редактирование здесь: словарь переносится. То, что Nano Banana делает диалогом, открытая экосистема называет техниками: inpainting — правка внутри маски, outpainting — за пределами кадра, denoise strength — насколько результат может уйти от источника. Зная эти слова, гораздо понятнее, что делает любой редактор, а чего — нет.
Редактирование против генерации
Задача, ради которой его сделали
Попросите любую универсальную модель изменить в фото человека одну деталь — и обычно вернётся почти тот же человек. Но челюсть сдвинулась, глаза «сели» иначе, лицо читается как родственник, а не тот же самый. Один правки выдерживает; четыре подряд — нет.
Сохранить личность неизменной, пока меняется всё запрошенное — это отдельная инженерная задача, и именно на неё нацелен этот модельный подход. Поэтому его описывают как редактор, а не генератор, хотя он умеет и то и другое.

Три реальных сценария
Когда требуется согласованность между изображениями
Один и тот же объект в шести обстановках
Продукт снят один раз, затем помещён на кухонную столешницу, столик в кафе, уличную скамью и студийный фон — при этом остаётся тем же узнаваемым объектом.
Попросите генератор выдать тот же продукт шесть раз — вернутся шесть похожих, но разных объектов. Вся коммерческая ценность редактора — именно в этой разнице.
- Снимайте один раз, размещайте много раз.
- Объект должен «выжить» при смене сцены.
- Проверяйте этикетку и логотип на каждом выходе.

Последовательная работа, которая должна быть цельной
Комиксы, раскадровки, поясняющие последовательности и детские книги часто «сыпятся» об одно и то же: к пятому кадру персонаж перестаёт быть собой.
В открытой экосистеме это решают обучением LoRA. Диалоговый редактор приводит к сходному результату без обучения, ценой меньшего уровня точного контроля.
- Шаг обучения не требуется.
- За длинные серии дрейф всё же накапливается.
- Периодически переякоривайтесь на исходное изображение.

Варианты из уже имеющейся картинки
Один портрет, проведённый через разные схемы света, фоны или гардеробы, чтобы клиент мог выбрать — без повторной аренды студии.
Честное ограничение: ни один из вариантов не является фотографией чего-то реального. Это правдоподобные альтернативы — нормально для мудборда и неприемлемо как документальная запись.
- Быстрее, чем пересъёмка ради поиска идей.
- Не замена реальной съёмке.
- Никогда не для документов, удостоверяющих личность.

Вопросы по Nano Banana
Что спрашивают после первой сессии
Темы, которые всплывают, когда новизна проходит.
Почему лицо всё равно со временем «уплывает»?
Каждая правка условлена предыдущим результатом, а не оригиналом, поэтому небольшие ошибки накапливаются. Переотправка исходника каждые несколько шагов обновляет опорную ссылку и останавливает медленный сдвиг.
Могу ли я получить один и тот же результат дважды?
Не надёжно. Диалоговое редактирование не даёт доступ к seed так, как это делает открытый конвейер, — это общая плата за простоту интерфейса.
Это лучше, чем inpainting?
Проще. Inpainting с явной маской даёт точный контроль над тем, какие пиксели можно менять; при фразовой инструкции это решение принимает модель. Для точных работ всё ещё нужна маска.
Можно ли работать сразу от нескольких референсов?
Комбинирование референсов — частый запрос, и поддержка зависит от интерфейса и версии. Проверьте на своём материале, а не полагайтесь на чьё-то описание.
С чем он справляется хуже всего?
Со стартом из пустоты. Без исходника механизму согласованности нечего сохранять, а модели, созданные для text-to-image, дают больше контроля над композицией и оптикой.
Работает ли это с «нечеловеческими» объектами?
Да, и часто надёжнее — у продукта или здания меньше признаков, к которым зритель придирается, чем у лица.

Те же идеи, но по терминам
Термины диалогового редактирования
Исследуйте дальше
Другие разделы LaFoto
Редактирование — одна задача. Есть и другие.
- бесплатный ресайзер изображений
- JPG, PNG и WebP
- компрессор изображений
- обрежьте изображение
- цветовая палитра изображения
- уберите фон
- проверяйте данные EXIF
- структурируйте prompt
- аниме-генератор на ИИ
- сделайте картинку мультяшной
- генератор пиксель-арта
- лучшие ИИ-генераторы изображений
- LaFoto против Midjourney
- альтернатива Leonardo AI
- сравнение с Ideogram
- LaFoto против Canva
- воспроизведение изображения
- что такое denoise strength
- объяснение inpainting
- гайды и разборы
Nano Banana — questions people ask
- Что такое Nano Banana?
- Это теперь уже официально используемое прозвище модели генерации и редактирования изображений Gemini от Google. Она создана для диалогового редактирования с сохранением одного и того же объекта через последовательные правки.
- Кто сделал Nano Banana?
- Google. Это часть семейства Gemini.
- Почему она называется Nano Banana?
- Она анонимно появилась на публичных аренах сравнения под этим временным именем, показала выдающиеся результаты, и ярлык закрепился. Google принял его, а не стал спорить.
- Является ли Nano Banana open source?
- Нет. Веса закрытые, доступ — через приложение и API Google.
- В чём Nano Banana лучше всего?
- В редактировании существующего изображения с сохранением узнаваемости объекта — одного и того же лица через несколько правок, что большинство моделей теряют после одной-двух.
- Лучше ли Nano Banana, чем Midjourney?
- Они решают разные задачи. Midjourney накладывает сильную эстетику и создаёт эффектные кадры «с нуля»; Nano Banana старается менять только запрошенное и оставлять остальное в реальной фотографии как есть.
- Умеет ли Nano Banana генерировать из текста без изображения?
- Да, но это не её сильная сторона. Ключевое преимущество — сохранение объекта при правках, а для этого нужен исходник.
- Использует ли LaFoto Nano Banana?
- Нет, и мы не аффилированы с Google. Эта страница — справка в нашем каталоге моделей.
Начните создавать сегодня
Сгенерируйте своё первое изображение в лучшем генераторе на ИИ.
Преобразуйте фразу в готовое, фотореалистичное изображение за секунды — а затем отточите каждую деталь. Без настройки, без Discord, без GPU.
К LaFoto уже присоединились 4 200+ авторов