Перейти к содержимому
LaFoto

Каталог моделей

Модели ИИ для изображений — описываем, а не ранжируем

Семь моделей, которые люди реально называют, и чем каждая хороша по сути. Без оценок — ответ полностью зависит от задачи, с которой вы пришли.

Эти модели не конкурируют в одном и том же. Midjourney навязывает эстетику, FLUX буквально следует инструкции, Nano Banana меняет фотографию, не теряя человека на ней, Stable Diffusion даёт вам компоненты, Recraft выводит редактируемые векторы, Seedream набирает шрифты на китайском и английском, а gpt-image-1 разбирает сложное предложение. Выбирайте по той из этих фраз, которая описывает вашу задачу.

Как выбирать между ними

Главный вопрос — вы создаёте изображение с нуля или меняете готовую фотографию. Генерация «с нуля» вознаграждает модель за композицию и следование prompt; изменение фото — за умение не трогать то, о чём вы не просили. Это почти противоположные требования, и инструмент, созданный для одного, обычно посредственен в другом.

Второй вопрос — нужна ли воспроизводимость результата. Закрытые хостинговые модели меняются под вами, и внешний вид, на который вы опираетесь в коммерции, может пропасть по графику, который вы не контролируете. Открытые weights это фиксируют ценой собственной инфраструктуры.

Третий — формат вывода, и о нём часто вспоминают слишком поздно. Если файл должен открываться в векторном редакторе или печататься на два метра, это требование отсеивает большую часть списка ещё до вопроса качества.

Что это за каталог

Позиций
Семь моделей
Рейтинг
Нет — описаны
Связь
Ни с одной из них
Цены
Преднамеренно не указаны
Версии
Не фиксированы — меняются слишком быстро
Обновлено
Август 2026

Как читать сравнение моделей

Почти каждый рейтинг отвечает на вопрос, который вы не задавали

Списки «лучших» моделей для изображений обычно делают так: прогоняют через каждую одну и ту же горстку prompt и оценивают результаты. Это измеряет, как конкретные prompt читаются каждой моделью — полезно только если ваша задача им подобна, а набор «демо-prompt для блога» почти никогда на реальные задачи не похож.

Куда полезнее структурные вопросы: модель делает изображения или меняет их, есть ли у неё «эстетическое мнение», можно ли запустить её у себя и что выходит на выходе — пиксели или кривые. Эти свойства не меняются к следующему релизу и отсеивают большую часть списка ещё до разговора о качестве.

семь малых фотографических отпечатков в рамах, разложенных сеткой на светлой студийной стене

Три вопроса, которые быстро сужают выбор

Сначала выберите по ограничениям, потом по качеству

Первая развилка — и самая широкая

Сгенерировать изображение по описанию и отредактировать уже имеющееся фото — почти противоположные задачи. Первая вознаграждает композицию и следование prompt; вторая — аккуратность, когда нетронутым остаётся всё, о чём вы не просили.

Модели для редактирования удерживают идентичность объекта при последовательных изменениях. Модели для генерации дают контроль над кадрированием, оптикой и стилем с нуля. Отличных сразу в обоих режимах мало.

  • Редактирование существующего фото: Nano Banana.
  • Создание с нуля: FLUX, Midjourney.
  • Оба режима, разговорно: gpt-image-1.
Отредактированная ИИ предметная сцена с заменённым фоном

Вопросы по моделям

Что обычно спрашивают перед выбором

Короткие ответы; длинные — на странице каждой модели.

Почему один и тот же prompt и модель дают разные картинки?

Потому что стартовый шум различается. Seed фиксирует этот шум, и связка prompt плюс seed плюс модель воспроизводит изображение точно. Поменяйте любой из трёх — и получите схожий, но не идентичный результат.

Новая модель всегда лучше?

По «сырым» результатам — обычно да. По всему вокруг — экосистема инструментов, адаптеры стилей, ясность лицензии, стабильность цен — нередко нет. Stable Diffusion — самый наглядный пример старшей модели, которую держит экосистема.

Можно ли переносить мои prompt между моделями?

Сюжет и сцена переносятся; параметры и синтаксис — редко. Модели по-разному читают веса, отрицания и токены стилей, и prompt, жёстко отстроенный под одну, обычно переуточнён для другой.

Что дают открытые веса на практике?

Возможность запускать локально, закрепить версию навсегда, генерировать без платы «за картинку» и не выносить исходники на стороннюю инфраструктуру. Взамен — железо и обслуживание.

Какая модель корректно рисует текст?

Несколько уже справляются с короткими строками, и ни одна не заменяет набор в дизайне-инструменте. Сгенерируйте картинку, добавьте слова в редакторе — и вы обойдёте целый класс проблем.

Модель важнее, чем prompt?

Ниже некоторого уровня prompt — нет. Конкретный prompt через среднюю модель обыграет расплывчатый через лучшую, поэтому раздел с подсказками по prompt здесь длиннее, чем сам каталог.

ИИ‑сгенерированная фуд‑фотография при дневном свете

Продолжайте изучать

Другие разделы LaFoto

Каталог описывает инструменты; здесь — что вы с ними делаете.

создайте по описаниюОсновной генератор — от текста к готовой картинке.Открыть120 изображений и их prompt120 изображений с точными prompt, которые их создали.ОткрытьИзображение по изображениюНачните с имеющейся у вас картинки.ОткрытьИИ-фоторедакторИзмените часть фото, остальное сохраните.Открытьupscale до 4KУвеличение до 4K без мыла.Открытьулучшите фотоЭкспозиция, шум и реставрация старых фото.Открытьудалите что-то с фотоМаска и восстановление фона позади.Открытьразмытие с учётом глубиныС учётом глубины, не равномерный фильтр.Открытьдобавьте цвет старому фотоПравдоподобный цвет для ч/б.ОткрытьИИ-генератор логотиповЗнаки, читаемые и на 16 пикселях.Открытьэскизы флеш-татуЭскизы, которые выдерживают набивку.Открытьсгенерируйте иллюстрациюИллюстрации и живопись, а не фото.Открытьстудийные хедшотыСтудийные портреты без студии.Открытьтехнические требования к фотоТочные требования и как им соответствовать.Открытьвизуализация интерьераПерестильте комнату по её фото.Открытьобъяснение терминовSeed, denoise, inpainting — что это такое.Открыть

Вопросы о моделях ИИ для изображений

Какая модель изображений ИИ лучшая?
Единого ответа нет, поэтому этот раздел описывает, а не ранжирует. Midjourney навязывает эстетику, FLUX буквально следует инструкциям, Nano Banana редактирует фотографию, не «теряя» человека, Stable Diffusion отдаёт вам «детали конструкции», Recraft выводит векторы, Seedream набирает текст по-китайски и по-английски, а gpt-image-1 разбирает сложное предложение. Выбирайте по тому, что описывает вашу задачу.
В чём разница между открытой и закрытой моделью?
Открытые веса можно скачать и запускать на своём железе — так вы можете навсегда зафиксировать версию, генерировать без поминутной/поштучной оплаты и держать исходные материалы вне сторонних серверов. К закрытым моделям обращаются через приложение или интерфейс API, им не нужна инфраструктура с вашей стороны, и они меняются по графику провайдера, а не по вашему.
Почему на этих страницах нет цен и номеров версий?
Потому что они меняются быстрее, чем успевает обновляться справочник, а устаревшее число читается как ложь, а не как давность. Здесь написано то, что остаётся стабильным: кто делает модель, как к ней обращаться, открыты ли веса и для чего она построена.
Аффилирована ли LaFoto с какими-либо из этих моделей?
Нет. Мы не перепродаём их и не имеем коммерческих отношений с их разработчиками. Единственное место, где мы говорим от первого лица, — запись про FLUX, где указано, какая модель сгенерировала изображения на этом сайте, — это подтверждается карточка за карточкой в галерее.
Можно ли переносить prompt между моделями?
Сюжет и сцена переносятся, параметры и синтаксис — редко. Модели по-разному читают веса, «негативы» и токены стиля, и сильно «подогнанный» под одну модель prompt обычно оказывается переуточнённым для другой.
Новая модель всегда лучше старой?
По сырому качеству выдачи — обычно да. По всему вокруг — экосистема инструментов, адаптеры стилей, ясность лицензий — часто нет. Stable Diffusion — наглядный пример старой модели, остающейся актуальной благодаря экосистеме, а не самим результатам.
Какую модель использовать для редактирования уже имеющейся фотографии?
Ту, что построена именно для редактирования, а не генерации. Ключевая способность — узнаваемо сохранять объект при последовательных изменениях, тогда как большинство text-to-image моделей теряет его уже после одной-двух правок.
Есть ли модели, которые надёжно рендерят текст?
Несколько моделей справляются с короткими строками достаточно хорошо, чтобы это можно было обыграть в дизайне, но ни одна не заменяет набор текста. Генерируйте картинку, а слова добавляйте в дизайн-инструменте — сгенерированный леттеринг нельзя отредактировать, проверить орфографию или перевести потом.

Начните создавать сегодня

Сгенерируйте своё первое изображение в лучшем генераторе на ИИ.

Преобразуйте фразу в готовое, фотореалистичное изображение за секунды — а затем отточите каждую деталь. Без настройки, без Discord, без GPU.

К LaFoto уже присоединились 4 200+ авторов