Каталог моделей
Модели ИИ для изображений — описываем, а не ранжируем
Семь моделей, которые люди реально называют, и чем каждая хороша по сути. Без оценок — ответ полностью зависит от задачи, с которой вы пришли.
Каталог
- GoogleNano BananaДиалоговый редактор изображений от Google. Сохраняет лицо неизменным при правках.
- Stability AIStable DiffusionОткрытая модель, из которой выросла вся экосистема. LoRA, ControlNet, checkpoints.
- Black Forest LabsFLUX.1От бывших исследователей Stable Diffusion. Буквально следует промпту, рендерит текст.
- Midjourney, Inc.MidjourneyТа самая с «фирменным стилем». С характером, закрытая, только по подписке.
- RecraftRecraftТа, что выдаёт настоящие векторы. Создана для брендинга и дизайна.
- ByteDanceSeedreamМодель ByteDance. Сильная двуязычная отрисовка текста и высокое нативное разрешение.
- OpenAIgpt-image-1Модель, стоящая за изображениями ChatGPT. Точно следует инструкциям, хорошо рендерит текст.
Как выбирать между ними
Главный вопрос — вы создаёте изображение с нуля или меняете готовую фотографию. Генерация «с нуля» вознаграждает модель за композицию и следование prompt; изменение фото — за умение не трогать то, о чём вы не просили. Это почти противоположные требования, и инструмент, созданный для одного, обычно посредственен в другом.
Второй вопрос — нужна ли воспроизводимость результата. Закрытые хостинговые модели меняются под вами, и внешний вид, на который вы опираетесь в коммерции, может пропасть по графику, который вы не контролируете. Открытые weights это фиксируют ценой собственной инфраструктуры.
Третий — формат вывода, и о нём часто вспоминают слишком поздно. Если файл должен открываться в векторном редакторе или печататься на два метра, это требование отсеивает большую часть списка ещё до вопроса качества.
Что это за каталог
- Позиций
- Семь моделей
- Рейтинг
- Нет — описаны
- Связь
- Ни с одной из них
- Цены
- Преднамеренно не указаны
- Версии
- Не фиксированы — меняются слишком быстро
- Обновлено
- Август 2026
Как читать сравнение моделей
Почти каждый рейтинг отвечает на вопрос, который вы не задавали
Списки «лучших» моделей для изображений обычно делают так: прогоняют через каждую одну и ту же горстку prompt и оценивают результаты. Это измеряет, как конкретные prompt читаются каждой моделью — полезно только если ваша задача им подобна, а набор «демо-prompt для блога» почти никогда на реальные задачи не похож.
Куда полезнее структурные вопросы: модель делает изображения или меняет их, есть ли у неё «эстетическое мнение», можно ли запустить её у себя и что выходит на выходе — пиксели или кривые. Эти свойства не меняются к следующему релизу и отсеивают большую часть списка ещё до разговора о качестве.

Три вопроса, которые быстро сужают выбор
Сначала выберите по ограничениям, потом по качеству
Первая развилка — и самая широкая
Сгенерировать изображение по описанию и отредактировать уже имеющееся фото — почти противоположные задачи. Первая вознаграждает композицию и следование prompt; вторая — аккуратность, когда нетронутым остаётся всё, о чём вы не просили.
Модели для редактирования удерживают идентичность объекта при последовательных изменениях. Модели для генерации дают контроль над кадрированием, оптикой и стилем с нуля. Отличных сразу в обоих режимах мало.
- Редактирование существующего фото: Nano Banana.
- Создание с нуля: FLUX, Midjourney.
- Оба режима, разговорно: gpt-image-1.

Кто контролирует то, от чего вы зависите
Закрытые хостинговые модели меняются под вами. Образ, на котором вы построили бренд, может перестать воспроизводиться по чужому расписанию, и закрепить версию нельзя.
Открытые веса решают это и взамен отдают вам инфраструктуру — железо, хранилище, обновления и конвейер, который ломается при обновлении зависимостей.
- Нужна воспроизводимость: Stable Diffusion, FLUX.
- Нет желания держать инфраструктуру: любые хостинговые.
- Объёмы и приватность толкают к self-hosting.

Ограничение, о котором узнают последним
Если результат должен открываться в векторном редакторе, масштабироваться до фасада здания или перекрашиваться кем-то ещё через год, растровая картинка — неверный артефакт, как бы хорошо она ни выглядела.
Так же, если в нём должна быть читабельная типографика на языке с тысячами символов — это сразу отсеивает большую часть списка ещё до остального.
- Редактируемые кривые: Recraft.
- Китайская и английская типографика: Seedream.
- Всё остальное: растровые пиксели.

Вопросы по моделям
Что обычно спрашивают перед выбором
Короткие ответы; длинные — на странице каждой модели.
Почему один и тот же prompt и модель дают разные картинки?
Потому что стартовый шум различается. Seed фиксирует этот шум, и связка prompt плюс seed плюс модель воспроизводит изображение точно. Поменяйте любой из трёх — и получите схожий, но не идентичный результат.
Новая модель всегда лучше?
По «сырым» результатам — обычно да. По всему вокруг — экосистема инструментов, адаптеры стилей, ясность лицензии, стабильность цен — нередко нет. Stable Diffusion — самый наглядный пример старшей модели, которую держит экосистема.
Можно ли переносить мои prompt между моделями?
Сюжет и сцена переносятся; параметры и синтаксис — редко. Модели по-разному читают веса, отрицания и токены стилей, и prompt, жёстко отстроенный под одну, обычно переуточнён для другой.
Что дают открытые веса на практике?
Возможность запускать локально, закрепить версию навсегда, генерировать без платы «за картинку» и не выносить исходники на стороннюю инфраструктуру. Взамен — железо и обслуживание.
Какая модель корректно рисует текст?
Несколько уже справляются с короткими строками, и ни одна не заменяет набор в дизайне-инструменте. Сгенерируйте картинку, добавьте слова в редакторе — и вы обойдёте целый класс проблем.
Модель важнее, чем prompt?
Ниже некоторого уровня prompt — нет. Конкретный prompt через среднюю модель обыграет расплывчатый через лучшую, поэтому раздел с подсказками по prompt здесь длиннее, чем сам каталог.

Читайте дальше
Куда идти из каталога
Продолжайте изучать
Другие разделы LaFoto
Каталог описывает инструменты; здесь — что вы с ними делаете.
- точный размер в пикселях
- конвертируйте формат изображения
- компрессор изображений
- обрежьте изображение
- извлеките цвета из изображения
- уберите фон
- просмотрщик EXIF
- ИИ-генератор prompt
- аниме-генератор на ИИ
- сделайте картинку мультяшной
- генератор пиксель-арта
- какой генератор выбрать
- сравнение с Midjourney
- сравнение с Leonardo
- альтернатива Ideogram
- альтернатива Canva для изображений
- объяснение seed
- что такое denoise strength
- редактирование внутри маски
- журнал LaFoto
Вопросы о моделях ИИ для изображений
- Какая модель изображений ИИ лучшая?
- Единого ответа нет, поэтому этот раздел описывает, а не ранжирует. Midjourney навязывает эстетику, FLUX буквально следует инструкциям, Nano Banana редактирует фотографию, не «теряя» человека, Stable Diffusion отдаёт вам «детали конструкции», Recraft выводит векторы, Seedream набирает текст по-китайски и по-английски, а gpt-image-1 разбирает сложное предложение. Выбирайте по тому, что описывает вашу задачу.
- В чём разница между открытой и закрытой моделью?
- Открытые веса можно скачать и запускать на своём железе — так вы можете навсегда зафиксировать версию, генерировать без поминутной/поштучной оплаты и держать исходные материалы вне сторонних серверов. К закрытым моделям обращаются через приложение или интерфейс API, им не нужна инфраструктура с вашей стороны, и они меняются по графику провайдера, а не по вашему.
- Почему на этих страницах нет цен и номеров версий?
- Потому что они меняются быстрее, чем успевает обновляться справочник, а устаревшее число читается как ложь, а не как давность. Здесь написано то, что остаётся стабильным: кто делает модель, как к ней обращаться, открыты ли веса и для чего она построена.
- Аффилирована ли LaFoto с какими-либо из этих моделей?
- Нет. Мы не перепродаём их и не имеем коммерческих отношений с их разработчиками. Единственное место, где мы говорим от первого лица, — запись про FLUX, где указано, какая модель сгенерировала изображения на этом сайте, — это подтверждается карточка за карточкой в галерее.
- Можно ли переносить prompt между моделями?
- Сюжет и сцена переносятся, параметры и синтаксис — редко. Модели по-разному читают веса, «негативы» и токены стиля, и сильно «подогнанный» под одну модель prompt обычно оказывается переуточнённым для другой.
- Новая модель всегда лучше старой?
- По сырому качеству выдачи — обычно да. По всему вокруг — экосистема инструментов, адаптеры стилей, ясность лицензий — часто нет. Stable Diffusion — наглядный пример старой модели, остающейся актуальной благодаря экосистеме, а не самим результатам.
- Какую модель использовать для редактирования уже имеющейся фотографии?
- Ту, что построена именно для редактирования, а не генерации. Ключевая способность — узнаваемо сохранять объект при последовательных изменениях, тогда как большинство text-to-image моделей теряет его уже после одной-двух правок.
- Есть ли модели, которые надёжно рендерят текст?
- Несколько моделей справляются с короткими строками достаточно хорошо, чтобы это можно было обыграть в дизайне, но ни одна не заменяет набор текста. Генерируйте картинку, а слова добавляйте в дизайн-инструменте — сгенерированный леттеринг нельзя отредактировать, проверить орфографию или перевести потом.
Дополнительные материалы
Начните создавать сегодня
Сгенерируйте своё первое изображение в лучшем генераторе на ИИ.
Преобразуйте фразу в готовое, фотореалистичное изображение за секунды — а затем отточите каждую деталь. Без настройки, без Discord, без GPU.
К LaFoto уже присоединились 4 200+ авторов