Промпт-инжиниринг

Midjourney против GPT Image 2.5: GPT лучше справляется с текстом и сложными заданиями

underwood
underwood

Основатель Promptsref

Основатель Promptsref и автор AI UGC-контента, специализирующийся на рабочих процессах генеративного ИИ, промпт-инжиниринге и обучении авторов; аудитория в социальных сетях превышает 40 000 человек.

14 мин чтения
В этой статье

Мы сравнили 12 изображений, созданных в генераторе изображений с ИИ Promptsref. Midjourney V8.2, GPT Image 2.5 Flare и Sunburst получили одинаковые четыре задания: портрет флористки, банка чая, двуязычная афиша и история в четырёх кадрах. Это привычные задачи для дизайнеров, интернет-магазинов и авторов контента. Мы оценивали, какой результат удобнее взять за основу для дальнейшей работы.

В этом сравнении GPT Image 2.5 оказался предпочтительнее там, где нужны точные надписи, заданные предметы и полная последовательность действий. Midjourney привлекает выразительностью лиц, цветом и манерой рисунка. Обе модели убедительно передают материалы. Безусловного победителя по реалистичности нет, как нет и явного перевеса Flare над Sunburst или наоборот.

Портрет: Midjourney выразительнее, GPT точнее передаёт направление взгляда

Первое задание — пожилая женщина у входа в цветочный магазин в сумерках. Она держит оранжевые георгины и смотрит на пустую улицу. В кадре должны сочетаться тёплый свет из магазина и холодный вечерний свет снаружи. Здесь важны и сам портрет, и организация пространства вокруг него.

Midjourney V8.2Midjourney V8.2: Выразительное лицо и удачные цвета, но женщина смотрит в камеру, а не на улицу.
Выразительное лицо и удачные цвета, но женщина смотрит в камеру, а не на улицу. Посмотреть работу
GPT Image 2.5 FlareGPT Image 2.5 Flare: Взгляд направлен правильно, в кадре больше улицы.
Взгляд направлен правильно, в кадре больше улицы. Посмотреть работу
GPT Image 2.5 SunburstGPT Image 2.5 Sunburst: Взгляд направлен правильно; вертикальный кадр сосредоточен на женщине и входе.
Взгляд направлен правильно; вертикальный кадр сосредоточен на женщине и входе. Посмотреть работу

Midjourney хорошо расставляет акценты. Морщинистое лицо, оранжевые цветы и тёмно-зелёный фасад сразу притягивают взгляд. Потёртые рамы и стены сочетаются с выражением лица, не отвлекая от женщины. Как портрет этот результат понравился нам больше всего.

Но смысл сцены изменился. Женщина смотрит прямо в камеру: тихое наблюдение за улицей превратилось в портрет, обращённый к зрителю. Лепестки оказались на подоконнике, а не на ступеньке у входа. Картинка выразительная, однако заданный момент в ней потерян.

Flare и Sunburst правильно направили взгляд. Flare показывает больше улицы, а Sunburst в вертикальном кадре сосредоточился на женщине и дверном проёме. Оба чётко разделили тёплый свет внутри и холодный снаружи. При этом женщины выглядят немного моложе, а позы кажутся более постановочными.

Ради настроения и выразительности мы выбрали бы Midjourney; если важно показать флористку, смотрящую на улицу, — GPT. Направление взгляда кажется мелочью, но именно оно определяет, как зритель понимает действие человека.

Предметная съёмка: материалы хороши у обоих, но GPT меньше ошибается

Банка чая должна быть матово-оранжевой, с серебристой крышкой из шлифованного металла и кремовой бумажной этикеткой, на которой написано только FIELD и JASMINE TEA. Справа — один зелёный лист. Стол и фон светло-серые, свет падает сверху слева.

Midjourney V8.2Midjourney V8.2: Материалы убедительны, но есть ошибка в надписи, розовый фон и два листа.
Материалы убедительны, но есть ошибка в надписи, розовый фон и два листа. Посмотреть работу
GPT Image 2.5 FlareGPT Image 2.5 Flare: Этикетка и число листьев верны; товар крупно показан в вертикальном кадре.
Этикетка и число листьев верны; товар крупно показан в вертикальном кадре. Посмотреть работу
GPT Image 2.5 SunburstGPT Image 2.5 Sunburst: Этикетка и число листьев верны; в квадратном кадре больше свободного места.
Этикетка и число листьев верны; в квадратном кадре больше свободного места. Посмотреть работу

Midjourney убедительно передал металлические блики, фактуру и объём. Сильный боковой свет подчёркивает форму банки, тёплые оттенки хорошо сочетаются. Но фон стал розовым, листьев оказалось два, а из JASMINE пропала латинская N. На этикетке появился лишний мелкий текст, и резкая тень уходит влево, вопреки заданному направлению света.

Обе версии GPT правильно воспроизвели этикетку, один лист и серый фон. Видны различия между шлифованным металлом, бумагой и матовой краской; тень под банкой выглядит естественно. Flare крупнее показал товар в вертикальном кадре. Sunburst оставил больше свободного места в квадратном изображении — это удобно, если рядом нужно разместить другие элементы.

При увеличении на сером фоне обеих картинок GPT видна мелкая фактура. На столе Midjourney тоже есть зернистость. Эти участки стоит проверить, если для макета нужен чистый фон: фактура, которая делает банку правдоподобнее, в свободном пространстве вокруг неё может мешать.

Для этого концепта товара мы выбрали бы GPT. На всех трёх изображениях банка выглядит металлической, но GPT ещё и сохраняет название и заданную расстановку. Картинку Midjourney можно использовать как ориентир по свету и цвету, однако этикетку и композицию придётся исправлять.

Афиши и надписи: если важен текст, начинайте с GPT

Для афиши книжного магазина требовались четыре текстовых блока: «今晚,读一本书», «AN EVENING OF READING», «FRIDAY · 19:30–21:00» и «免费入场 · FREE ENTRY», а также раскрытая книга и полумесяц. Задание проверяет китайские и английские надписи, цифры и умение выстроить понятную иерархию информации.

Midjourney V8.2Midjourney V8.2: Книга и луна есть, но весь текст мероприятия пропущен.
Книга и луна есть, но весь текст мероприятия пропущен. Посмотреть работу
GPT Image 2.5 FlareGPT Image 2.5 Flare: Все четыре блока на месте, информация ясно организована.
Все четыре блока на месте, информация ясно организована. Посмотреть работу
GPT Image 2.5 SunburstGPT Image 2.5 Sunburst: Текст полный, рисунок книги более простой.
Текст полный, рисунок книги более простой. Посмотреть работу

Midjourney нарисовал книгу и луну в сдержанных тонах, но не добавил ни одной надписи о мероприятии. Получилась иллюстрация, поверх которой дизайнеру ещё предстоит сверстать афишу. Отсутствие информации — более серьёзная проблема, чем неудачный выбор шрифта.

Flare и Sunburst включили все четыре блока целиком. При визуальной проверке явных ошибок в написании или времени не обнаружилось. Китайский заголовок самый крупный, под ним — английский подзаголовок, в центре — рисунок, внизу — подробности мероприятия. Тему и время легко найти.

Flare прорисовал больше линий на страницах книги, Sunburst сделал рисунок проще. Для практического использования важнее другое: все нужные слова на месте. В этой двуязычной афише обе версии GPT уверенно выигрывают.

С Midjourney разумно сначала создать иллюстрацию, а затем отдельно добавить текст. Официальная инструкция по генерации текста рекомендует короткие слова и фразы и отмечает лучшие результаты со стандартной латиницей. GPT может создать изображение сразу с надписями. Но если даты, цены и названия будут часто меняться, финальную вёрстку текста удобнее сделать в графическом редакторе.

Раскадровка: GPT сохраняет сюжет, Midjourney теряет ключевые действия

Последнее задание — история в четырёх кадрах. Женщина с тёмным каре в жёлтом дождевике гуляет с белой собакой, у которой одно ухо чёрное. Начинается дождь, и женщина раскрывает красный зонт. Затем она встаёт на колени и укрывает только собаку, оставляя собственную голову под дождём. В конце они отдыхают на скамейке, а собака кладёт голову женщине на колени. В первом и последнем кадрах зонт должен быть закрыт.

Midjourney V8.2Midjourney V8.2: Привлекательный стиль, но зонт открыт сразу, а собака исчезает в конце.
Привлекательный стиль, но зонт открыт сразу, а собака исчезает в конце. Посмотреть работу
GPT Image 2.5 FlareGPT Image 2.5 Flare: Четыре действия понятны; ремешок на плече не сохраняется отчётливо.
Четыре действия понятны; ремешок на плече не сохраняется отчётливо. Посмотреть работу
GPT Image 2.5 SunburstGPT Image 2.5 Sunburst: Все четыре этапа на месте, но дождевик меняется с расстёгнутого на застёгнутый.
Все четыре этапа на месте, но дождевик меняется с расстёгнутого на застёгнутый. Посмотреть работу

Здесь нужно проверить три вещи: все ли предметы на месте, верны ли действия и узнаются ли женщина и собака от кадра к кадру. Одного общего стиля рисунка недостаточно, чтобы рассказать историю.

Приглушённые цвета, свободные линии и фактура старой бумаги у Midjourney хорошо подходят для книжной иллюстрации. Однако зонт открыт с самого начала. В третьем кадре он укрывает и женщину, а в последнем исчезают и собака, и зонт. Чёрное ухо тоже не сохраняется достаточно ясно. Из истории пропали готовность промокнуть ради собаки и тёплая финальная сцена — два её главных момента.

Flare и Sunburst сохранили четыре этапа: раскрыть зонт, перенести его над собакой и в конце сесть вместе на скамейку. Дождевик, каре и чёрное ухо остаются узнаваемыми. Оба результата сохраняют и заданную живописную манеру иллюстрации. GPT рассказывает эту историю, а Midjourney меняет её существенные части.

У GPT тоже есть небольшие несостыковки. В Flare ремешок на плече из первых кадров позднее уже не виден отчётливо. У Sunburst дождевик меняется с расстёгнутого на застёгнутый. Обе героини кажутся моложе заданной молодой взрослой женщины. Для черновой раскадровки сюжет понятен. Для готовой книги придётся согласовать возраст героини и детали одежды.

Серии и обложки: как использовать стилевые референсы Midjourney

Если несколько обложек должны объединять общая палитра, освещение и манера рисунка, стилевой референс Midjourney помогает задать это направление. Можно выбрать подходящее изображение-образец и менять сюжет следующих работ.

Согласно официальной документации, Style Reference передаёт особенности цвета, фактуры, художественной техники и света. Силу влияния можно регулировать весом. Если привычная стилизация Midjourney слишком заметна, режим Raw уменьшает автоматическое вмешательство модели.

При работе над серией важно понимать, что именно нужно сохранить. Похожая акварельная манера — вопрос стиля. Тот же человек или та же упаковка — вопрос постоянства объекта. Style Reference решает первую задачу. Сам по себе он не гарантирует одинаковое лицо или товар во всех изображениях.

Flare или Sunburst: выбирайте композицию под свою задачу

Обе версии правильно написали этикетки и текст афиши, а также сохранили основные события истории. Полезнее сравнивать, насколько крупно показан объект, сколько места оставлено фону и как подробно нарисована иллюстрация.

ЗаданиеFlareSunburst
Портрет флористкиБольше контекста улицыБолее тесный вертикальный кадр с женщиной и входом
Банка чаяКрупный товар в вертикальном кадре; верная этикеткаБольше места в квадратном кадре; верная этикетка
Двуязычная афишаПолный текст; больше линий в книгеПолный текст; более простой рисунок книги
История в четырёх кадрахОсновные действия сохранены; меняется ремешокОсновные действия сохранены; меняется застёжка дождевика

Эти изображения не дают причины всегда предпочитать одну версию другой. В портрете флористки Flare удобнее, если нужно показать улицу, а Sunburst — если хочется сосредоточиться на женщине. Для банки чая выбор зависит от макета: нужен вертикальный или квадратный формат и сколько свободного места требуется вокруг товара.

Какую модель выбрать для следующей работы

Для концепта товара с точной этикеткой, афиши с текстом или раскадровки мы начали бы с GPT Image 2.5. В таких задачах имена, количество предметов и действия не должны теряться при генерации. В нашем сравнении GPT сохраняет больше этой информации.

Midjourney стоит попробовать для выразительных портретов и иллюстраций к обложкам, где допустима свободная трактовка. Флористка — наш любимый портрет, а книжная манера рисунка у модели обаятельна. Именно эти конкретные визуальные качества дают повод её выбрать.

Решение зависит от результата, который вам нужен: картинка с подходящим настроением или изображение, точно передающее уже определённое содержание. В первом случае мы рассмотрели бы Midjourney. Во втором результаты этого сравнения склоняют нас к GPT Image 2.5.


Методика сравнения

Мы оценили по одному опубликованному изображению каждой модели для четырёх заданий, выполненных 21 сентября 2026 года. Промпты доступны на страницах работ по ссылкам. Автор подтвердил использование Midjourney V8.2; в каждом задании запрашивалось четыре изображения, но здесь оценено только то, которым он поделился. Настройки GPT — 1K и автоматическое соотношение сторон. Размеры и композиции различаются. Выводы относятся к показанным работам, а не к средней результативности повторных попыток. Стилевые референсы описаны в документации, но в этих четырёх заданиях не использовались.

Об авторе

underwood

underwood

Основатель Promptsref

Основатель Promptsref и автор AI UGC-контента, специализирующийся на рабочих процессах генеративного ИИ, промпт-инжиниринге и обучении авторов; аудитория в социальных сетях превышает 40 000 человек.