Midjourney против GPT Image 2.5: GPT лучше справляется с текстом и сложными заданиями
Основатель Promptsref
Основатель Promptsref и автор AI UGC-контента, специализирующийся на рабочих процессах генеративного ИИ, промпт-инжиниринге и обучении авторов; аудитория в социальных сетях превышает 40 000 человек.
В этой статье
- Портрет: Midjourney выразительнее, GPT точнее передаёт направление взгляда
- Предметная съёмка: материалы хороши у обоих, но GPT меньше ошибается
- Афиши и надписи: если важен текст, начинайте с GPT
- Раскадровка: GPT сохраняет сюжет, Midjourney теряет ключевые действия
- Серии и обложки: как использовать стилевые референсы Midjourney
- Flare или Sunburst: выбирайте композицию под свою задачу
- Какую модель выбрать для следующей работы
Мы сравнили 12 изображений, созданных в генераторе изображений с ИИ Promptsref. Midjourney V8.2, GPT Image 2.5 Flare и Sunburst получили одинаковые четыре задания: портрет флористки, банка чая, двуязычная афиша и история в четырёх кадрах. Это привычные задачи для дизайнеров, интернет-магазинов и авторов контента. Мы оценивали, какой результат удобнее взять за основу для дальнейшей работы.
В этом сравнении GPT Image 2.5 оказался предпочтительнее там, где нужны точные надписи, заданные предметы и полная последовательность действий. Midjourney привлекает выразительностью лиц, цветом и манерой рисунка. Обе модели убедительно передают материалы. Безусловного победителя по реалистичности нет, как нет и явного перевеса Flare над Sunburst или наоборот.
Портрет: Midjourney выразительнее, GPT точнее передаёт направление взгляда
Первое задание — пожилая женщина у входа в цветочный магазин в сумерках. Она держит оранжевые георгины и смотрит на пустую улицу. В кадре должны сочетаться тёплый свет из магазина и холодный вечерний свет снаружи. Здесь важны и сам портрет, и организация пространства вокруг него.



Midjourney хорошо расставляет акценты. Морщинистое лицо, оранжевые цветы и тёмно-зелёный фасад сразу притягивают взгляд. Потёртые рамы и стены сочетаются с выражением лица, не отвлекая от женщины. Как портрет этот результат понравился нам больше всего.
Но смысл сцены изменился. Женщина смотрит прямо в камеру: тихое наблюдение за улицей превратилось в портрет, обращённый к зрителю. Лепестки оказались на подоконнике, а не на ступеньке у входа. Картинка выразительная, однако заданный момент в ней потерян.
Flare и Sunburst правильно направили взгляд. Flare показывает больше улицы, а Sunburst в вертикальном кадре сосредоточился на женщине и дверном проёме. Оба чётко разделили тёплый свет внутри и холодный снаружи. При этом женщины выглядят немного моложе, а позы кажутся более постановочными.
Ради настроения и выразительности мы выбрали бы Midjourney; если важно показать флористку, смотрящую на улицу, — GPT. Направление взгляда кажется мелочью, но именно оно определяет, как зритель понимает действие человека.
Предметная съёмка: материалы хороши у обоих, но GPT меньше ошибается
Банка чая должна быть матово-оранжевой, с серебристой крышкой из шлифованного металла и кремовой бумажной этикеткой, на которой написано только FIELD и JASMINE TEA. Справа — один зелёный лист. Стол и фон светло-серые, свет падает сверху слева.



Midjourney убедительно передал металлические блики, фактуру и объём. Сильный боковой свет подчёркивает форму банки, тёплые оттенки хорошо сочетаются. Но фон стал розовым, листьев оказалось два, а из JASMINE пропала латинская N. На этикетке появился лишний мелкий текст, и резкая тень уходит влево, вопреки заданному направлению света.
Обе версии GPT правильно воспроизвели этикетку, один лист и серый фон. Видны различия между шлифованным металлом, бумагой и матовой краской; тень под банкой выглядит естественно. Flare крупнее показал товар в вертикальном кадре. Sunburst оставил больше свободного места в квадратном изображении — это удобно, если рядом нужно разместить другие элементы.
При увеличении на сером фоне обеих картинок GPT видна мелкая фактура. На столе Midjourney тоже есть зернистость. Эти участки стоит проверить, если для макета нужен чистый фон: фактура, которая делает банку правдоподобнее, в свободном пространстве вокруг неё может мешать.
Для этого концепта товара мы выбрали бы GPT. На всех трёх изображениях банка выглядит металлической, но GPT ещё и сохраняет название и заданную расстановку. Картинку Midjourney можно использовать как ориентир по свету и цвету, однако этикетку и композицию придётся исправлять.
Афиши и надписи: если важен текст, начинайте с GPT
Для афиши книжного магазина требовались четыре текстовых блока: «今晚,读一本书», «AN EVENING OF READING», «FRIDAY · 19:30–21:00» и «免费入场 · FREE ENTRY», а также раскрытая книга и полумесяц. Задание проверяет китайские и английские надписи, цифры и умение выстроить понятную иерархию информации.



Midjourney нарисовал книгу и луну в сдержанных тонах, но не добавил ни одной надписи о мероприятии. Получилась иллюстрация, поверх которой дизайнеру ещё предстоит сверстать афишу. Отсутствие информации — более серьёзная проблема, чем неудачный выбор шрифта.
Flare и Sunburst включили все четыре блока целиком. При визуальной проверке явных ошибок в написании или времени не обнаружилось. Китайский заголовок самый крупный, под ним — английский подзаголовок, в центре — рисунок, внизу — подробности мероприятия. Тему и время легко найти.
Flare прорисовал больше линий на страницах книги, Sunburst сделал рисунок проще. Для практического использования важнее другое: все нужные слова на месте. В этой двуязычной афише обе версии GPT уверенно выигрывают.
С Midjourney разумно сначала создать иллюстрацию, а затем отдельно добавить текст. Официальная инструкция по генерации текста рекомендует короткие слова и фразы и отмечает лучшие результаты со стандартной латиницей. GPT может создать изображение сразу с надписями. Но если даты, цены и названия будут часто меняться, финальную вёрстку текста удобнее сделать в графическом редакторе.
Раскадровка: GPT сохраняет сюжет, Midjourney теряет ключевые действия
Последнее задание — история в четырёх кадрах. Женщина с тёмным каре в жёлтом дождевике гуляет с белой собакой, у которой одно ухо чёрное. Начинается дождь, и женщина раскрывает красный зонт. Затем она встаёт на колени и укрывает только собаку, оставляя собственную голову под дождём. В конце они отдыхают на скамейке, а собака кладёт голову женщине на колени. В первом и последнем кадрах зонт должен быть закрыт.



Здесь нужно проверить три вещи: все ли предметы на месте, верны ли действия и узнаются ли женщина и собака от кадра к кадру. Одного общего стиля рисунка недостаточно, чтобы рассказать историю.
Приглушённые цвета, свободные линии и фактура старой бумаги у Midjourney хорошо подходят для книжной иллюстрации. Однако зонт открыт с самого начала. В третьем кадре он укрывает и женщину, а в последнем исчезают и собака, и зонт. Чёрное ухо тоже не сохраняется достаточно ясно. Из истории пропали готовность промокнуть ради собаки и тёплая финальная сцена — два её главных момента.
Flare и Sunburst сохранили четыре этапа: раскрыть зонт, перенести его над собакой и в конце сесть вместе на скамейку. Дождевик, каре и чёрное ухо остаются узнаваемыми. Оба результата сохраняют и заданную живописную манеру иллюстрации. GPT рассказывает эту историю, а Midjourney меняет её существенные части.
У GPT тоже есть небольшие несостыковки. В Flare ремешок на плече из первых кадров позднее уже не виден отчётливо. У Sunburst дождевик меняется с расстёгнутого на застёгнутый. Обе героини кажутся моложе заданной молодой взрослой женщины. Для черновой раскадровки сюжет понятен. Для готовой книги придётся согласовать возраст героини и детали одежды.
Серии и обложки: как использовать стилевые референсы Midjourney
Если несколько обложек должны объединять общая палитра, освещение и манера рисунка, стилевой референс Midjourney помогает задать это направление. Можно выбрать подходящее изображение-образец и менять сюжет следующих работ.
Согласно официальной документации, Style Reference передаёт особенности цвета, фактуры, художественной техники и света. Силу влияния можно регулировать весом. Если привычная стилизация Midjourney слишком заметна, режим Raw уменьшает автоматическое вмешательство модели.
При работе над серией важно понимать, что именно нужно сохранить. Похожая акварельная манера — вопрос стиля. Тот же человек или та же упаковка — вопрос постоянства объекта. Style Reference решает первую задачу. Сам по себе он не гарантирует одинаковое лицо или товар во всех изображениях.
Flare или Sunburst: выбирайте композицию под свою задачу
Обе версии правильно написали этикетки и текст афиши, а также сохранили основные события истории. Полезнее сравнивать, насколько крупно показан объект, сколько места оставлено фону и как подробно нарисована иллюстрация.
| Задание | Flare | Sunburst |
|---|---|---|
| Портрет флористки | Больше контекста улицы | Более тесный вертикальный кадр с женщиной и входом |
| Банка чая | Крупный товар в вертикальном кадре; верная этикетка | Больше места в квадратном кадре; верная этикетка |
| Двуязычная афиша | Полный текст; больше линий в книге | Полный текст; более простой рисунок книги |
| История в четырёх кадрах | Основные действия сохранены; меняется ремешок | Основные действия сохранены; меняется застёжка дождевика |
Эти изображения не дают причины всегда предпочитать одну версию другой. В портрете флористки Flare удобнее, если нужно показать улицу, а Sunburst — если хочется сосредоточиться на женщине. Для банки чая выбор зависит от макета: нужен вертикальный или квадратный формат и сколько свободного места требуется вокруг товара.
Какую модель выбрать для следующей работы
Для концепта товара с точной этикеткой, афиши с текстом или раскадровки мы начали бы с GPT Image 2.5. В таких задачах имена, количество предметов и действия не должны теряться при генерации. В нашем сравнении GPT сохраняет больше этой информации.
Midjourney стоит попробовать для выразительных портретов и иллюстраций к обложкам, где допустима свободная трактовка. Флористка — наш любимый портрет, а книжная манера рисунка у модели обаятельна. Именно эти конкретные визуальные качества дают повод её выбрать.
Решение зависит от результата, который вам нужен: картинка с подходящим настроением или изображение, точно передающее уже определённое содержание. В первом случае мы рассмотрели бы Midjourney. Во втором результаты этого сравнения склоняют нас к GPT Image 2.5.
Методика сравнения
Мы оценили по одному опубликованному изображению каждой модели для четырёх заданий, выполненных 21 сентября 2026 года. Промпты доступны на страницах работ по ссылкам. Автор подтвердил использование Midjourney V8.2; в каждом задании запрашивалось четыре изображения, но здесь оценено только то, которым он поделился. Настройки GPT — 1K и автоматическое соотношение сторон. Размеры и композиции различаются. Выводы относятся к показанным работам, а не к средней результативности повторных попыток. Стилевые референсы описаны в документации, но в этих четырёх заданиях не использовались.
