Midjourney или DALL-E: какую картинку чем быстрее сделать
Сравнение двух генераторов по способу управления, а не по красоте кадра: где выигрывает правка словами в чате, а где нужны параметры и фактура Midjourney. С разбором одной задачи двумя маршрутами, таблицей по типам картинок и связкой из двух инструментов.
Короткий ответ: DALL-E внутри ChatGPT выигрывает там, где важно точно выполнить сложное указание и поправить кадр словами. Midjourney выигрывает там, где нужна фактура, свет и единый стиль в серии. Ваш конкретный товар с вашей этикеткой не нарисует ни один из них.
Чем DALL-E в ChatGPT отличается от Midjourney по способу управления
Это два разных способа работы, а не две кнопки с одинаковым результатом. В ChatGPT картинка живёт внутри диалога: вы описываете кадр обычными словами, получаете одно изображение и правите его репликами — «убери вторую чашку», «сделай светлее», «поверни на четверть». Модель помнит предыдущий кадр и контекст разговора.
Midjourney устроен иначе. Вы отправляете короткое плотное описание с параметрами и получаете сразу четыре варианта. Правка идёт не разговором, а новой генерацией с изменённым параметром или выбором варианта для увеличения. Интерфейс английский, работа идёт на сайте или в Discord, и русский запрос модель понимает заметно хуже английского.
| Признак | DALL-E в ChatGPT | Midjourney |
|---|---|---|
| Что приходит на один запрос | одно изображение | сетка из четырёх вариантов |
| Как правится кадр | репликой в диалоге | новой генерацией или параметром |
| Язык запроса | русский работает наравне с английским | английский точнее, русский теряет детали |
| Повтор удачного кадра | нет, каждый запуск с нуля | есть через seed |
| Бесплатная проба | есть суточный лимит | нет |
| Приватность результата | кадр остаётся в вашем чате | на младших тарифах виден в общей галерее |
Одна задача двумя маршрутами: обложка статьи в чате и в Midjourney
Задача одна: горизонтальная обложка со стеллажом на складе, место под заголовок справа. Маршрут в чате состоит из разговора.
Нарисуй горизонтальную обложку 16:9. Складской стеллаж, нижние полки заполнены картонными коробками, верхние пустые. Бетонный пол, холодный свет от потолочных ламп, общий план с уровня глаз. Людей и надписей в кадре нет. Правая треть кадра свободна от деталей, туда пойдёт заголовок.
Дальше две-три реплики: «коробок слишком много, оставь два ряда», «свет сделай холоднее», «правую треть освободи полностью». Каждая правка держится за предыдущий кадр. На всё уходит 8-12 минут, из них половина — на то, чтобы разглядеть, что именно не так.
Маршрут в Midjourney короче по тексту и длиннее по перебору. Запрос отправляется сразу с параметрами:
warehouse shelving unit, cardboard boxes on lower shelves only, upper shelves empty, concrete floor, cold overhead fluorescent light, eye-level wide shot, editorial photography, muted grey-blue palette, empty space on the right side —ar 16:9 —style raw —no people, text, logos
Приходит четыре варианта примерно за минуту. Если один почти подошёл — берутся слабые вариации от него, потом увеличение. Если не подошёл ни один — меняется одно слово и запуск повторяется. Итог: 10-20 минут и кадр с фактурой, которую в чате получить труднее. Отсюда общее правило: чат экономит время на объяснении, Midjourney экономит время на подборе картинки.
Какая задача чем решается быстрее: таблица по типам картинок
| Задача | Чем делать | Почему |
|---|---|---|
| Иллюстрация к статье или посту | ChatGPT | кадр правится словами прямо там, где написан текст |
| Картинка со сложным составом объектов | ChatGPT | точнее выполняет указание «три предмета, второй слева, надпись сверху» |
| Лайфстайл-кадр с товаром | Midjourney | свет и фактура ближе к съёмке, меньше глянцевой гладкости |
| Серия иллюстраций в одном стиле | Midjourney | ссылка на стиль и повтор по seed держат серию |
| Рекламный баннер под тест в 10 вариантах | Midjourney | четыре варианта за запуск, перебор идёт быстрее |
| Схема, макет, картинка с надписью | ChatGPT | текст выходит ближе к задуманному, хотя проверять надо всё равно |
| Аватар и портрет в другой обстановке | Midjourney | ссылка на персонажа держит лицо стабильнее |
| Материалы клиента под соглашение о неразглашении | ChatGPT | на младших тарифах Midjourney кадры попадают в общую галерею |
Сколько стоят подписки Midjourney и ChatGPT и как их оплатить из Беларуси
- Midjourney. Бесплатного режима нет вообще. Начальный тариф — несколько десятков рублей в месяц с ограниченным пакетом быстрых генераций, следующий стоит кратно дороже и добавляет безлимитный медленный режим.
- ChatGPT. Порядок величины тот же, но подписка закрывает не только картинки: тексты, разбор файлов, таблицы, голосовой режим.
- Где смотреть суммы. Наборы тарифов и лимиты у обоих сервисов пересматриваются несколько раз в год, поэтому актуальные цифры берут на странице тарифов самого сервиса.
- Бесплатно. У ChatGPT, Gemini и Ideogram есть суточные лимиты, у Шедеврума и Kandinsky — генерация без оплаты и на русском.
Отдельный пункт для Беларуси: белорусской картой ни одна из этих подписок напрямую не оплачивается. Нужна зарубежная карта или посредник, а это комиссия сверху и риск, что платёж не пройдёт в нужный момент. При выборе между двумя подписками этот фактор часто перевешивает разницу в качестве кадра.
Где Kandinsky и Шедеврум закрывают задачу, а где нет
Российские генераторы решают две проблемы сразу: они бесплатны и понимают русский без перевода, оплата не нужна вовсе. Этого хватает на картинку к посту в личный блог, на фон, на иллюстрацию идеи. Не хватает на карточку товара, рекламный баннер и предметный кадр: детализация ниже, фотореализм заметно слабее, перенос лица с образца работает плохо.
Stable Diffusion стоит рядом отдельно: это модель, которую ставят на свой компьютер или запускают через сторонние площадки. Управления там больше всего, но и порог входа выше, и видеокарта нужна приличная. Как самостоятельный инструмент это отдельная тема, а для сравнения двух подписок достаточно знать, что бесплатность там оплачивается временем на настройку.
Что Midjourney и DALL-E делают одинаково плохо
- Надписи на кириллице. Буквы складываются в похожие, но чужие слова. Разница между инструментами есть, но она в количестве попыток, а не в надёжности.
- Точная копия товара и логотипа. Получается предмет «в стиле вашего». Для брендированной упаковки это брак.
- Схемы и графики с цифрами. Рисуется картинка, похожая на схему, подписи выдуманы.
- Повторяемость персонажа. В серии из пяти кадров герой узнаётся, в серии из двадцати расползается.
- Мелкая механика. Пальцы, отражения, ремешки, застёжки: проверять нужно каждый кадр.
Частая ошибка: сравнивать инструменты по одной красивой картинке
Обычно выбор делают так: открывают галерею Midjourney, видят там кадры уровня рекламной съёмки, оплачивают подписку и через неделю понимают, что свою задачу не закрывают. В галерее лежат портреты и фантастические пейзажи, а нужна была обложка с местом под заголовок и тремя предметами в заданном порядке.
Ошибка в том, что сравнивается лучший кадр чужого человека с вашим первым. Честное сравнение делается иначе: берёте одну свою реальную задачу — ту, которая повторяется каждую неделю, — и прогоняете её в обоих сервисах по 15 минут. Смотрите не на красоту, а на три вещи: сколько попыток до пригодного кадра, сколько времени ушло на объяснение и что пришлось доделывать в редакторе. Полчаса такой проверки отвечают на вопрос точнее любого сравнения в сети, потому что у вас свой тип кадра, свой формат и свои сроки.
Как выбрать один инструмент, если бюджет на одну подписку
Правило простое. Если картинки нужны к текстам, постам и презентациям и их правят по мелочи — берите ChatGPT: подписка закрывает и генерацию, и всё остальное. Если визуал сам по себе продукт — карточки, баннеры, обложки, серии, — берите Midjourney, разница в фактуре там окупается.
Второй фильтр — приватность. Если вы работаете с материалами клиентов и подписываете соглашение о неразглашении, младшие тарифы Midjourney не подходят: генерации видны в общей галерее, а скрытый режим включается только на самом дорогом тарифе.
Связка из двух: чат пишет промт, Midjourney рисует
Связка работает лучше любого выбора между инструментами. Задачу вы описываете человеческим языком в чате, а он собирает из неё плотный английский промт с параметрами:
Собери промт для Midjourney по моей задаче. Формат ответа: одна строка на английском, 40-55 слов, порядок блоков — главный объект, окружение, свет, ракурс, стиль, палитра. В конце параметры: соотношение сторон и список запретов через —no. Прилагательных вроде beautiful и professional не используй. Моя задача: [описать по-русски, что нужно и куда пойдёт кадр].
Дальше промт отправляется в Midjourney, выбранный кадр увеличивается, надписи и логотип ставятся в редакторе. Как эта пара встраивается в поток дизайнерских задач и во сколько оценивается работа, разобрано на странице курса для дизайнеров: обучение идёт 12 месяцев, уроков более 150 и становится больше, доступ индивидуальный. Тем, кто делает визуал пачками под ленту и сторис, ближе страница для SMM-специалистов. Что подойдёт под ваши задачи, можно разобрать на бесплатном созвоне 20-30 минут: там расспросят про вашу работу, покажут, что закрывается ИИ уже сегодня, и назовут инструменты и уроки.
Частые вопросы
Дизайнерам: разберём вашу ситуацию бесплатно
Управляемая генерация под бриф, видео без съёмки и сборка сайтов без разработчика.
Подробнее →