Дизайн и видео

Промты для нейросетей картинки: порядок слов, параметры и разбор неудач

Механика запроса на картинку: вес первых слов, порядок блоков, длина, негативные формулировки и параметры генераторов. Три промта целиком под предметный кадр, иллюстрацию и иконку плюс таблица разбора: какой дефект в кадре какой правкой промта лечится.

Короткий ответ: на результат влияют четыре вещи — порядок слов, длина, конкретность и параметры. Главный объект идёт в начало, стиль в конец, длина держится в пределах 30-60 слов. Дальше промт не пишется заново, а правится по одному признаку, и для этого есть таблица разбора.

Почему первые слова промта весят больше остальных

Генератор распределяет внимание неравномерно: начало описания влияет на кадр сильнее хвоста. Отсюда порядок: сначала главный объект и его состояние, потом окружение, потом свет и ракурс, стиль и технические требования в конце. Промт, который начинается со слов «в стиле минимализма», отдаст стилю главную роль, а предмет получится второстепенным.

Длина работает так же прямолинейно. До 30 слов кадр выходит общим, 30-60 слов — рабочая зона, после 70-80 модель начинает терять требования, и обычно теряет как раз то, что вам важно. Поэтому вежливые обороты, «пожалуйста» и «сделай красиво» из промта выкидываются: они занимают место и не несут смысла.

В каком порядке идут блоки промта: шесть позиций от объекта до формата

  1. Главный объект и его состояние. Что в кадре, из чего сделано, в каком виде: «керамическая кружка молочного цвета, матовая, наполовину полная».
  2. Окружение. Поверхность, помещение, что рядом, время суток. Два-три предмета максимум, иначе получится каша.
  3. Свет. Источник и направление: «мягкий боковой свет из окна слева», «жёсткий верхний свет студийной лампы». Строка про свет меняет кадр сильнее любого прилагательного.
  4. Ракурс и оптика. Высота камеры, крупность, глубина резкости: «с уровня стола, средний план, фон размыт».
  5. Стиль. Тип изображения и палитра. В конец, чтобы стиль не перетянул на себя главную роль.
  6. Технические требования. Соотношение сторон, пустая зона под текст, запреты. Забывается чаще всего, и потом квадратный кадр не лезет в вертикальную карточку.

Проверка собранного промта занимает пять секунд: прочитайте его вслух и уберите каждое слово, без которого кадр не изменится. Обычно уходят «красивый», «профессиональный», «качественный» и «современный» — модель не знает, что за ними стоит.

Три промта целиком: предметный кадр, иллюстрация к статье и иконка

Стеклянная банка мёда с деревянной ложкой поперёк горлышка, крышка снята и лежит рядом. Дубовый стол, льняная салфетка под банкой, два грецких ореха рядом. Мягкий боковой свет из окна слева, тёплые тени средней длины. Съёмка с уровня стола, средний план, фон размыт. Предметная фотография, тёплая палитра. Без надписей и этикеток, без рук в кадре. Вертикальный кадр 3:4, верхняя четверть свободна.

Пустой стеллаж с картонными коробками только на нижних полках. Складское помещение, бетонный пол, ровный холодный свет от потолочных ламп. Общий план с уровня глаз. Редакционная фотография, приглушённая серо-синяя палитра, лёгкое зерно. Без людей, без техники, без читаемых надписей на коробках. Горизонтальный кадр 16:9, правая треть без деталей.

Иконка конверта с часами в углу. Плоская векторная графика, толстая линия одинаковой толщины, без обводки по контуру. Два цвета: тёмно-синий объект на светло-сером фоне. Один объект по центру, отступы от краёв не меньше десятой части кадра. Без теней, без градиента, без мелких деталей и без текста. Квадрат 1:1.

Все три промта помещаются в 40-55 слов и построены по одному порядку блоков. Их можно взять как основу: меняется первый блок и палитра, остальное перекладывается почти без правок.

Какие параметры управляют кадром в Midjourney и чем их заменить в чате

Что задаём В Midjourney В ChatGPT и Gemini
Соотношение сторон —ar 3:4 словами: «вертикальный кадр 3 к 4»
Сила стилизации —stylize от 0 до 1000 нет, только через описание стиля
Повтор кадра —seed с числом нет, каждая генерация с нуля
Ссылка на стиль —sref с адресом картинки загрузка образца в чат
Один и тот же герой —cref с фото загрузка фото, но стабильность ниже
Запрет объекта —no текст, люди словами, с обязательной проверкой

В Stable Diffusion и Kandinsky к этому добавляется отдельное поле негативного промта и настройки числа шагов и силы следования тексту. В чат-генераторах ручек нет вообще: всё, что там можно, — точнее сформулировать словами и загрузить образец.

Что писать в негативном промте, а что бесполезно

  • Работает. Перечень объектов, которых в кадре быть не должно: люди, надписи, логотипы, лишняя посуда, провода.
  • Работает. Технические дефекты: размытость, водяной знак, рамка.
  • Бесполезно. Абстракции вроде «некрасиво», «плохое качество», «непрофессионально». Модель не знает, что это.
  • Вредно в чатах. Формулировка «без текста» в ChatGPT нередко приводит к появлению текста. Надёжнее не упоминать надписи вовсе и добавить их в редакторе.

Какой дефект кадра какой правкой промта лечится

Что не так в кадре Что менять в промте
Свет плоский, кадр никакой назвать источник и направление: «мягкий боковой свет из окна слева»
В кадре каша из предметов убрать половину объектов, оставить один главный и один фоновый
Ракурс не тот задать высоту камеры и фокусное расстояние: «с уровня стола, 50 мм»
Слишком гладко, видно генерацию добавить признаки съёмки: зерно, лёгкая тень, следы использования на предмете
Надпись превратилась в набор букв убрать текст из промта, поставить его в редакторе поверх
Предмет не похож на ваш загрузить фото как образец, прилагательными это не решается
Цвета уехали назвать палитру двумя-тремя цветами и фон отдельно
Герой меняется от кадра к кадру ссылка на персонажа или один и тот же образец для всей серии
Заголовок некуда поставить прописать пустую зону: «нижняя треть кадра без деталей»
Кадр выглядит как реклама из стока убрать слова «профессиональный» и «современный», назвать конкретную сцену

Частая ошибка: переписать промт целиком вместо одной правки

Сценарий знакомый. Из четырёх вариантов один почти подошёл: свет хороший, композиция собранная, но в углу лишний предмет. Человек стирает поле, пишет новое описание на 70 слов, добавляет «уберите лишнее» и «сделайте лучше» — и получает четыре совершенно других кадра, ни один из которых не дотягивает до того, что было.

Механика тут такая: генератор не помнит предыдущий результат и не понимает слово «лучше». Каждый новый запуск — это новая случайная точка, и удачное сочетание света с композицией вы уже потеряли. Правило простое: за раз меняется один блок промта, остальное копируется буква в букву. В Midjourney к этому добавляется значение seed от удачного кадра — тогда правка одного слова меняет одну деталь, а не весь кадр.

Ещё дешевле бывает вообще не трогать промт: лишний предмет в углу убирается в редакторе за минуту, а на его вытравливание генерациями уходит 10-15 попыток.

Чем промт под фотографию отличается от промта под иллюстрацию и иконку

  • Фотография. Тип съёмки, свет и его направление, фокусное расстояние, глубина резкости, поверхность. Без этих слов получается витрина из стока.
  • Иллюстрация. Техника и толщина линии, палитра в три цвета, наличие или отсутствие обводки, плоская заливка или градиент, фон.
  • Иконка. Плоская, один объект, один цвет плюс фон, поля по краям, без теней и мелких деталей. Иконка с фактурой не читается в размере 24 пикселя.
  • Фон под текст. Отдельно указать пустую зону: «нижняя треть кадра пустая, без деталей». Иначе надпись некуда ставить.

Как вести список промтов, чтобы не собирать каждый раз с нуля

Заготовок нужно немного: 10-15 штук под задачи, которые повторяются. Карточка выглядит так — название задачи, текст промта с подстановками в квадратных скобках, параметры, значение seed для удачного кадра и сам результат рядом. Через месяц такой список экономит больше времени, чем любые чужие подборки на сто пунктов: чужой промт написан под чужой товар, чужой свет и чужую площадку.

Чего от промта ждать не стоит: кириллица, схемы, точный товар

Надписи на кириллице плывут у всех моделей, лучше других держит Ideogram, но проверять всё равно приходится глазами. Схему или график генератор рисует как картинку, похожую на схему: подписи и цифры будут выдуманными. Ваш конкретный флакон со своей этикеткой модель не знает — тут нужен референс или правка готового фото. Пальцы, отражения и мелкие предметы в руках стали лучше, но остаются местом, где чаще всего вылезает брак.

Сколько времени экономит отлаженный промт и что он стоит по рынку

Кадр Промт с нуля По готовой заготовке Заказать в Беларуси
Фон под баннер 15-20 минут 5 минут от 40 BYN за штуку
Предметный кадр товара 40-60 минут 15-20 минут предметная съёмка партии от 300 BYN
Иллюстрация к статье 25-35 минут 10 минут от 50 BYN
Набор из шести иконок 1,5-2 часа 30-40 минут от 120 BYN

Подписка на генератор обходится в несколько десятков рублей в месяц, а конкретные суммы и лимиты меняются несколько раз в год — их смотрят на странице тарифов сервиса, а не в чужой статье. Выгода при этом появляется не на одной картинке, а на объёме и на скорости правок: пакет баннеров у дизайнера в Беларуси начинается от 150 BYN, и переделать его через неделю — это новый срок и новый счёт.

Как навык писать промты превращается в услугу с чеком и в поток заказов, разобрано на странице курса для дизайнеров: в программе более 150 уроков по 30 минут, обучение рассчитано на 12 месяцев, доступ индивидуальный. Требования площадок к изображениям и то, что можно ставить на карточку товара, — на странице для селлеров. Понять, какие кадры нужны именно в вашей работе, помогает бесплатный разбор на 20-30 минут.

Частые вопросы

Какой длины должен быть промт для картинкиРабочая длина - 30-60 слов. После 70-80 слов часть требований перестаёт учитываться, а вежливые обороты вроде «пожалуйста, сделай» просто занимают место.
Работает ли негативный промт в ChatGPTПлохо. Формулировка «без надписей» иногда приводит к появлению надписей. В Midjourney для этого есть параметр --no, в Stable Diffusion и Kandinsky - отдельное поле негативного промта.
Как повторить одну и ту же картинку дваждыВ Midjourney и Stable Diffusion для этого есть seed: тот же промт с тем же значением даёт близкий кадр. В чат-генераторах повторяемости нет, там помогает только загрузка первого кадра как образца.
Почему нейросеть игнорирует часть промтаПричин две: промт длиннее, чем модель удерживает, и требования спорят между собой. Лечится сокращением до одного главного объекта и разнесением правок по шагам.
Нужно ли писать промт на английскомДля Flux, Midjourney и Stable Diffusion английский заметно точнее в деталях материала и света. Русское описание переводится тем же чатом за пятнадцать секунд.

Дизайнерам: разберём вашу ситуацию бесплатно

Управляемая генерация под бриф, видео без съёмки и сборка сайтов без разработчика.

Подробнее