Дизайн и видео

Нейросеть для генерации изображений по фото: новый кадр по вашему образцу

Загруженное фото работает образцом: модель переносит с него стиль, предмет или лицо и рисует новый кадр. Разбираем, что переносится надёжно, что придумывается заново, готовый промт для переноса товара в новую сцену и сколько генераций уходит на один пригодный результат.

Короткий ответ: вы загружаете фото как образец, и модель рисует по нему новый кадр. Исходника в результате нет — переносится что-то одно: стиль, предмет или лицо. Лучше всего получаются сцены с вашим товаром и портреты в другой обстановке, хуже всего — точная копия упаковки с надписями.

Чем генерация по образцу отличается от редактирования готового снимка

Это две разные задачи, и путаница между ними стоит вечера работы. При редактировании исходник остаётся: вы убрали провод, поменяли цвет куртки, расширили кадр, всё остальное на месте. При генерации по образцу исходника в результате нет вообще — модель посмотрела на фото и нарисовала новое изображение, похожее по стилю, по предмету или по человеку в кадре.

Признак Редактирование снимка Генерация по образцу
Что остаётся от исходника все пиксели, кроме исправленных ничего, кадр рисуется заново
Типичная задача убрать лишний предмет, поменять цвет тот же товар в другой обстановке
Разрешение результата как у исходника стандартный размер сервиса, часто меньше
Что проверяют после границу правки и цвет сходство предмета с оригиналом
Попыток до пригодного кадра 1-3 6-20
Зачем нужно доработать то, что сняли получить кадр, которого не снимали

Отсюда правило выбора на одну строку. Нужен тот же снимок с одной поправкой — это редактирование. Нужен другой кадр, но в той же эстетике или с тем же товаром — это генерация по образцу, и дальше речь только про неё.

Что модель переносит с фото надёжно, а что придумывает заново

Что переносим Насколько надёжно Что при этом ломается
Стиль: свет, палитра, зерно, глубина резкости высокая надёжность, совпадения деталей не требуется почти ничего, это самый спокойный сценарий
Предмет: силуэт, пропорции, цвет средняя, узнаётся с первого взгляда фактура шва, гравировка, кнопки, состав на упаковке
Лицо человека узнаваемость держится примерно в семи кадрах из десяти форма носа, родинки, разрез глаз плывут от кадра к кадру
Композиция сцены целиком низкая, берётся настроение, а не расстановка предметы переставляются, ракурс меняется
Надписи и логотип не переносится вообще получаются похожие, но чужие буквы и знак

Работает всё это по одному якорю за раз. Просьба «сохрани и лицо, и товар, и свет как на фото» обычно возвращает кадр, где не сохранено ничего: модель распределяет внимание между тремя требованиями и не выполняет ни одного до конца.

Какие сервисы принимают фото как образец: Midjourney, Gemini, ChatGPT, Кандинский

Инструмент Что переносит лучше Ограничение
Midjourney со ссылкой на изображение стиль, свет, настроение, серия в одной эстетике русский запрос понимает хуже, описание лучше переводить; доступ только по платной подписке
Gemini предмет и человека между кадрами иногда меняет пропорции предмета, есть бесплатный уровень с суточным лимитом
ChatGPT точность по словесному описанию сцены сглаживает фактуру, кадр выглядит рисованным
Кандинский, Шедеврум работают бесплатно и по русскому запросу ниже детализация, перенос лица слабый, вечерами очередь
Flux в сторонних оболочках совмещает правку и генерацию по образцу доступ через чужие площадки, интерфейс английский, условия лицензии читать отдельно

Подписка на сервис генерации обходится порядка 60-90 BYN в месяц, суммы и наборы тарифов пересматриваются несколько раз в год — смотреть их стоит на странице тарифов самого сервиса, а не в чужой статье. Белорусская карта на зарубежных сервисах обычно не проходит, поэтому первые недели практики честнее прожить на бесплатных Шедевруме и Кандинском.

Промт для переноса товара с фото в новую сцену: готовый шаблон

Запрос состоит из четырёх частей: что на образце, какую сцену строим, что менять запрещено, какой формат кадра нужен. Четвёртая часть чаще всего забывается, и потом квадратная картинка не лезет в вертикальную карточку.

На загруженном фото — керамическая кружка молочного цвета с матовой поверхностью. Построй новый кадр: та же кружка стоит на деревянном столе у окна, рядом раскрытая книга и льняная салфетка, утренний рассеянный свет слева, мягкие тени. Форму, пропорции, цвет и положение ручки кружки сохрани точно как на образце, поверхность оставь матовой. Надписей и логотипов на кружке не рисуй, оставь её гладкой. Кадр вертикальный, соотношение 3:4, товар занимает примерно треть высоты.

Для портрета формула та же, меняются якоря: сохраняем лицо, меняем обстановку и одежду.

На фото — мужчина 35-40 лет. Сделай портрет этого же человека для делового профиля: светлый офис с размытым фоном, тёмно-синий пиджак и белая рубашка, ровный студийный свет, взгляд в камеру, кадр по грудь. Черты лица, форму носа, разрез глаз и линию бровей сохрани как на исходном фото. Очков не добавляй, бороду не меняй. Кадр вертикальный, соотношение 4:5.

Как поставить товар с фото в новую сцену: семь шагов от съёмки до карточки

  1. Снимите товар как образец. Однотонный фон, рассеянный свет, без вспышки и бликов, объект целиком в кадре. Телефона хватает, а вот срезанный край или отражение лампы на глянце испортят все последующие генерации.
  2. Загрузите снимок и опишите сцену словами. Поверхность, окружение, время суток, направление света, ракурс. Общие слова вроде «уютно» модель понимает как угодно.
  3. Отдельной фразой перечислите запреты. Что нельзя менять: форма, цвет, пропорции, положение этикетки, число предметов в кадре.
  4. Задайте формат кадра сразу. Вертикальный под карточку, квадрат под ленту, горизонтальный под обложку. Обрезка квадрата под вертикаль съедает треть композиции.
  5. Сделайте 4-6 вариантов за заход. Выбирайте тот, где предмет ближе к оригиналу, а не тот, где красивее фон: фон правится, форма товара — нет.
  6. Верните надписи и логотип слоем в редакторе. Берите их из исходного снимка. Сгенерированный текст на упаковке почти всегда переделывается.
  7. Посмотрите результат на телефоне в размере карточки. Половина огрехов, заметных на мониторе, там не видна, и наоборот: кривая пропорция на маленьком экране вылезает первой.

Частая ошибка: три якоря в одном запросе

Типичная ситуация выглядит так. Человек загружает фото своего товара на своей витрине, просит «такой же товар, такую же витрину и такой же свет, только чтобы стояла зима за окном» — и получает похожий, но чужой предмет в чужом магазине. Дальше идут десять попыток с добавлением слов «точно», «в точности», «строго как на фото», и каждая следующая хуже предыдущей.

Причина в том, что модель не копирует, а восстанавливает по описанию. Чем больше признаков вы требуете сохранить, тем сильнее размывается каждый. Рабочий обход состоит из двух проходов: сначала генерируется сцена без товара — витрина, свет, зима за окном; потом товар вставляется из исходного снимка в редакторе с подгонкой света. Времени уходит те же двадцать минут, но результат предсказуем и товар остаётся вашим.

Что ломается при генерации по фото: надписи, логотипы и пропорции

  • Текст на предмете. Буквы складываются в похожие, но чужие слова. На кириллице заметно хуже, чем на латинице.
  • Логотип. Получается знак «в стиле вашего», а не ваш. Для брендированной упаковки это брак, который нельзя показывать клиенту.
  • Размер и пропорции. Бутылка становится выше, коробка шире, кружка глубже. На карточке товара это прямой путь к возвратам и жалобам.
  • Руки и мелкие предметы в руках. Стало заметно лучше, чем пару лет назад, но проверять нужно каждый кадр: лишний палец находится не сразу.
  • Повтор персонажа в серии. Один человек в пяти кадрах узнаётся, в двадцати расползается: к концу серии это уже другой человек.
  • Отражения и прозрачное. Стекло, вода, глянец собираются из правдоподобных бликов, которые не соответствуют геометрии сцены.

Сколько генераций уходит на пригодный кадр и сколько это стоит в BYN

Задача Попыток до результата Время Сколько стоит по рынку Беларуси
Лайфстайл-кадр с товаром 6-15 30-50 минут предметная съёмка партии от 300 BYN
Портрет для профиля и резюме 10-20 40-60 минут съёмка в студии от 120 BYN
Фон и обложка по референсу 3-6 15-20 минут пакет баннеров у дизайнера от 150 BYN
Серия из пяти кадров в одном стиле 25-40 2-3 часа съёмочный день от 500 BYN

Выгода появляется не на одном кадре, а на объёме и на скорости правок. Переснять партию через неделю нельзя: товар отгружен, сезон прошёл, модель уехала. Перегенерировать сцену можно за вечер, и это единственный честный аргумент в пользу генерации — не дешевизна, а обратимость.

Где генерация по образцу приносит деньги в Беларуси

Два понятных применения. Первое — карточки и лайфстайл-кадры для маркетплейсов, когда позиций десятки, а бюджета на съёмку каждой нет. Второе — контент для соцсетей магазина или эксперта, где кадр нужен раз в два дня и обязательно в одной стилистике. В обоих случаях платят не за красивую картинку, а за поток: двадцать однородных кадров к четвергу.

Как это встраивается в работу дизайнера и превращается в услугу с ценой и сроком, разобрано на странице курса для дизайнеров. Требования площадок к изображениям и то, что можно ставить на карточку, — на странице для селлеров. Обучение рассчитано на 12 месяцев, уроки по 30 минут, их более 150 и становится больше, доступ индивидуальный. Если непонятно, с какой задачи начинать именно вам, есть бесплатный разбор на 20-30 минут: там расспросят про вашу ситуацию, покажут, что закрывается ИИ уже сегодня, назовут инструменты и уроки и прикинут деньги по рыночным ценам.

Частые вопросы

Можно ли сгенерировать картинку по своему фотоДа, фото загружается как образец. Модель переносит с него что-то одно: стиль кадра, предмет или лицо. Все три признака сразу пока не держит ни один сервис, и попытка попросить всё вместе даёт кадр, где не сохранено ничего.
Сохранится ли товар на сгенерированном фото точь-в-точьФорма, цвет и общие пропорции узнаются, мелкие детали нет. Гравировка, шов, кнопки и состав на этикетке будут придуманы, поэтому надписи и логотип возвращают из исходного снимка слоем в редакторе.
Есть ли бесплатные нейросети для генерации по фотоШедеврум и Кандинский работают без оплаты и понимают русский запрос. Детализация ниже, чем у платных сервисов, перенос лица заметно слабее, а в вечерние часы появляется очередь на генерацию.
Сколько генераций нужно на один хороший кадрНа лайфстайл-сцену с товаром обычно уходит 6-15 попыток, на портрет 10-20, на серию из пяти кадров в одном стиле 25-40. Первые три варианта почти никогда не идут в работу.
Можно ли использовать сгенерированное фото товара на маркетплейсеГлавное фото карточки должно показывать реальный товар: сгенерированная комплектация, цвет или размер - это обман покупателя и возвраты. Сгенерированный фон и лайфстайл-кадры на дополнительных слайдах обычно допустимы, но правила площадок различаются, и их проверяют до загрузки партии.

Дизайнерам: разберём вашу ситуацию бесплатно

Управляемая генерация под бриф, видео без съёмки и сборка сайтов без разработчика.

Подробнее