Референсы: как прикладывать свои фото, чтобы модель поняла задачу

Сколько снимков принимает каждая модель, чем «Стиль» отличается от «Персонажа», почему важен порядок файлов и какой исходник даёт хороший результат.

19 сентября 2026 г. · Как пользоваться, Работа с фото

Референсы: как прикладывать свои фото, чтобы модель поняла задачу

Приложить фото к запросу — это не «дать модели картинку», а поставить ей задачу. От того, сколько снимков вы приложили, в каком порядке и что написали в тексте, результат меняется сильнее, чем от выбора модели.

Сколько снимков принимает каждая модель

МодельФото за раз
GPT Image16
Nano Banana, Seedream14
Wan Image9
Grok Imagine, Midjourney5
Kling Image, Niji4
Qwen Image, Ideogram3
Flux, Bria2
Recraft, Topaz, Stable Diffusion1

Число — не показатель силы модели. Шестнадцать снимков нужны в редких задачах; в обычной правке больше трёх-четырёх скорее мешают: модель начинает усреднять и теряет главный объект.

Разные входы — разные задачи

В рабочей зоне снимки кладутся не в одну кучу, а в отдельные рамки: у каждой своё назначение.

  • Референсы — общий визуальный исходник.
  • Сюжет — влияет на предметы и композицию.
  • Стиль — модель берёт палитру и манеру, но не содержание. У Midjourney это флаг --sref.
  • Персонаж — лицо, которое нужно сохранить. У Midjourney это --cref.
  • Первый кадр — для видео: с него начнётся ролик.

Положить фото человека в «Стиль» и ждать сходства бессмысленно — модель возьмёт оттуда цвет и фактуру, а не лицо.

Порядок имеет значение

В некоторых задачах модель читает снимки по порядку. Пример — примерка одежды: первый снимок человек, второй вещь. Поменяйте местами — получите вещь, «одетую» в человека.

Когда снимков несколько, на них можно ссылаться прямо в тексте: @Image1, @Image2. Так вы говорите, что с каким делать: возьми кружку с @Image1 и поставь её на стол из @Image2. Метки видны рядом с прикреплёнными файлами.

Какой исходник даёт хороший результат

  • Резкость важнее разрешения. Смазанный кадр модель «дорисует» по-своему, и это будет уже другой предмет.
  • Объект целиком и не перекрыт. Обрезанная кружка станет кружкой другой формы.
  • Ровный свет. Жёсткие тени модель принимает за часть предмета.
  • Однотонный фон — модель точнее понимает границы объекта.
  • Лицо крупно. Если человек на снимке занимает сотню пикселей, сохранять нечего.

Кадрируйте снимок перед загрузкой: лишнее в кадре — это лишние решения, которые модель примет за вас.

Что написать в запросе

Приложенный снимок не отменяет текст. Наоборот, текст становится важнее: он объясняет, что именно делать с картинкой.

  • замени фон на светлую студию, человека не трогай
  • оставь предмет как есть, добавь мягкую тень и отражение на столе
  • перерисуй в стиле акварели, лицо и позу сохрани

Формулировка «сделай красиво» при приложенном фото — худший вариант: модель воспримет это как разрешение переделать всё.

Частые ошибки

Много снимков «на всякий случай». Четыре ракурса одного предмета путают модель сильнее, чем помогают. Берите лучший.

Скриншот вместо фотографии. Пережатый скриншот из мессенджера теряет детали, и они не восстановятся.

Референс чужого стиля с узнаваемым автором. Модель может отказать, а результат — оказаться слишком похожим на оригинал. Лучше описывать приём словами: «плотный мазок, тёплая палитра», а не называть художника.

Ожидание, что модель «увидит» то, чего нет. Затылок не превратится в лицо, а размытый номер — в читаемый.

Где это уже настроено

В разделе «Тренды и задачи» у каждого рецепта входы подписаны и расставлены по порядку: примерить одежду, подобрать причёску, фото товара, общее фото. Остаётся загрузить снимки в нужные рамки.

Что дальше

Как формулировать саму просьбу — шесть частей запроса. Какая модель лучше держит исходник при правке — разбор моделей для правки фото.

Читайте также