Референсы: как прикладывать свои фото, чтобы модель поняла задачу
Сколько снимков принимает каждая модель, чем «Стиль» отличается от «Персонажа», почему важен порядок файлов и какой исходник даёт хороший результат.
19 сентября 2026 г. · Как пользоваться, Работа с фото
Приложить фото к запросу — это не «дать модели картинку», а поставить ей задачу. От того, сколько снимков вы приложили, в каком порядке и что написали в тексте, результат меняется сильнее, чем от выбора модели.
Сколько снимков принимает каждая модель
| Модель | Фото за раз |
|---|---|
| GPT Image | 16 |
| Nano Banana, Seedream | 14 |
| Wan Image | 9 |
| Grok Imagine, Midjourney | 5 |
| Kling Image, Niji | 4 |
| Qwen Image, Ideogram | 3 |
| Flux, Bria | 2 |
| Recraft, Topaz, Stable Diffusion | 1 |
Число — не показатель силы модели. Шестнадцать снимков нужны в редких задачах; в обычной правке больше трёх-четырёх скорее мешают: модель начинает усреднять и теряет главный объект.
Разные входы — разные задачи
В рабочей зоне снимки кладутся не в одну кучу, а в отдельные рамки: у каждой своё назначение.
- Референсы — общий визуальный исходник.
- Сюжет — влияет на предметы и композицию.
- Стиль — модель берёт палитру и манеру, но не содержание. У Midjourney это флаг
--sref. - Персонаж — лицо, которое нужно сохранить. У Midjourney это
--cref. - Первый кадр — для видео: с него начнётся ролик.
Положить фото человека в «Стиль» и ждать сходства бессмысленно — модель возьмёт оттуда цвет и фактуру, а не лицо.
Порядок имеет значение
В некоторых задачах модель читает снимки по порядку. Пример — примерка одежды: первый снимок человек, второй вещь. Поменяйте местами — получите вещь, «одетую» в человека.
Когда снимков несколько, на них можно ссылаться прямо в тексте: @Image1, @Image2. Так вы говорите, что с каким делать: возьми кружку с @Image1 и поставь её на стол из @Image2. Метки видны рядом с прикреплёнными файлами.
Какой исходник даёт хороший результат
- Резкость важнее разрешения. Смазанный кадр модель «дорисует» по-своему, и это будет уже другой предмет.
- Объект целиком и не перекрыт. Обрезанная кружка станет кружкой другой формы.
- Ровный свет. Жёсткие тени модель принимает за часть предмета.
- Однотонный фон — модель точнее понимает границы объекта.
- Лицо крупно. Если человек на снимке занимает сотню пикселей, сохранять нечего.
Кадрируйте снимок перед загрузкой: лишнее в кадре — это лишние решения, которые модель примет за вас.
Что написать в запросе
Приложенный снимок не отменяет текст. Наоборот, текст становится важнее: он объясняет, что именно делать с картинкой.
замени фон на светлую студию, человека не трогайоставь предмет как есть, добавь мягкую тень и отражение на столеперерисуй в стиле акварели, лицо и позу сохрани
Формулировка «сделай красиво» при приложенном фото — худший вариант: модель воспримет это как разрешение переделать всё.
Частые ошибки
Много снимков «на всякий случай». Четыре ракурса одного предмета путают модель сильнее, чем помогают. Берите лучший.
Скриншот вместо фотографии. Пережатый скриншот из мессенджера теряет детали, и они не восстановятся.
Референс чужого стиля с узнаваемым автором. Модель может отказать, а результат — оказаться слишком похожим на оригинал. Лучше описывать приём словами: «плотный мазок, тёплая палитра», а не называть художника.
Ожидание, что модель «увидит» то, чего нет. Затылок не превратится в лицо, а размытый номер — в читаемый.
Где это уже настроено
В разделе «Тренды и задачи» у каждого рецепта входы подписаны и расставлены по порядку: примерить одежду, подобрать причёску, фото товара, общее фото. Остаётся загрузить снимки в нужные рамки.
Что дальше
Как формулировать саму просьбу — шесть частей запроса. Какая модель лучше держит исходник при правке — разбор моделей для правки фото.
Читайте также
- Нейросеть для видео: как выбрать модель и сколько стоит ролик — Четырнадцать видеомоделей в одной таблице: цена за секунду, длина ролика и тариф. Чем ролик по описанию отличается от ролика из вашего кадра и что брать под задачу.
- Параметры Midjourney по-русски: --ar, --s, --c, --sref и остальные — Midjourney хранит настройки прямо в тексте запроса. Разбираем каждый флаг: что делает, в каких пределах работает и когда его стоит трогать. Плюс почему один запуск даёт четыре кадра.
- Как восстановить и оживить старое фото нейросетью — Пересъёмка, чистка царапин, раскрашивание, увеличение и превращение снимка в короткий ролик. Порядок шагов, цена каждого и то, чего от нейросети ждать не стоит.