Чтобы сделать промпт по картинке, сначала опишите видимые объекты, их расположение, фон, цвет и свет. Затем решите, что сохранить в новом изображении, а что изменить. Попросите модель отделить наблюдения от предположений и проверьте ответ по исходнику. Так получится управляемое задание для генерации, а не длинный перечень красивых слов.

Ниже — пошаговый разбор учебного натюрморта с обложки и два шаблона: запрос для анализа референса и готовое описание новой сцены. Это поможет, если понравилась композиция чужого кадра, нужно объяснить визуальную идею дизайнеру или подготовить похожую по настроению иллюстрацию.

Что можно получить из изображения

Промпт по фото — это новая словесная интерпретация видимого. По пикселям нельзя надёжно восстановить исходный запрос, модель, seed или цепочку правок. У реальной фотографии генеративного промпта вообще могло не быть. Даже специальная функция Describe в Midjourney предназначена для идей и описаний, а не для точного копирования изображения.[1]

Выберите результат, прежде чем составлять запрос
ЗадачаПодход
Перенести настроение, свет и композициюРазобрать картинку и собрать новое текстовое описание.
Создать вариацию с опорой на исходникПередать изображение как референс, если выбранная модель и режим это поддерживают.
Сохранить конкретный объект и заменить фонИспользовать редактирование исходного изображения и проверять сохранность объекта.

Текст теряет часть визуальных деталей. Если важна конкретная форма предмета или узнаваемость человека, один подробный абзац не гарантирует сходства. В документации Midjourney референс также описан как источник влияния на новый результат; для точных изменений предлагается редактор.[2]

1. Подготовьте референс и цель

Перед загрузкой

  1. Выберите один кадр с читаемыми деталями. Уберите интерфейс, рамки и случайные элементы вокруг нужного изображения.
  2. Проверьте ориентацию и резкость. Если нужна отдельная деталь, подготовьте её крупный фрагмент и укажите, что это часть исходного кадра.
  3. Запишите цель одной фразой: например, сохранить расположение предметов и тёплый свет, но заменить груши яблоками.
  4. Определите обязательные признаки: количество объектов, положение главного предмета, свободное место под заголовок, формат кадра.

Мультимодальные модели умеют отвечать на вопросы об изображениях, но результат анализа стоит сверять вручную. Хорошо различимые детали и правильно ориентированный исходник уменьшают неоднозначность входных данных. Если надпись слишком мелкая, лучше сообщить её текст отдельно, чем просить модель догадаться.[3]

2. Попросите разобрать фото по наблюдаемым признакам

Не начинайте с просьбы «восстанови точный промпт». Сначала получите разбор. Укажите, что считать фактом, какой результат нужен и какие сведения запрещено додумывать. Особенно полезен такой порядок для сложной композиции с несколькими предметами.

Шаблон промпта
Разбери прикреплённое изображение для подготовки промпта генерации.
1. Перечисли только видимые объекты и их количество.
2. Опиши расположение: слева/справа, передний/задний план, масштаб объектов и свободное место.
3. Опиши фон, основные цвета, видимые текстуры, характер света и теней.
4. Отдельно перечисли неуверенные предположения. Не выдумывай марку камеры, объектив, точные настройки, материал или исходный промпт.
5. Составь короткий связный промпт для нового изображения. Сохранить: [что именно]. Изменить: [что именно].
Не добавляй предметы, которых нет в кадре, если я этого не попросил. Если деталь неразличима, так и напиши.

Как пройти этот шаг в Искре

Рабочий маршрут

  1. Откройте генератор текста и перейдите к работе в студии. Для анализа нужен диалог с моделью, которая принимает изображение.
  2. У выбранной модели найдите поле «Фото-референсы» и приложите файл. Если загрузка в текущем режиме недоступна, выберите подходящую модель или режим.
  3. Вставьте шаблон анализа и замените поля «Сохранить» и «Изменить» своей задачей. Перед отправкой проверьте прикреплённый файл и показанную стоимость.
  4. Сравните ответ с картинкой. Исправьте количество, расположение и цвета до перехода к генератору изображений.

Названия моделей и доступные настройки могут меняться. Наличие текстового диалога само по себе не подтверждает, что конкретная модель правильно разберёт любой референс. Этот маршрут опирается на доступную загрузку изображений в студии; сравнительный тест качества моделей здесь не проводился.

3. Пример: кувшин и две груши

Рассмотрим собственный учебный референс в начале статьи. На светлой поверхности стоит тёмно-бирюзовый кувшин с ручкой слева, справа — две жёлтые груши, передняя перекрывает часть задней. Фон персиковый. Ниже — редакционный разбор видимого изображения; это не сохранённый ответ нейросети.

От наблюдения к формулировке
Что видноЧто записать в промптЧто не выдавать за факт
Кувшин крупнее каждой груши; груши справаОдин крупный кувшин слева, две груши справа, одна перед другой.Точные размеры предметов в сантиметрах.
Светлая поверхность и персиковый фонСветлая столешница и спокойный персиковый фон.Конкретный материал стола или краска определённой марки.
Светлее слева, мягкие тени уходят вправоМягкое освещение слева, тени вправо.Тип осветителя, время суток или схема студии.
Есть мелкая фактура кувшина и кожицы грушСдержанная предметная фотография с видимой фактурой поверхностей.Модель камеры, фокусное расстояние или диафрагма.

Готовый промпт по этому референсу

Шаблон промпта
Горизонтальная предметная фотография: один крупный тёмно-бирюзовый кувшин с ручкой слева и две жёлтые груши справа на светлой столешнице. Передняя груша частично перекрывает заднюю. Все предметы целиком в кадре. Персиковый фон, мягкое освещение слева, спокойные тени вправо. Видимая мелкая фактура поверхностей, естественные цвета. Оставь свободное место над предметами. Без надписей и дополнительных объектов.

Это описание передаёт основные отношения в сцене. Оно не обещает повторить изгиб ручки, пятнышки на кожице или точное положение каждой тени. Такие признаки проверяют по результату отдельно, если они важны для задачи.

Как изменить сцену без противоречий

Допустим, нужна иллюстрация про яблоки. Замените фразу «две жёлтые груши» на «два зелёных яблока» во всём задании. Остальные условия оставьте прежними. Если хотите белый фон, удалите персиковый из описания, а не добавляйте противоположное требование в конце. Меняйте по одной группе признаков: объект, затем фон, затем свет.

4. Перенесите описание в генератор

Для нового кадра откройте генератор изображений, выберите модель и вставьте итоговый промпт. Размер и соотношение сторон задайте в доступных настройках. Не переносите автоматически служебные команды другой платформы: обычное описание сцены понятнее, а специальные параметры работают только там, где поддерживаются. Документация CometAPI также разделяет создание изображения и редактирование исходника и оговаривает настройки конкретных моделей.[4][5]

Если используете сам файл как референс, проверьте, что выбранный режим действительно принимает изображение. Опишите желаемый итог целиком: что должно быть в новой сцене. Если задача — точечная правка имеющегося кадра, перейдите в редактор изображений и укажите изменение вместе с тем, что нужно сохранить. Для такого случая есть отдельная инструкция о замене фона.

5. Проверьте результат и исправьте запрос

Сравнивайте с обязательными признаками

  • Количество: ровно один кувшин и две груши, без лишних предметов.
  • Композиция: кувшин слева, груши справа, нужное перекрытие и свободное место сверху.
  • Цвет и фон: бирюзовый, жёлтый и персиковый не заменены произвольно.
  • Свет и целостность: направление теней согласовано, ручка и края предметов не искажены.
  • Назначение: изображение подходит по формату и оставляет место для будущего текста.
Исправляйте причину расхождения
ПроблемаСледующая правка
Появилась третья грушаНачните описание с точного количества; удалите двусмысленные слова вроде «россыпь фруктов».
Композиция расползласьУточните один главный пространственный признак: кувшин слева, груши справа.
Кадр слишком декоративныйУберите конфликтующие стили и перечисления эффектов, оставьте предметную фотографию.
Нужно сохранить форму конкретного товараПроверьте режим редактирования или референс вместо дальнейшего удлинения текстового описания.

Сохраняйте исходную картинку, итоговый текст и настройки каждого удачного варианта. Если меняете всё одновременно, трудно понять, какая правка помогла. После нескольких попыток с одинаковым расхождением пересмотрите способ работы: возможно, вам требуется редактирование, а не создание нового кадра по словам.

Частые вопросы

Можно ли получить исходный промпт по фото?

Надёжно — нет. Можно составить описание, пригодное для новой генерации, но похожие изображения получаются из разных запросов. Даже наличие метаданных не означает, что в файле сохранена полная история создания.

Нужен ли английский язык?

Начните с языка, на котором точнее формулируете задачу. Если переводите запрос, проверьте количество предметов, отношения «перед» и «за», цвета и запреты. Универсального языка, гарантирующего лучший результат у всех моделей, нет.

Сколько деталей включать?

Оставьте признаки, по которым будете принимать результат. Для натюрморта это объекты, их расположение, фон, цвет и свет. Неразличимая микрофактура и выдуманные настройки камеры обычно только усложняют проверку. Хороший промпт по картинке позволяет объяснить, что именно получилось верно и что нужно исправить.

Источники 5Как мы готовим и обновляем материалы