Как писать промпты для изображений

Вторая страница раздела про картинки. На первой мы разобрали, как ИИ рисует. Здесь — как попросить его нарисовать именно то, что вы задумали. Промпт для картинки заметно отличается от запроса к чату: в чате вы ставите задачу, а здесь — описываете сцену, как режиссёр объясняет кадр художнику, который вас не видит и не умеет переспрашивать. Всё, что вы не описали, модель додумает за вас — и часто не так, как вы хотели.

Сразу держите в голове правило с прошлой страницы: разница между моделями важна меньше, чем качество вашего описания. Хорошо описанная сцена даже в простой модели обычно лучше небрежного промпта в топовой.

Главный принцип: вы — арт-директор

Модель не читает мыслей. Если вы напишете «красивый дом», она выберет «дом» наугад из миллионов вариантов. Ваша задача — сузить выбор: какой дом, где, в каком свете, в каком стиле, с какого ракурса. Чем точнее вы это опишете, тем ближе результат к картинке в вашей голове.

Думайте так: вы диктуете кадр человеку, который нарисует ровно то, что услышал — ни больше, ни меньше.


Анатомия промпта для изображения

Почти любой сильный промпт собирается из нескольких слоёв. Не всегда нужны все — но чем важнее результат, тем больше слоёв стоит задать.

  1. Субъект — кто или что в центре. «Рыжий кот».

  2. Действие / поза — что он делает. «сидит на подоконнике и смотрит в окно».

  3. Окружение / фон — где это происходит. «уютная кухня, за окном дождь».

  4. Стиль — фотография, иллюстрация, 3D, акварель, пиксель-арт и т.п. «стиль уютной детской иллюстрации».

  5. Освещение — едва ли не главный рычаг «красоты». «мягкий тёплый свет лампы».

  6. Композиция и ракурс — крупный план, общий план, вид сверху, сбоку. «крупный план, кот в фокусе, фон размыт».

  7. Настроение и цвет«спокойное, уютное, тёплая палитра».

  8. Соотношение сторон — квадрат, вертикаль для сторис, горизонталь для обложки.

Каркас, который можно копировать

[субъект] + [что делает] + [где, фон] +
[стиль] + [освещение] + [ракурс/композиция] +
[настроение/цвета] + [формат/соотношение сторон]

Пример по нему:

Рыжий кот сидит на подоконнике и смотрит на дождь, уютная кухня на фоне, стиль тёплой детской иллюстрации, мягкий свет настольной лампы, крупный план с размытым фоном, спокойное настроение, тёплая палитра, вертикальный формат.


От простого к детальному (наглядно)

Один и тот же кот — три промпта. Чем подробнее запрос, тем больше вы управляете результатом, а не полагаетесь на случай.

Промпт «кот» — модель сама выбирает породу, фон и свет:

Промпт: кот

Промпт «рыжий кот сидит на подоконнике» — задали цвет и место:

Промпт: рыжий кот на подоконнике

Промпт «рыжий пушистый кот на подоконнике в лучах заката, крупный план, боке, фотореализм» — теперь вы управляете породой, светом, ракурсом и настроением:

Промпт: подробное описание

Посмотрите, как один и тот же замысел растёт от «никак» до «то, что нужно»:

  • Слишком общо: кот → получите случайного кота непонятно где.

  • Лучше: рыжий кот на подоконнике → уже ближе, но стиль и свет — лотерея.

  • Хорошо: рыжий кот сидит на подоконнике, смотрит на дождь за окном, уютная кухня, мягкий тёплый свет, стиль детской иллюстрации, крупный план → предсказуемый, аккуратный результат.

Правило: каждый добавленный слой убирает «отсебятину» модели.


Как задавать стиль

Стиль — самый сильный способ изменить картинку одним движением. Описывайте его признаками, а не пытайтесь скопировать конкретного ныне живущего художника (это и надёжнее, и без проблем с авторскими правами):

  • По типу: «фотография», «3D-рендер», «акварель», «карандашный скетч», «плоская векторная иллюстрация», «киношный кадр».

  • По атмосфере: «минимализм», «ретро 80-х», «киберпанк», «сказочный».

  • По «камере» (для фото-реализма): «снято на 50мм, малая глубина резкости», «широкоугольный кадр», «студийный свет».

Совет: смешивайте 2–3 стилевых признака, а не десять — иначе модель «перегружается» и выдаёт кашу.


Текст внутри картинки

Это всё ещё самое сложное для генераторов, поэтому есть два правила:

  1. Точный текст пишите в кавычках: вывеска с надписью "Кофейня Уют".

  2. Держите текст коротким — длинные абзацы внутри картинки модель искажает.

И выбирайте модель под задачу: в GEMERA с текстом лучше всего справляются GPT Image 2 (по описанию — лучше всех рендерит текст и точнее понимает запрос), NanoBanano Pro (точнее рендер текста, чем у базовой) и Qwen Image 2 (хорошо справляется с текстом и контекстом).


Редактирование и итерация

Первый результат — это черновик. Сила в доработке:

  • Правьте словами: «сделай светлее», «убери предмет на фоне», «поменяй платье на синее».

  • Дайте референс — загрузите картинку-образец как ориентир по стилю или композиции.

  • Сохраняйте героя — если нужен один и тот же персонаж на серии картинок, прямо просите об этом.

Для генерации и правок «в разговоре» по описаниям в GEMERA хорошо подходят NanoBanano (универсал для большинства генераций и редактирования) и GPT Image 2 (точнее понимает контекст). Для подгрузки реальных деталей и актуальной информации — NanoBanano 2 (умеет веб-поиск).


Какую модель GEMERA выбрать под задачу

В меню GEMERA несколько моделей, и у каждой своя сильная сторона (и своя стоимость в кредитах — мощные и PRO-модели дороже). Подбирайте под задачу, чтобы не переплачивать.

Задача

Модель в GEMERA

Большинство картинок, генерация + редактирование

NanoBanano (база, недорого)

Максимальное качество и точный текст

NanoBanano Pro (PRO)

Свежая версия, веб-поиск под актуальные детали, отличное качество

NanoBanano 2

Текст на изображении, точное следование запросу

GPT Image 2 (генерация дольше)

Фотореализм и выразительные художественные стили

Krea 2 Large (PRO); Krea 2 Medium — быстрее и дешевле

Быстрый набросок идеи

Grok Imagine; Grok Imagine HQ (PRO) — качество получше

Очень быстро, за 3–4 секунды (черновик)

Z-Turbo (качество ниже)

Текст и контекст

Qwen Image 2

Референс для картинок (и сильна в видео)

SeedReam 4.5

Новейшая утилитарная модель Recraft

Recraft Utility Pro (PRO)

Практический подход: черновики и поиск идеи гоняйте на быстрых и дешёвых (Z-Turbo, Grok Imagine), а на финальную картинку переключайтесь на качественную (NanoBanano 2 / Pro, GPT Image 2, Krea 2 Large). Так вы экономите кредиты и время.


Частые ошибки

  • Слишком общий промпт — «красиво» и «круто» модель не понимает, ей нужны конкретные признаки.

  • Перегруз деталями — двадцать прилагательных сразу превращаются в кашу. Лучше несколько точных, чем гора случайных.

  • Длинный текст в картинке — почти гарантированные искажения букв.

  • Не та модель — пытаться сделать текстовый постер на модели «для быстрого наброска».

  • Сдаться после первой генерации — почти всё доводится до ума парой правок.


Чек-лист перед генерацией

  • Назвал главный субъект и что он делает?

  • Описал фон/окружение?

  • Указал стиль (2–3 признака, не больше)?

  • Задал свет, ракурс, настроение?

  • Выбрал соотношение сторон?

  • Если нужен текст — он в кавычках и короткий, и я выбрал модель, сильную в тексте?

  • Выбрал модель под задачу (черновик — дешёвую, финал — качественную)?


Что дальше

Следующая страница раздела — про редактирование изображений подробнее: ретушь, замена фона, расширение кадра, сохранение персонажа на серии картинок. А этот навык — описывать сцену слоями и подбирать модель под задачу — пригодится для всего остального. Лучший способ научиться — сгенерировать первую картинку прямо сейчас и поправить её парой фраз.


Читайте также: Prompt Lab · Какую модель выбрать · Редактирование изображений