Как писать промпты для изображений
Вторая страница раздела про картинки. На первой мы разобрали, как ИИ рисует. Здесь — как попросить его нарисовать именно то, что вы задумали. Промпт для картинки заметно отличается от запроса к чату: в чате вы ставите задачу, а здесь — описываете сцену, как режиссёр объясняет кадр художнику, который вас не видит и не умеет переспрашивать. Всё, что вы не описали, модель додумает за вас — и часто не так, как вы хотели.
Сразу держите в голове правило с прошлой страницы: разница между моделями важна меньше, чем качество вашего описания. Хорошо описанная сцена даже в простой модели обычно лучше небрежного промпта в топовой.
Главный принцип: вы — арт-директор
Модель не читает мыслей. Если вы напишете «красивый дом», она выберет «дом» наугад из миллионов вариантов. Ваша задача — сузить выбор: какой дом, где, в каком свете, в каком стиле, с какого ракурса. Чем точнее вы это опишете, тем ближе результат к картинке в вашей голове.
Думайте так: вы диктуете кадр человеку, который нарисует ровно то, что услышал — ни больше, ни меньше.
Анатомия промпта для изображения
Почти любой сильный промпт собирается из нескольких слоёв. Не всегда нужны все — но чем важнее результат, тем больше слоёв стоит задать.
Субъект — кто или что в центре. «Рыжий кот».
Действие / поза — что он делает. «сидит на подоконнике и смотрит в окно».
Окружение / фон — где это происходит. «уютная кухня, за окном дождь».
Стиль — фотография, иллюстрация, 3D, акварель, пиксель-арт и т.п. «стиль уютной детской иллюстрации».
Освещение — едва ли не главный рычаг «красоты». «мягкий тёплый свет лампы».
Композиция и ракурс — крупный план, общий план, вид сверху, сбоку. «крупный план, кот в фокусе, фон размыт».
Настроение и цвет — «спокойное, уютное, тёплая палитра».
Соотношение сторон — квадрат, вертикаль для сторис, горизонталь для обложки.
Каркас, который можно копировать
[субъект] + [что делает] + [где, фон] +
[стиль] + [освещение] + [ракурс/композиция] +
[настроение/цвета] + [формат/соотношение сторон]Пример по нему:
Рыжий кот сидит на подоконнике и смотрит на дождь, уютная кухня на фоне, стиль тёплой детской иллюстрации, мягкий свет настольной лампы, крупный план с размытым фоном, спокойное настроение, тёплая палитра, вертикальный формат.
От простого к детальному (наглядно)
Один и тот же кот — три промпта. Чем подробнее запрос, тем больше вы управляете результатом, а не полагаетесь на случай.
Промпт «кот» — модель сама выбирает породу, фон и свет:
Промпт «рыжий кот сидит на подоконнике» — задали цвет и место:
Промпт «рыжий пушистый кот на подоконнике в лучах заката, крупный план, боке, фотореализм» — теперь вы управляете породой, светом, ракурсом и настроением:

Посмотрите, как один и тот же замысел растёт от «никак» до «то, что нужно»:
Слишком общо:
кот→ получите случайного кота непонятно где.Лучше:
рыжий кот на подоконнике→ уже ближе, но стиль и свет — лотерея.Хорошо:
рыжий кот сидит на подоконнике, смотрит на дождь за окном, уютная кухня, мягкий тёплый свет, стиль детской иллюстрации, крупный план→ предсказуемый, аккуратный результат.
Правило: каждый добавленный слой убирает «отсебятину» модели.
Как задавать стиль
Стиль — самый сильный способ изменить картинку одним движением. Описывайте его признаками, а не пытайтесь скопировать конкретного ныне живущего художника (это и надёжнее, и без проблем с авторскими правами):
По типу: «фотография», «3D-рендер», «акварель», «карандашный скетч», «плоская векторная иллюстрация», «киношный кадр».
По атмосфере: «минимализм», «ретро 80-х», «киберпанк», «сказочный».
По «камере» (для фото-реализма): «снято на 50мм, малая глубина резкости», «широкоугольный кадр», «студийный свет».
Совет: смешивайте 2–3 стилевых признака, а не десять — иначе модель «перегружается» и выдаёт кашу.
Текст внутри картинки
Это всё ещё самое сложное для генераторов, поэтому есть два правила:
Точный текст пишите в кавычках:
вывеска с надписью "Кофейня Уют".Держите текст коротким — длинные абзацы внутри картинки модель искажает.
И выбирайте модель под задачу: в GEMERA с текстом лучше всего справляются GPT Image 2 (по описанию — лучше всех рендерит текст и точнее понимает запрос), NanoBanano Pro (точнее рендер текста, чем у базовой) и Qwen Image 2 (хорошо справляется с текстом и контекстом).
Редактирование и итерация
Первый результат — это черновик. Сила в доработке:
Правьте словами: «сделай светлее», «убери предмет на фоне», «поменяй платье на синее».
Дайте референс — загрузите картинку-образец как ориентир по стилю или композиции.
Сохраняйте героя — если нужен один и тот же персонаж на серии картинок, прямо просите об этом.
Для генерации и правок «в разговоре» по описаниям в GEMERA хорошо подходят NanoBanano (универсал для большинства генераций и редактирования) и GPT Image 2 (точнее понимает контекст). Для подгрузки реальных деталей и актуальной информации — NanoBanano 2 (умеет веб-поиск).
Какую модель GEMERA выбрать под задачу
В меню GEMERA несколько моделей, и у каждой своя сильная сторона (и своя стоимость в кредитах — мощные и PRO-модели дороже). Подбирайте под задачу, чтобы не переплачивать.
Задача | Модель в GEMERA |
|---|---|
Большинство картинок, генерация + редактирование | NanoBanano (база, недорого) |
Максимальное качество и точный текст | NanoBanano Pro (PRO) |
Свежая версия, веб-поиск под актуальные детали, отличное качество | NanoBanano 2 |
Текст на изображении, точное следование запросу | GPT Image 2 (генерация дольше) |
Фотореализм и выразительные художественные стили | Krea 2 Large (PRO); Krea 2 Medium — быстрее и дешевле |
Быстрый набросок идеи | Grok Imagine; Grok Imagine HQ (PRO) — качество получше |
Очень быстро, за 3–4 секунды (черновик) | Z-Turbo (качество ниже) |
Текст и контекст | Qwen Image 2 |
Референс для картинок (и сильна в видео) | SeedReam 4.5 |
Новейшая утилитарная модель Recraft | Recraft Utility Pro (PRO) |
Практический подход: черновики и поиск идеи гоняйте на быстрых и дешёвых (Z-Turbo, Grok Imagine), а на финальную картинку переключайтесь на качественную (NanoBanano 2 / Pro, GPT Image 2, Krea 2 Large). Так вы экономите кредиты и время.
Частые ошибки
Слишком общий промпт — «красиво» и «круто» модель не понимает, ей нужны конкретные признаки.
Перегруз деталями — двадцать прилагательных сразу превращаются в кашу. Лучше несколько точных, чем гора случайных.
Длинный текст в картинке — почти гарантированные искажения букв.
Не та модель — пытаться сделать текстовый постер на модели «для быстрого наброска».
Сдаться после первой генерации — почти всё доводится до ума парой правок.
Чек-лист перед генерацией
Назвал главный субъект и что он делает?
Описал фон/окружение?
Указал стиль (2–3 признака, не больше)?
Задал свет, ракурс, настроение?
Выбрал соотношение сторон?
Если нужен текст — он в кавычках и короткий, и я выбрал модель, сильную в тексте?
Выбрал модель под задачу (черновик — дешёвую, финал — качественную)?
Что дальше
Следующая страница раздела — про редактирование изображений подробнее: ретушь, замена фона, расширение кадра, сохранение персонажа на серии картинок. А этот навык — описывать сцену слоями и подбирать модель под задачу — пригодится для всего остального. Лучший способ научиться — сгенерировать первую картинку прямо сейчас и поправить её парой фраз.
Читайте также: Prompt Lab · Какую модель выбрать · Редактирование изображений