
Промпт «нарисуй открытку» даёт открытку с днём рождения, хотя дня рождения нет, с собакой, хотя нужен кот, и с надписью, которую вы не заказывали. Нейросеть не читает мысли — она делает ровно то, что смогла понять.
Тот же запрос, но по-человечески сформулированный:
«Квадратная открытка 1:1 для бабушки, без повода: рыжий кот лежит на подоконнике рядом с чашкой чая и букетом ромашек. Настроение тёплое и домашнее, мягкая рисованная иллюстрация, свет из окна, светлый фон. Вверху короткая надпись: «Бабуля, обнимаю!». Без собак, без торта, без воздушных шаров».

Разберу, из чего складывается рабочий промпт, дам заготовки под частые задачи и покажу шесть промахов, из-за которых картинка получается не той. Все иллюстрации в этой статье сгенерированы по промптам, которые тут же и приведены, — можете сравнить текст с результатом.
Какие модели брать сейчас
Для большинства бытовых и рабочих задач хватает двух: GPT Image 2 и Nano Banana. Открытки, портреты, обложки, предметные кадры, интерьеры, правки готовых картинок — всё это они делают предсказуемо.
GPT Image 2 работает в приложении ChatGPT по обычной подписке, Nano Banana — в Gemini по подписке Gemini. Отдельно за модели платить не нужно, они входят даже в недорогие тарифы. Если подписки нет, обе доступны через агрегаторы — их список есть в подборке ИИ-сервисов.
Но модель не заменяет промпт. Сильная модель просто аккуратнее выполнит то, что вы написали, — и так же уверенно додумает то, что вы не написали.
Формула промпта для генерации картинок
Хороший промпт не обязан быть длинным. Он должен убрать главную неопределённость.
Минимальная формула такая: что сделать + что в кадре + где это происходит + как выглядит + какой формат + чего быть не должно.

Разберу на примере:
«Квадратная картинка 1:1: уютное кресло у большого окна, на кресле мягкий плед, рядом маленький столик с чашкой чая и раскрытой книгой. За окном вечерний дождь и мягкие огни города. Стиль: тёплая рисованная иллюстрация, спокойные цвета, мягкий свет от настольной лампы. Без людей, без текста и логотипов».

Здесь задано: формат — квадрат; главный объект — кресло, плед, столик, чай, книга; место — комната у окна; стиль — тёплая рисованная иллюстрация; свет — настольная лампа; ограничения — без людей, текста и логотипов.
Уберите половину — и модель начнёт решать сама. Добавит людей, сделает фотографию вместо рисунка, поставит в кадр лишнее.
И сразу про язык: промпты можно писать по-русски. Несколько лет назад генераторы понимали английский заметно лучше, отсюда и привычка. Современные модели с русским работают нормально, так что не мучайтесь.
Заготовки под частые задачи
Стилизованная иллюстрация
Если нужна не фотография, а рисунок, назовите жанр прямо: акварель, 3D-рендер, редакционный коллаж, комикс, плакатная иллюстрация, векторная графика. Без этого модель по умолчанию тянет в фотореализм.
«Квадратная иллюстрация 1:1: маленький дракончик сидит в большом кресле и читает книгу, рядом чашка какао и стопка старых книг, за окном звёздная ночь. Стиль: плакатная иллюстрация с крупными формами, лёгкой зернистой фактурой и ограниченной палитрой — тёмно-синий, кремовый, оранжевый. Без текста».

Нужна другая подача — меняйте только строку стиля, остальное оставляйте:
- «мягкая акварель на фактурной бумаге, спокойные тёплые цвета, лёгкие полупрозрачные тени»;
- «глянцевый 3D-рендер, объёмные формы, чистый фон, мягкие студийные тени»;
- «редакционный коллаж из бумажных вырезок, крупные формы, заметная бумажная фактура».
Реалистичный портрет
Для вымышленного человека опишите обычный кадр: возраст, внешность, выражение, одежду, фон, свет и крупность.
«Реалистичный портрет мужчины около 40 лет для профессионального профиля: короткая тёмная стрижка, спокойная лёгкая улыбка, взгляд в камеру, тёмно-серый пиджак и белая футболка. Фон простой серый, мягкий студийный свет спереди и немного слева, кадр по грудь. Без надписей и логотипов».
Если нужно сходство с реальным человеком, текстового описания мало — понадобятся фотографии и другой порядок работы. Это отдельная история, я разбирал её в статье про ИИ-портрет.
Открытка
Укажите повод, адресата, главный объект, настроение, формат и короткую надпись. Длинное поздравление лучше добавить потом в редакторе — на картинке оно почти наверняка получится кривым.
«Квадратная открытка 1:1 для коллеги, который уходит в отпуск: чемодан с наклейками стоит на пляже рядом с коктейлем и солнцезащитными очками, на заднем плане море и мягкий закатный свет. Стиль: лёгкая рисованная иллюстрация, тёплые цвета, весёлое настроение. Крупная надпись сверху: «Хорошего отпуска!»».

Если надпись всё-таки вышла кривой, не пытайтесь чинить её объяснениями. Проще попросить картинку без текста и оставить чистое место сверху.
Обложка статьи или поста
Здесь важно заранее решить, где останется место под текст. Иначе модель займёт объектами весь кадр, и заголовок ставить будет некуда.
«Горизонтальная обложка 16:9 для статьи о выборе кофемашины: справа компактная кофемашина, чашка эспрессо и несколько зёрен на светлой кухонной столешнице. Слева оставь чистое светлое место под заголовок. Стиль: современная рисованная редакционная иллюстрация, спокойная палитра. Без готового текста».

Для квадратного поста меняется только первая фраза, для вертикальных историй — формат и расположение: главный объект вверху, внизу чистое место под подпись.
Карточка товара
Не просите придумать товар с нуля. Сфотографируйте банку, упаковку или коробку на нейтральном фоне и загрузите фото — тогда модель увидит форму, цвет, пропорции и надписи на самом товаре.
Дальше в промпте прямо скажите: сохранить форму, цвет и надписи с фотографии, но собрать вокруг нормальный кадр для магазина. Поставить на чистую поверхность, добавить мягкий свет, тень и пару уместных предметов рядом.
Интерьер
«Уютная кухня» — не описание. Модель должна понять, что ближе к камере, что на фоне, из чего сделана сцена и откуда идёт свет.
«Реалистичная интерьерная сцена: маленькая светлая кухня утром, деревянный стол на переднем плане, на столе чашка кофе и льняная салфетка. За столом окно с мягким тёплым светом, на заднем плане открытые полки с белой посудой и растениями. Камера на уровне стола. Без людей и текста».

Свет и ракурс: два слова, которые меняют всё
Если из шести блоков формулы что-то и стоит прописывать особенно тщательно, то это свет и положение камеры. Они влияют на результат сильнее, чем описание самого объекта.
Свет задаёт настроение: «мягкий утренний свет из окна слева» и «жёсткий контрастный свет сверху» дают два совершенно разных кадра с одинаковыми предметами. Полезные формулировки: откуда идёт свет, какой он по жёсткости, какого оттенка.
Ракурс задаёт отношение к объекту. «Камера на уровне глаз» — нейтрально. «Сверху под углом» — обзорно, хорошо для предметных сцен. «Снизу» — объект выглядит крупнее и внушительнее. Без указания модель почти всегда берёт нейтральную высоту, и кадр выходит скучным.
Добавить эти два уточнения — одна строчка в промпте, а разница между «сгенерировалось» и «выглядит нормально» часто ровно в них.
Текст на картинке: отдельная больная тема
Половина неудачных генераций — из-за надписей. Разберу подробно, потому что здесь есть работающие приёмы.
Пишите надпись в кавычках и отдельной строкой. Не «добавь поздравление», а «надпись: «Хорошего отпуска!»». Модель должна видеть точный текст, а не задачу его придумать.
Держитесь в пределах трёх-четырёх слов. Короткая фраза набирается правильно почти всегда. С каждым лишним словом растёт шанс получить букву не оттуда или лишний символ в середине.
Указывайте, что другого текста быть не должно. Модели любят дописывать мелкие надписи на фоне: вывески, обложки книг, подписи под предметами. Строчка «никакого другого текста на изображении» это убирает.
Кириллица работает. Раньше русские надписи выходили нечитаемыми, и это породило устойчивое убеждение, что текст надо просить только по-английски. Сейчас современные модели набирают кириллицу нормально — если фраза короткая и написана явно.
Если не получилось с двух попыток — не мучайте. Просите картинку без текста с чистым местом под надпись и добавляйте её в любом редакторе. Это займёт минуту вместо десяти перегенераций.
Отдельно про длинные тексты: меню, таблицы, списки, скриншоты интерфейсов. Такое стабильно не получается ни у одной модели. Не тратьте время — это задача для редактора, а не для генератора.
Схема или диаграмма
Отдельный случай, который часто нужен и редко получается с наскока. Схему нельзя просить абстрактно — надо описать геометрию.
«Горизонтальная схема 3:2: слева прямоугольник, от него вправо расходятся три стрелки к трём прямоугольникам поменьше. Верхняя стрелка заметно толще двух остальных. Подписи на изображении — только эти, кириллицей, крупно: «Запрос», «Вариант А», «Вариант Б», «Вариант В». Никакого другого текста. Стиль: чистая плоская графика, светлый фон, две краски».
Работает здесь три вещи. Названо расположение элементов, а не смысл схемы. Перечислены точные подписи в кавычках. И явно запрещён любой другой текст — иначе модель дорисует поясняющие надписи от себя.
Чего просить не стоит: схем с точными числами, графиков по реальным данным и всего, где важна пропорция величин. Это модель придумает.
Как превратить идею в промпт
Обычно всё начинается с короткой фразы вроде «картинка с мотоциклом для поста». Прежде чем писать промпт, ответьте себе на несколько вопросов.
- где будет использоваться картинка;
- какой нужен формат;
- какой именно объект в кадре;
- где он находится;
- есть ли люди;
- нужен ли текст;
- какой стиль — фото, иллюстрация, 3D;
- чего точно быть не должно.
После ответов получается вот это:
«Квадратная картинка 1:1 для поста о первой поездке на мотоцикле: чёрный дорожный мотоцикл стоит на пустой городской улице ранним утром, мокрый асфальт отражает тёплый свет фонарей, на заднем плане размытые витрины кафе. Камера на уровне руля. Стиль: реалистичное фото, спокойная палитра. Без людей и текста».

Пусть промпт соберёт нейросеть
Если идея есть, а промпт не складывается, попросите текстовую модель собрать его. Только не «сделай красивее», а именно уточнить задачу и вернуть готовое задание:
«Помоги составить промпт для генерации картинки.
Я напишу идею обычными словами. Преврати её в одно цельное визуальное задание: тип картинки, главный объект, действие, окружение, стиль, свет, ракурс, формат, текст на картинке и ограничения.
Если данных не хватает — задай уточняющие вопросы. Если хватает — верни один готовый промпт без пояснений, списков и вариантов.
Моя идея: [вставьте идею]».
Последняя строчка про «без пояснений и вариантов» важнее, чем кажется. Без неё вы получите три варианта с разбором, из которых придётся собирать четвёртый.
Проверка перед генерацией
Семь вопросов, которые ловят почти все промахи: понятно ли, что главное в кадре; указан ли формат; есть ли место действия; не конфликтуют ли стили; не слишком ли длинный текст на картинке; понятно ли, что брать из референса; написано ли, чего быть не должно.
Соберите свой шаблон
Заготовки выше — не догма, а образцы структуры. Полезнее собрать собственный шаблон под ту задачу, которая у вас повторяется чаще всего.
Делается это просто: берёте промпт, который однажды сработал хорошо, и помечаете в нём места, которые меняются от раза к разу. Обычно это главный объект, место действия и надпись. Всё остальное — формат, стиль, свет, ограничения — остаётся неизменным.
Через несколько итераций у вас получится заготовка, где нужно подставить два-три слова. Генерация новой картинки после этого занимает полминуты, а результат предсказуем.
Шесть частых промахов
1. Не указан формат. Модель выберет сама, и обычно не тот, который нужен. Формат — первое, что стоит писать.
2. Стили конфликтуют. «Реалистичное фото в стиле акварели» — противоречие, и модель решит его как захочет. Один кадр — одна манера.
3. Нет ограничений. Строчка «без людей, без текста, без логотипов» экономит больше перегенераций, чем любые уточнения по объекту.
4. Длинная надпись на картинке. Три-четыре слова модель наберёт правильно. Целое предложение почти наверняка выйдет с ошибками в буквах.
5. Эпитеты вместо описания. «Красиво», «стильно», «атмосферно» не значат ничего. Вместо них — свет, палитра, ракурс, материал.
6. Десять правок вместо переписывания. Самый дорогой промах по времени. Если не совпали идея, стиль и композиция — проще переписать промпт заново.
Форматы: что под что
Формат стоит первым в промпте не случайно — от него зависит вся композиция, и переделать его потом сложнее, чем кажется.
Квадрат 1:1 — посты в соцсетях, аватарки, открытки, карточки товара. Самый универсальный: если не знаете, что выбрать, берите его.
Горизонталь 16:9 — обложки статей, превью видео, заставки. Здесь почти всегда нужно место под заголовок, и просить его надо явно.
Вертикаль 9:16 — истории, короткие видео, экраны телефона. Главный объект стоит поднимать в верхнюю половину: низ обычно перекрывается интерфейсом.
Вертикаль 3:4 и 4:5 — портреты и товарные фото в лентах. Удобнее квадрата, когда объект вытянутый.
Частая ошибка — сгенерировать в одном формате и потом обрезать в другой. Обрезка съедает композицию: то, что задумывалось по центру, уезжает к краю. Проще перегенерировать с нужным форматом сразу, тем более что промпт уже написан.
И маленькая подсказка про соотношения: если сервис принимает формат числами, пишите именно их, а не слова. «Квадратная» модель поймёт, но «1:1» она поймёт точнее.
Сколько попыток — это нормально
Вопрос, который редко проговаривают, а он мешает больше всего: люди считают, что с первого раза должно получиться, и расстраиваются.
Нормальный расклад такой. Простая картинка по хорошему промпту — одна-две попытки. Кадр со сложной композицией или несколькими объектами — три-четыре. Картинка с текстом — две попытки на сам кадр плюс, скорее всего, добавление надписи в редакторе.
Если ушло больше пяти попыток и результат не приблизился — дело не в удаче, а в промпте. Остановитесь и перечитайте его: почти наверняка там либо конфликтующие требования, либо не хватает одного из шести блоков формулы.
И ещё: генерируйте по несколько вариантов одного промпта сразу, если сервис это позволяет. Модель каждый раз интерпретирует описание чуть по-разному, и выбрать лучший из четырёх дешевле, чем доводить единственный.
Если картинка получилась не такой
Правило простое: одна деталь не устроила — редактируйте готовую картинку. Не совпали идея, стиль, формат или главный объект — меняйте промпт и генерируйте заново.
Для мелких правок в чате с картинкой хватает обычной фразы:
- «оставь картинку такой же, но убери случайный текст на фоне»;
- «сохрани композицию и стиль, но сделай формат вертикальным 9:16»;
- «оставь человека, одежду и свет без изменений, замени фон на светлую студию»;
- «сделай картинку без текста, оставь чистое место справа под заголовок».
Обратите внимание на конструкцию: сначала что сохранить, потом что поменять. Без первой части модель охотно переделывает и то, что вас устраивало.
Чем промпт для картинки отличается от промпта для текста
Привычка, выработанная в переписке с чат-ботами, здесь мешает, и об этом стоит сказать отдельно.
В текстовом чате нормально написать половину задачи и уточнить по ходу разговора. Модель переспросит, вы ответите, вместе дойдёте до результата. Генератор картинок так не работает: он не задаёт вопросов и не ведёт диалог. Он получает описание и рисует, что понял.
Отсюда второе отличие: промпт для картинки — это не просьба, а техническое задание. «Хочу что-нибудь уютное» в текстовом чате начнёт разговор. В генераторе это просто мало данных, и недостающее модель придумает молча.
И третье: порядок слов имеет значение. То, что стоит в начале промпта, влияет на результат сильнее. Поэтому формат и главный объект идут первыми, а второстепенные детали — в конце.
Практический вывод простой: перед генерацией дописывайте промпт до конца, а не рассчитывайте доуточнить в следующем сообщении. Уточнение работает при правке готовой картинки, но не при создании новой.
Как получить промпт из чужой картинки
Нашли в интернете картинку и хотите похожую — не угадывайте промпт. Загрузите её в модель, которая понимает изображения, и попросите описать:
«Опиши эту картинку как промпт для генерации похожего изображения. Сохрани композицию, главный объект, фон, свет, стиль, палитру и настроение. Верни один цельный промпт без пояснений».
Полученный текст вставляете в генератор — и дальше правите: меняете объект, цвет, фон, формат.
Отдельный приём — вытащить только манеру, без сюжета. Полезно, когда нравится не сама картинка, а её подача:
«Опиши только визуальный стиль этой картинки: палитру, фактуру, свет, тип иллюстрации, настроение и композиционный приём. Не пересказывай сюжет и не описывай конкретные объекты. Верни короткий блок «Стиль: …», который можно вставлять в другие промпты».
Такой блок потом подставляется в любые промпты, и серия картинок выходит в одной манере. Я так собираю иллюстрации к статьям: сюжет свой в каждой, а строка стиля общая.
Ещё один частый вопрос — что делать, если правка ломает то, что было хорошо. Это нормальное поведение: модель пересобирает картинку заново, а не редактирует пиксели. Поэтому перед серьёзной правкой сохраняйте предыдущий вариант — вернуться к нему потом будет нечем.
Как сделать серию картинок в одной манере
Задача возникает почти сразу: нужна не одна картинка, а десять — для статьи, для канала, для карточек товара. И если каждую генерировать отдельно, они выйдут разными по подаче.
Лечится это разделением промпта на две части. Первая — сюжет, он свой у каждой картинки. Вторая — блок стиля, он общий и копируется без изменений.
Блок стиля должен описывать материал, палитру и фактуру, но не объекты. Например: «плоская векторная иллюстрация без градиентов, тёплый почти белый фон, графитовые формы, один фиолетовый акцент, лёгкая бумажная зернистость».
Дальше вы пишете десять разных сюжетов и к каждому приклеиваете один и тот же блок. Картинки получатся разными по содержанию и одинаковыми по подаче — именно то, что нужно для серии.
Пара тонкостей. Блок стиля лучше ставить после описания сюжета, а не до: так модель сначала понимает, что рисовать, и только потом — как. И держите его коротким, три-четыре предложения: длинный блок начинает конкурировать с сюжетом за внимание.
Если серия нужна регулярно, сохраните блок в заметки. У меня таких заготовок несколько штук под разные типы материалов, и новая картинка обходится в одну строку сюжета.
Как работать с референсами
Референс — картинка, которую прикладывают к промпту. Модель может взять из неё объект, позу, лицо, стиль, свет или композицию. Чтобы она не запуталась, скажите прямо, что именно брать.
Один референс используют, когда нужно перенести конкретный предмет в новую сцену. Есть фото кресла — хотите поставить это же кресло в другую комнату. В промпте перечисляете, что сохранить: форму, цвет ткани, ножки, пропорции. И описываете новую сцену.
Несколько референсов подписывают буквами: «из картинки A возьми женщину и её позу, из картинки B — сумку, из картинки C — мотоцикл и угол съёмки». Без подписей модель смешает всё в произвольных пропорциях.
Два человека с разных фото — самый капризный случай. Обязательно уточняйте, кто где стоит и кто на кого смотрит, иначе получите двух людей, глядящих в разные стороны, с разным светом на лицах.
Редактирование готовой картинки
Четыре операции покрывают почти всё.
Заменить фон. «Оставь человека, одежду, позу и свет на лице без изменений. Замени фон на светлую студию с мягким серым градиентом».
Добавить объект. «Добавь на стол рядом с ноутбуком белую чашку кофе с лёгким паром. Остальное не меняй». Обязательно скажите, где именно, — иначе объект встанет в случайное место.
Убрать лишнее. «Убери чашку со стола, восстанови поверхность стола на её месте». Вторая часть нужна: без неё модель иногда оставляет след.
Поменять деталь. «Замени цвет куртки на тёмно-зелёный. Крой, фактуру ткани, позу и фон оставь прежними».

Общий принцип виден: сначала перечисляете, что должно остаться без изменений, потом называете одну правку. Список из трёх правок в одном сообщении выполняется наполовину.
Отдельно про референсы для стиля: приложенная картинка почти всегда работает лучше, чем описание манеры словами. Если у вас есть образец нужной подачи, показывайте его, а не пытайтесь пересказать.
Что модели до сих пор делают плохо
Чтобы не биться в стену, полезно знать границы. Ни один промпт их не обойдёт.
Точное количество. «Пять яблок» может превратиться в четыре или семь. Модель плохо считает предметы в кадре, и уточнения помогают слабо. Если число принципиально, проверяйте глазами каждый раз.
Руки и пальцы. Стало заметно лучше, но остаётся самым слабым местом. Кадр, где руки на переднем плане и крупно, — риск. Если можно обойтись без них, обойдитесь.
Мелкий текст и таблицы. Уже говорил, но повторю: длинные надписи, списки, интерфейсы не получаются. Это ограничение самой технологии, а не вопрос формулировки.
Точная геометрия и схемы. Чертёж с размерами, график с реальными данными, план помещения — не сюда. Получится похожее на схему изображение, но цифры и пропорции будут выдуманными.
Повторение одного персонажа. Сделать одного и того же героя в пяти разных сценах без референса не выйдет. Лицо будет плавать. Решается только приложенными фотографиями и отдельным порядком работы.
Логотипы и фирменные знаки. Модель нарисует что-то похожее на логотип, но это будет её выдумка. Свой логотип накладывайте в редакторе.
Как хранить свои промпты
Через месяц работы у вас накопится десяток удачных промптов, и половина забудется. Хранить их стоит с самого начала, и не в переписке.
Мне удобнее всего простой текстовый файл, разбитый по типам задач: обложки, портреты, предметные кадры. К каждому промпту — короткая пометка, для чего он и что в нём стоит менять.
Отдельно храните блоки стиля: они переиспользуются чаще всего. И отдельно — формулировки ограничений, тот самый список «без людей, без текста, без логотипов», который вы будете подставлять почти везде.
Полезная привычка: когда промпт сработал хорошо, сразу пометьте, чем именно. «Хорошо взял свет», «правильно оставил место под заголовок». Через месяц вы не вспомните, что в этом промпте было удачного, а пометка вернёт вас к сути за секунду.
И держите отдельный список неудач: промпт, который дал не то, и чем именно не то. Такой список полезнее удачных примеров — по нему быстро видно, какие формулировки модель понимает не так, как вы ожидали.
Где брать идеи
Готовые промпты с примерами результата лежат в открытых галереях — Lexica, PromptHero, раздел с работами сообщества у Midjourney. Там удобно смотреть не столько сюжеты, сколько формулировки: как люди описывают свет, ракурс и манеру.
Но копировать чужой промпт целиком смысла мало — он собран под другую задачу. Полезнее вытаскивать оттуда куски: удачное описание освещения, формулировку стиля, способ задать композицию.
И главное, что стоит запомнить про промпты для картинок: длина сама по себе ничего не даёт. Работает не количество слов, а количество принятых за модель решений. Каждое, которое вы не приняли, она примет сама — и почти всегда не так, как вы себе представляли.
