Блог гайд

Промт для генерации картинки

Промт для картинки — текстовое описание сцены, по которому нейросеть генерирует изображение. В отличие от текстовых промтов, здесь важен визуальный язык: художники, фото-термины, параметры камеры, тип освещения. Чем точнее визуальный словарь — тем ближе результат к замыслу.

Ведущие модели 2026: Midjourney 6.1, DALL-E / GPT Image, Flux, Nano Banana (Google), Шедеврум (Яндекс), Kandinsky 6.0 (Сбер), Recraft, Ideogram, Leonardo AI.

Структура промта для картинки

Универсальная формула для Midjourney, Flux, DALL-E, Nano Banana и большинства моделей с en-промтом:

[subject] + [style] + [setting] + [camera] + [lighting] + [mood] + [color] + [composition] + [quality] + [parameters]
  • subject — кто/что и что делает
  • style — художник, медиум, жанр (фото / иллюстрация / 3D)
  • setting — окружение, время суток, локация, эпоха
  • camera — объектив, ракурс, фокусное расстояние
  • lighting — характер света (мягкий, контровый, золотой час)
  • mood — настроение сцены (спокойное, тревожное, торжественное)
  • color — палитра в 2-4 цветах
  • composition — кадрирование, правило третей, симметрия
  • quality — технические маркеры (sharp focus, film grain)
  • parameters — для Midjourney: --ar, --style, --v, --s

Пример: editorial photograph of a young architect standing in front of a glass building at dusk, in the style of Magnum Photos, 85mm telephoto from below, golden hour rim light, calm and contemplative mood, muted palette of cream and slate blue, rule of thirds, shallow depth of field —ar 16:9 —style raw —v 6.1.

Блоки не обязаны идти строго по порядку, но первые 3-5 слов получают повышенный вес — туда ставится главный субъект или ключевой стилевой маркер. Если приоритет — фотореализм, в начало идёт editorial photograph; если приоритет — стиль автора, в начало идёт in the style of [имя].

Из чего состоит каждый блок

Субъект и действие. Конкретика сильнее общих слов. Плохо: «человек в офисе». Хорошо: «молодая женщина в льняной рубашке у окна с ноутбуком, в просторном офисе с деревянными столами».

Стиль или художник. Самый сильный рычаг. Один-два референса задают эстетику. Фотография: editorial photography, Magnum Photos, Annie Leibovitz, Henri Cartier-Bresson. Иллюстрация: Adrian Tomine, Jean Jullien, New Yorker editorial. Живопись: Edward Hopper, Andrew Wyeth. 3D: isometric render, Pixar style, Blender. Аниме: Studio Ghibli, Makoto Shinkai, Kyoto Animation. В Шедеврум и Kandinsky — русскими словами: «в стиле акварельной иллюстрации», «как фотография 1970-х».

Камера и ракурс. Фото-термины задают глубину сильнее абстрактного «красивая фотография». Рабочие связки: 85mm f/1.4, shallow depth of field (портрет), 35mm wide-angle, deep focus (репортаж), macro 100mm (макро), shot on Sony A7R V / Hasselblad / Kodak Portra 400 (камера + плёнка), anamorphic 2.39:1 (кинокадр), low angle / top-down / flat lay (ракурс).

Освещение. Без указания света результат плоский. Базовый набор: soft afternoon light from a window (мягкий боковой), golden hour, warm rim light (закат), studio three-point lighting (студия), Rembrandt lighting, chiaroscuro (классический портретный), soft blue dusk (сумерки), backlit silhouette, sun flare (контровый), volumetric god rays through fog (лучи через туман), neon ambient, cyan-magenta wash (киберпанк).

Цветовая палитра. Палитра в 2-4 цветах работает лучше «красивых цветов». Примеры: muted warm palette of cream, sage green, natural oak; high-contrast black, white and red accent; pastel pink, lavender, mint; monochromatic blue; earthy terracotta, ochre, deep brown.

Настроение. Эмоциональный регистр, который держит сцену. Quiet and contemplative — задумчивая тишина. Tense, foreboding — напряжение и тревога. Joyful, celebratory — радость и праздник. Melancholic, nostalgic — меланхолия, ностальгия. Serene, peaceful — покой. Настроение поддерживается светом, палитрой и позой героя — если они конфликтуют, читается верхний слой, а нижний теряется.

Композиция. Rule of thirds, subject on the left (правило третей), centered, symmetrical (симметрия), leading lines into the horizon (направляющие), negative space on the right (место под текст), wide shot / medium shot / close-up (планы).

Технические параметры Midjourney. --ar 16:9 соотношение сторон, --style raw без художественной обработки, --v 6.1 версия модели, --s 100 стилизация (0-1000), --c 10 chaos (0-100), --q 2 качество (×2 GPU), --no text исключения, --sref URL мудборд, --cref URL лицо героя, --oref URL стабильный объект.

Пять типов освещения

Свет — один из самых сильных рычагов в промте для картинки. Один и тот же субъект в разном свете читается как разные сцены.

  • Естественный мягкий свет. Окно в пасмурный день или белый рассеиватель: soft diffused window light from the left, gentle shadow falloff. Подходит портретам, продукту, lifestyle.
  • Золотой час. Низкое солнце, тёплая температура, длинные тени: warm golden hour sunlight, soft rim light around the subject, long shadows. Пейзажи, реклама образа жизни.
  • Студийный портретный (Rembrandt / loop / butterfly). Один ключевой источник сбоку плюс заполняющий: studio Rembrandt lighting, soft key from upper left at 45 degrees, subtle fill, neutral grey background. Объём и характер лица.
  • Кинематографический контраст. Резкий перепад света и тени: cinematic chiaroscuro, single warm practical light, deep shadows, atmospheric haze, anamorphic flare. Драма, нуар, концепт-арт.
  • Неоновый / смешанный. Несколько разноцветных источников и дымка: neon ambient lighting, cyan and magenta wash, wet asphalt reflections, anamorphic lens flare. Киберпанк, ночной город, обложки.

Если ни одного из этих маркеров в промте нет — модель додумает свет сама, обычно плоский и дневной.

Сравнение моделей по задачам

Один и тот же промт даёт разный результат в разных моделях. Под задачу — своя модель.

ЗадачаЛучшая модель
Рекламный креатив, типографикаRecraft, Ideogram
Аватарка, портрет, fashionMidjourney
Продуктовая карточка, мокапFlux 1.1 Pro
Иллюстрация для статьиDALL-E, Midjourney
Концепт-арт, фэнтезиMidjourney, Flux
Логотип, иконка, SVGRecraft
Кириллический текстIdeogram 2.0, Шедеврум
Редактирование готового фотоNano Banana, Kandinsky
Бесплатно, на русском, без VPNШедеврум, Kandinsky, Алиса картинки
Инфографика, схемаDALL-E, Recraft
Инстаграм-пост, обложка YouTubeMidjourney + Ideogram

Пять готовых промтов под основные задачи

Базовые сценарии. Промты под Midjourney 6.1 / Flux 1.1; для Шедеврум и Kandinsky — перевести связной русской фразой и убрать -- параметры.

1. Портрет героя для соцсетей. Editorial portrait of a young woman in her early thirties, soft confident smile, neutral linen shirt, in the style of contemporary magazine portraiture, three-quarter framing, 85mm f/1.4, Rembrandt lighting with soft window key, subtle warm rim, muted palette of cream, sand, amber, blurred indoor background —ar 4:5 —style raw —s 100 —v 6.1. Опорный приём — 85mm и Rembrandt-схема.

2. Пейзаж для обложки. Wide landscape photograph of a misty pine forest in the Russian north at sunrise, low fog between the trunks, foreground: wet ferns and a fallen mossy log, middle ground: dense old-growth pines, background: pale pink and gold sunrise sky, in the style of Sebastiao Salgado and Hiroshi Yoshida, slate blue and dusty rose palette, 24mm wide angle, deep focus, atmospheric haze —ar 21:9 —style raw —s 80 —v 6.1. Тройное деление планов — основа глубины.

3. Продуктовая карточка. Editorial product photography of a matte ceramic coffee mug on a light oak table, top-down flat lay, soft natural window light from upper left, sharp focus on the mug, complementary props: a small linen napkin, scattered roasted coffee beans, a wooden spoon, palette of cream, walnut and warm beige, generous negative space on the right for marketplace text —ar 4:5 —style raw —s 60 —v 6.1 —no logo, text, watermark, label. Низкий --s 60 — продукт узнаваемый, не «художественный».

4. Баннер для блога или email. Editorial illustration for a tech article header, a glowing neural network forming a stylized human silhouette in profile, in the style of New York Times and Wired editorial illustration, flat geometric shapes with painterly fills, gradient deep navy to teal, palette of midnight blue, teal, warm cream highlights, wide format with large negative space on the left for headline text —ar 16:9 —style raw —s 250 —v 6.1. Свободная левая зона держит верстку под заголовок.

5. Концепт-арт. Cinematic concept art of a lone explorer standing on a snow-covered ridge at dusk, looking down at the ruins of a vast ancient observatory in the valley below, glowing green aurora overhead, in the style of Simon Stalenhag and Greg Rutkowski, cold blue and teal palette with a single warm amber accent from the explorer’s lantern, volumetric god rays, painterly atmosphere, 35mm cinematic framing —ar 21:9 —style raw —s 350 —v 6.1. Один тёплый акцент в холодной палитре держит взгляд на герое.

Под конкретный бренд меняется палитра (на фирменные цвета), под героя добавляется --cref URL, под формат площадки — соотношение сторон (1:1, 4:5, 9:16, 16:9, 21:9).

Стили и готовые промты

Фотореализм

Конкретная камера, объектив, плёнка, тип света. Photorealistic editorial photograph of a young chef plating a dish in a Moscow restaurant kitchen, shot on Sony A7R V with 50mm f/1.4, soft window light, warm rim from candles, palette of amber, brown, cream, 35mm film grain —ar 3:2 —style raw —s 50 —v 6.1. В Flux — без -- параметров, плюс highly detailed, hyperrealistic. В Nano Banana — связным предложением.

Аниме

Студия и тип сцены, объективы игнорируются. Anime illustration of a young student walking home from school at dusk, cherry blossom petals, empty Tokyo street, in the style of Makoto Shinkai and Kyoto Animation, soft pink-orange sunset, lens flare, palette of dusty pink, lavender, warm yellow —ar 16:9 —niji 6. В Flux — добавить anime style, cel shading, Ghibli aesthetic.

Иллюстрация для статьи

Editorial illustration of a young woman at a wooden desk, working on a laptop, in the style of Adrian Tomine, New Yorker magazine cover, clean line work with painterly fills, soft afternoon window light, palette of cream, sage, oak, negative space on the right —ar 16:9 —style raw —s 200 —v 6.1.

Реклама и продукт

Продукт читается, есть место под текст. Editorial product photography of a ceramic coffee mug on a wooden table, top-down flat lay, soft natural window light, sharp focus on mug, beside it: coffee beans, spoon, linen napkin, palette of cream and walnut —ar 4:5 —style raw —s 100 —v 6.1 —no text, logo, watermark.

Портрет

Классический портретный свет, объектив, нейтральный фон. Studio portrait of a young woman in her late twenties, warm smile, in the style of editorial portrait photography, Rembrandt lighting with soft key and subtle rim, neutral grey background, 85mm f/1.4, palette of cream and amber —ar 1:1 —style raw —s 100 —v 6.1.

Пейзаж

Широкий формат, передний-средний-дальний план. Wide landscape photograph of a winter forest in northern Russia at dawn, snow on fir branches, low mist, foreground: a fallen log, background: pale pink sunrise sky, in the style of Sebastiao Salgado, palette of slate blue, dusty pink, deep green, 35mm wide angle —ar 21:9 —style raw —s 80 —v 6.1.

Обложка для блога или соцсетей

Формат 16:9 или 4:5, поле под заголовок. Editorial illustration of a glowing neural network forming a human silhouette, in the style of New York Times tech illustration, flat geometric shapes, gradient deep blue to teal, palette of navy, teal, warm white, negative space on the left for headline —ar 16:9 —style raw —s 250 —v 6.1.

Иконка

Плоская графика, один-два цвета, без теней. Minimal flat icon of a paper plane, vector style, single colour deep teal on cream, geometric, inspired by Dieter Rams, no gradients —ar 1:1 —style raw —v 6.1. Для SVG — Recraft.

Концепт-арт

Атмосфера, кинематографичность, слои. Cinematic concept art of a lone traveler on a snow-covered ridge, looking down at ruins of an ancient observatory, glowing aurora, in the style of Simon Stalenhag and Greg Rutkowski, cold blue-teal palette with warm amber accent, volumetric god rays —ar 21:9 —style raw —s 350 —v 6.1.

Инфографика и схема

Чистая геометрия, читаемые подписи. Лучше в DALL-E и Recraft. Editorial infographic showing a neural network, three horizontal layers with labelled nodes, flat vector with subtle paper texture, cream background, navy blue lines, warm orange accent, in the style of New York Times graphics —ar 16:9.

Ретро и винтаж

Конкретное десятилетие и медиум. Vintage photograph of a small Moscow cafe interior in 1978, warm tungsten light, slight haze, faded color photograph, in the style of Soviet film stock, palette of mustard yellow, faded teal, deep brown, 35mm film grain —ar 4:3 —style raw —s 150 —v 6.1.

Неон и киберпанк

Ночь, вода, отражения, насыщенные цвета. Cinematic night scene of a narrow Tokyo alley after rain, neon signs reflected in puddles, single figure with umbrella, steam from vents, in the style of Blade Runner 2049 and Liam Wong, high-contrast magenta, cyan, deep black, anamorphic lens flare —ar 21:9 —style raw —s 250 —v 6.1.

Акварель

Подтёки, бумажная текстура, без фото-камеры. Watercolor illustration of a quiet morning in a Russian country house, wooden veranda, samovar on a table, soft light through birch trees, in the style of contemporary watercolor sketchbook, visible paper texture and pigment bleeds, palette of cream, sage, soft terracotta —ar 4:5 —s 300 —v 6.1.

Pixel-art

Разрешение тайла и палитру указать. Pixel art scene of a cozy bookshop interior at night, warm lamp light, cat on a stack of books, rain outside, 16-bit Super Famicom aesthetic, 64x64 tile resolution, limited palette of 24 colors, no anti-aliasing —ar 4:3 —s 100 —v 6.1.

3D-рендер и изометрия

Isometric 3D render of a tiny home office floating in space, desk with laptop, plant, lamp, in the style of Blender isometric and low-poly art, soft global illumination, ambient occlusion, palette of cream, sage, warm wood —ar 1:1 —style raw —v 6.1.

Логотип

Логотипы — в Recraft или Ideogram (точная типографика). Midjourney генерирует «логотипо-подобные» концепты, но текст кривой. Minimal monogram logo combining letters M and S, geometric sans-serif, single colour deep teal on cream, inspired by Pentagram and Saul Bass —ar 1:1 —style raw —v 6.1 —no shadow, gradient, blur.

Специфика моделей

Midjourney 6.1. Лучший общий результат на художественных промтах и фотореализме. Параметры обязательны: --ar, --style raw для фото. --s 0-100 для литерального следования, --s 200-500 для стилизации. Style reference — --sref URL, --cref URL (лицо), --oref URL (объект). Аниме — отдельная модель --niji 6. Запятая делит сегменты, которые модель парсит независимо. Подробнее — промты для Midjourney, Midjourney бесплатно.

Flux 1.1 Pro / Flux Dev. Сильный фотореализм, людей и руки рисует лучше Stable Diffusion. Принимает естественный язык, длинные промты до 300 слов. Без -- параметров — все требования словами: aspect ratio 16:9, highly detailed. Поддерживает negative prompt в API. Open-source ветка Flux Dev запускается локально через ComfyUI.

Nano Banana (Google Gemini Image). Естественный язык без формулы — пиши как человеку. Сильная сторона — редактирование готовых фото и сохранение лица между генерациями. Понимает русский, en точнее.

DALL-E 3 / GPT Image. Длинные описательные промты на естественном языке. Слабее в фотореализме, сильнее в иллюстрациях и инфографике. ChatGPT дополняет короткий промт автоматически — отключается через «use this exact prompt».

Шедеврум (Яндекс). Бесплатно, без VPN, на русском. Понимает русские описания стилей: «в стиле акварельной иллюстрации», «как кадр из советского фильма». Слабее на сложных фотореалистичных сценах с людьми. См. также Алиса картинки. Пример: «Молодая женщина за деревянным столом у окна, работает за ноутбуком, мягкий дневной свет, в стиле редакторской иллюстрации, тёплая палитра: кремовый, шалфейный зелёный, дуб, 16:9».

Kandinsky 6.0 (Сбер). Бесплатно, в GigaChat и отдельно. Сильная сторона — image-to-image, реставрация фото, замена фона. На русском работает лучше западных моделей через машинный перевод. Поддерживает negative prompt. Пример: «Фотография архитектора у стеклянного здания на закате, в стиле редакторской фотографии, мягкий золотой свет, кремовый и сине-серый». Negative: «размытие, текст, лишние пальцы, искажённое лицо».

Негативные промты — что НЕ показывать

В Stable Diffusion, Flux, Kandinsky можно явно запретить нежелательное. Базовый набор: blurry, low quality, text, watermark, signature, extra fingers, deformed hands, distorted face, oversaturated, plastic skin, jpeg artifacts. Midjourney — аналог через --no text, watermark, blurry hands. В Nano Banana и DALL-E negative prompt нет — нежелательное описывается позитивно: вместо «без текста»«clean image, no typography elements».

Текст на картинке — кириллица и латиница

Длинный текст внутри картинки — боль моделей. Что работает в 2026: латиница 1-3 буквы — Midjourney 6.1, Flux 1.1, DALL-E 3; латиница до 5 слов — стабильно Ideogram 2.0, Recraft v3; длинный латинский текст — только Ideogram и Recraft с указанием шрифта; кириллица короткое слово — Ideogram 2.0 (с трудом), Flux 1.1 Ultra (через раз), Шедеврум; длинная кириллическая фраза — стабильного решения нет, разумнее генерировать фон без текста и добавлять надпись в Figma или Canva.

Промт для текста — текст в кавычках, после него шрифт и материал: Vintage cafe sign with the text “Утро” in serif lettering, hand-painted on weathered wood, in the style of Soviet hand-lettering —ar 4:3 —style raw —v 6.1.

Image-to-image и работа по референсу

Когда нужен тот же стиль, ракурс или герой — текстового промта мало, нужна картинка-референс. Midjourney: --sref URL (стиль), --cref URL (лицо), --oref URL (объект), комбинируются. Flux: Redux-модели и IP-Adapter. Nano Banana: загрузить фото и попросить «keep this composition, change subject to X». Kandinsky: режим «по фото». Stable Diffusion / ComfyUI: ControlNet (Canny, Depth, OpenPose, Reference). Промт по референсу короче — словами уточняется только то, что меняется.

Если визуального воображения нет (aphantasia)

Около 2-4% людей не видят картинки в голове, формула «опиши, что хочешь увидеть» не работает. Обходная схема: идти от функции картинки, а не от сцены; выбрать референсы глазами на Pinterest, Behance, Lexica, дальше работать через --sref с мудбордом; описывать ощущение и место под текст; идти через слои — сначала subject, потом стиль, потом свет, по одному параметру за итерацию.

Промпт-приёмы 2026 — что работает, а что нет

Трюки из эпохи Stable Diffusion 1.5 и Midjourney v4 в 2026 либо не работают, либо ухудшают результат.

Больше не нужно: masterpiece, best quality, 8k, ultra-detailed, hyperdetailed (компенсировали слабые модели, в Midjourney 6.1 и Flux 1.1 не дают прироста), trending on artstation, award-winning, professional, beautiful, photo в начале при --style raw, гирлянда из десяти прилагательных.

Продолжает работать: in the style of [фотограф/художник] (самый сильный рычаг), жанровые маркеры (editorial photograph, studio portrait, documentary), объектив и плёнка (Kodak Portra 400, 35mm), тип света (rim light, golden hour, Rembrandt), палитра в 2-4 цветах словами, --no.

Появилось в 2026: --sref random (случайный стиль для исследования), Personalization --p (Midjourney запоминает визуальный профиль), режим Raw в Flux 1.1 Ultra для естественной кожи без «AI-glaze».

Распространённые ошибки

Слишком много субъектов. «Девушка, кот, собака, ноутбук, кофе, цветы» — модель сделает кашу. Один-два главных субъекта плюс лаконичная среда.

Конфликтующие стили или свет. «Anime + Edward Hopper», «sunny + dark moody» — модель выберет одно. Один референс и одна световая схема за раз.

Отрицания в позитивном промте. «Без текста, не размытое» — модель не различает «не». Запреты — в negative prompt или --no.

Абстрактные прилагательные. «Красиво, креативно, breathtaking» — без визуального содержания. Заменять на конкретные референсы и фото-термины.

Пропуск света и aspect ratio. Без света результат плоский. Дефолт 1:1 редко соответствует задаче — для статей 16:9, для соцсетей 4:5 или 9:16.

FAQ

В какой нейросети писать промт на русском? Шедеврум, Kandinsky, Алиса картинки оптимизированы под русский. В Midjourney, DALL-E, Flux лучше переводить в английский. Nano Banana понимает оба языка, en точнее.

Длинный или короткий промт? Midjourney 6.1 — короткий (20-40 слов). DALL-E 3, Nano Banana — длинный описательный (50-200 слов). Flux — до 300 слов. Шедеврум и Kandinsky — 30-70 слов.

Почему хорошие промты бесполезны? Проблема часто в модели, а не в промте. Фотореализм — Midjourney или Flux. Иллюстрация — DALL-E или Recraft. Текст — Ideogram. Редактирование готового фото — Nano Banana или Kandinsky.

Где брать референсы стиля? Гугл-поиск имён («editorial photography», «New Yorker illustrators»), PromptHero, Lexica. В Midjourney — --sref URL с картинкой из Pinterest или Behance.

Можно ли копировать стиль конкретного художника? Технически — да. Юридически — серая зона. По документации Firefly, коммерчески безопасные модели не обучают на живых художниках. Для коммерции — Firefly или custom-модель.

Как добиться одного лица в серии? В Midjourney — --cref URL. В Nano Banana — загрузить фото и попросить «keep the same face». В Flux — LoRA. Без этого одинаковое лицо в разных кадрах почти невозможно.

Почему руки и пальцы кривые? Старая болезнь diffusion. Решения: «hands hidden in pockets», «arms crossed», «holding a cup» — руки в действии получаются лучше. Flux 1.1 и Midjourney 6.1 рисуют руки заметно лучше предыдущих версий. Negative: «extra fingers, deformed hands».

Как сгенерировать читаемый текст на картинке? Латиница — Ideogram и Recraft. Midjourney 6.1 справляется со словами 1-3 буквы. Кириллица — только Ideogram 2.0 и Шедеврум, короткие надписи. Длинный русский — фон без текста, надпись в Figma или Canva.

Нужен ли формат «masterpiece, 8k, hyperdetailed»? В 2026 — нет. Маркеры остались с эпохи SD 1.5, в Midjourney 6.1 и Flux 1.1 не добавляют качества. Работают конкретные термины: свет, объектив, плёнка, референс.

Что писать в негативный промт по умолчанию? blurry, low quality, text, watermark, signature, extra fingers, deformed hands, distorted face, oversaturated, jpeg artifacts. Для портретов — plastic skin, doll eyes. Для продукта — logo, brand label. В Nano Banana и DALL-E negative нет — нежелательное описывается позитивно.

Влияет ли порядок слов? Да, особенно в Midjourney и Stable Diffusion. Первые 3-5 слов получают больший вес. Стиль критичен — в начало; субъект важнее — субъект первым.

Можно ли коммерчески использовать сгенерированные картинки? У Midjourney и DALL-E коммерческие права даёт платная подписка. Firefly обучен на лицензионном датасете. По данным U.S. Copyright Office, картинки только по тексту в США не защищаются авторским правом. В РФ практика формируется.

Где собрать готовые промты? Библиотека промтов на сайте. Внешние: PromptHero, Lexica с поиском по картинке.

Дальше

Если нужен углублённый разбор по конкретной модели — промты для Midjourney с разбором параметров, Midjourney обзор с тарифами, Flux для фотореализма и текста, DALL-E для иллюстраций в ChatGPT, Recraft для рекламы и вектора, Шедеврум для бесплатной генерации на русском без VPN. Общая подборка готовых промтов на разные задачи — в библиотеке промтов. Сравнение моделей под задачу — в обзоре нейросетей для картинок.