Блог гайд

Промты для Midjourney

Midjourney — модель генерации изображений, лидер по визуальному качеству и художественной стилизации. Работает через web-интерфейс на midjourney.com и Discord-бота. В отличие от ChatGPT и DALL-E, строит изображение как художник: с авторской палитрой, продуманным светом и композицией.

В 2026 актуальная версия — Midjourney V8.1 (вышла 14 апреля 2026). До неё дефолтом был V7. V8.1 быстрее V7 в 4-5 раз, рендерит читаемый текст внутри изображения, лучше работает с анатомией рук и по умолчанию выдаёт 2K. V7 остаётся как альтернатива для художественных сцен. Обзор моделей — на Midjourney.

Базовая структура промта в Midjourney

Рабочий шаблон состоит из шести смысловых блоков:

[субъект и действие], [среда и контекст],
[медиум / стиль / художник], [освещение],
[композиция и ракурс], [цветовая палитра]
--ar 16:9 --style raw --v 8.1

Пример:

A young woman reading a book in a Moscow cafe,
editorial photography, soft afternoon window light,
medium telephoto lens shot, muted warm palette
--ar 16:9 --style raw --v 8.1

Midjourney не любит длинные многословные описания — на промтах от 60 слов модель теряется. Лучше работают компактные запросы из 10-30 слов с 5-7 ключевыми визуальными терминами. Первые слова влияют сильнее последних — важное ставится в начало.

Промт пишется на английском. Русский Midjourney понимает, но выдаёт менее предсказуемый результат — модель обучалась преимущественно на английских данных. Для перевода описаний удобно использовать ChatGPT или Claude.

Шесть смысловых блоков подробно

Субъект и действие. Главный персонаж или объект. Не «человек», а «middle-aged barista with a beard»; не «город», а «narrow stone street in old Tbilisi».

Среда и контекст. Где и когда: время суток, погода, страна, окружение. Задаёт настроение и вторичные детали (мокрый асфальт, пыль на солнце).

Медиум и стиль. На каком материале и в какой манере: photography, oil painting, watercolour, 3D render, vector. Сюда же — имя референса: in the style of Roger Deakins, Studio Ghibli.

Освещение. Самый недооценённый блок. Soft window light, golden hour, harsh midday sun, neon backlight, candlelight. Без явного описания света кадр получается усреднённо-дневным.

Композиция и ракурс. Top-down flat lay, low-angle hero shot, close-up macro. Линза: 24mm wide-angle, 50mm natural, 85mm portrait, anamorphic.

Цветовая палитра. Muted earthy palette of olive and cream; high-contrast magenta and cyan; monochrome with grain. Без указания модель выбирает палитру за вас.

Порядок слов и приоритет

Первая треть промта определяет большую часть результата, последняя — почти не влияет. Ключевой объект и стиль — в начало, свет и палитра — в середину, параметры командной строки (--ar, --v, --no) — в конец.

Если в кадре несколько равнозначных элементов, балансируйте вес через ::: red dress::2 white background::1. Используется редко, но спасает, когда модель игнорирует второстепенный элемент.

Главные параметры Midjourney

--ar — соотношение сторон

ЗначениеИспользование
--ar 1:1квадрат (соцсети, обложка трека)
--ar 16:9широкий (статья, hero, презентация)
--ar 9:16вертикальный (Stories, Reels)
--ar 4:5портретный (карусель в соцсетях)
--ar 21:9кинематографический (баннер)
--ar 3:2классический фото (репортаж)
--ar 2:3вертикальное фото (журнал)

--v — версия модели

--v 8.1 # текущий дефолт (с апреля 2026)
--v 7 # предыдущая, мягче стилизация
--niji 6 # аниме и иллюстрация

--style — режим стилизации

--style raw # без художественной обработки, ближе к фото
--style cute # иллюстрации (только в niji)
--style scenic # пейзажи (только в niji)

--style raw — главный параметр для фотореализма. Без него Midjourney добавляет художественность, и фото выглядит «слишком красиво».

--s — stylize (0-1000)

Насколько модели разрешено добавлять своё видение. --s 0 — близко к промту, --s 100 — баланс (default), --s 250-500 — заметная обработка, --s 1000 — максимум. Для фото и продукта — --s 0-100, для арта и иллюстраций — --s 250-500. На высоких значениях появляется «midjourney look»: фирменная палитра и художественный свет.

--c — chaos (0-100)

Вариативность четырёх результатов в сетке. --c 0 — все похожи, --c 30 — заметное разнообразие, --c 80+ — каждый сильно отличается.

--weird — странность (0-3000)

Для нестандартных концептуальных образов. Чем выше, тем дальше модель уходит от привычного. Полезен для концепт-арта и обложек альбомов.

--no — отрицательный промт

--no text, watermark, blurry, deformed hands, extra fingers

Midjourney не понимает отрицания внутри основного промта. Всё ненужное — в --no.

--seed и --q

--seed 12345 фиксирует результат: одинаковый промт с одним seed выдаёт похожие кадры — удобно для итеративной правки. --q (0.25–2) — детализация и время рендера; в 2026 году дефолт почти всегда достаточен.

--sref — референс стиля

--sref https://example.com/style-image.jpg
--sref https://image1.jpg https://image2.jpg --sw 50

Копирует визуальный стиль референса: палитру, текстуру, освещение. Содержимое не переносится. --sw (0-1000) — сила копирования.

--cref и --oref — референс персонажа и объекта

--cref https://example.com/person.jpg --cw 100
--oref https://example.com/object.jpg --ow 100

--cref — для одного и того же персонажа в разных сценах. --cw (0-100): 0 — только лицо, 100 — лицо + волосы + одежда. --oref так же для любых объектов (продукт, машина, здание) — появился в V8.1.

--tile — бесшовные паттерны

--tile делает картинку, которая стыкуется сама с собой по краям. Для текстур, паттернов и фонов сайта.

--draft — черновой режим

Появился в V7. Генерация в разы быстрее за счёт упрощённого рендера. Удобно перебирать варианты композиции, прежде чем тратить Fast-часы на финал. После одобрения — снять --draft и догенерировать в полном качестве.

--repeat — пачка из одного промта

--repeat 4 запускает один и тот же промт четыре раза подряд. Полезно для перебора сидов под фиксированный промт. Доступно на Standard и выше.

Двойное двоеточие :: — вес и разделение

Базовый приём — задать вес: red dress::2 white background::1. Расширенный — разделить смысловые группы, чтобы модель не смешивала их. hot dog::1 fashion editorial::2 воспринимается как «редакционный кадр с хот-догом», а не «собака в одежде». Без :: Midjourney пытается слить понятия.

Стили: фотореализм

Editorial / репортаж

Editorial photography of [сцена],
soft natural light from a window, shallow depth of field,
medium telephoto lens, muted warm palette
--ar 16:9 --style raw --s 50 --v 8.1

Кинематографический

Cinematic shot of [сцена],
in the style of Roger Deakins cinematography,
35mm anamorphic lens, golden hour light,
muted cool palette of slate blue and warm cream
--ar 21:9 --style raw --v 8.1

Документальный портрет

Environmental portrait of [человек] in [среда],
National Geographic style, 85mm lens, natural light,
slight grain, muted natural palette
--ar 4:5 --style raw --v 8.1

Уличная фотография

Candid street photograph of [сцена] in [город],
Henri Cartier-Bresson style, decisive moment,
35mm lens, black and white with film grain
--ar 3:2 --style raw --v 8.1

Студийный портрет на тёмном фоне

Studio portrait of [человек],
single softbox key light from camera left,
dark seamless backdrop, 85mm lens at f/1.8,
shallow depth of field
--ar 4:5 --style raw --s 50 --v 8.1

Стили: иллюстрация

Editorial / New Yorker

Editorial illustration of [сцена],
in the style of Adrian Tomine, New Yorker magazine cover,
clean line work with painterly color fills,
muted contemporary palette
--ar 16:9 --v 8.1

Flat / минималистичная

Flat vector illustration of [сцена],
minimalist geometric shapes, limited colour scheme,
Dieter Rams design principles, deep teal on cream
--ar 1:1 --style raw --v 8.1

Акварель

Watercolour illustration of [сцена],
loose brush strokes with visible paper texture,
soft wet-on-wet bleeding edges,
muted palette of dusty rose and sage
--ar 4:5 --v 8.1 --s 400

Винтаж и ретро-футуризм

Retro-futuristic illustration of [сцена],
1960s atomic age aesthetic, halftone print texture,
muted palette of avocado, mustard and salmon,
Saul Bass poster composition
--ar 3:2 --v 8.1 --s 400

Стили: аниме (через niji)

Studio Ghibli

[сцена],
in the style of Studio Ghibli,
hand-drawn anime, watercolour backgrounds,
soft natural light, gentle palette,
emotional intimate moment
--ar 16:9 --niji 6 --style scenic

Современный аниме-портрет

Anime portrait of [персонаж],
detailed eyes, soft cel-shading,
clean line art, vivid but balanced colors,
modern anime style 2026
--ar 4:5 --niji 6 --style cute

Makoto Shinkai — кинематографический аниме-пейзаж

[сцена],
in the style of Makoto Shinkai,
hyperdetailed cloudscape, lens flare,
glowing magic hour light, saturated palette
--ar 21:9 --niji 6 --style scenic --s 400

Стили: концепт-арт

Concept art of [объект / сцена],
in the style of ArtStation top trending,
matte painting, dramatic atmospheric perspective,
volumetric god rays, intricate detail,
cinematic composition
--ar 21:9 --v 8.1 --s 500

Для концепт-арта работает связка большого --s (300-700) и --weird (300-1000) — модель уходит дальше от очевидного решения.

Стили: поп-арт

Pop art portrait of [персонаж],
in the style of Andy Warhol screen print,
bold flat colors, high contrast,
limited palette of magenta, yellow and black,
graphic poster composition
--ar 1:1 --v 8.1 --s 300

Стили: фэшн

Fashion editorial photograph of [модель] wearing [одежда],
Vogue magazine cover style,
hard directional light, dramatic shadows,
seamless coloured backdrop, 85mm lens,
high fashion pose
--ar 4:5 --style raw --v 8.1

Для фэшн работает указание журнала-референса (Vogue, Harper’s Bazaar, Dazed) и тип света — это даёт характерный «глянцевый» или «редакторский» look.

Стили: реклама / продукт

Product photography of [продукт] on [поверхность],
soft natural window light, top-down view, flat lay,
beside the product: [сопутствующие предметы],
minimalist composition with negative space,
muted warm palette
--ar 1:1 --style raw --v 8.1 --no text, logo, brand name

Ключевое для рекламы — --no text, logo, brand name. Иначе модель пытается дорисовать неузнаваемые логотипы и подписи.

Стили: пейзаж

Landscape photograph of [место],
golden hour light, dramatic clouds,
foreground interest, leading lines,
wide-angle 24mm lens, deep depth of field,
muted natural palette
--ar 21:9 --style raw --v 8.1

Для пейзажа --style raw обязателен — иначе модель добавит «инстаграмную» насыщенность.

Стили: киберпанк и неон

Cyberpunk street scene in [город],
rain-soaked neon-lit alley, holographic billboards,
reflective wet asphalt, atmospheric fog,
in the style of Syd Mead and Blade Runner 2049,
palette of magenta, cyan and amber
--ar 21:9 --v 8.1 --s 400

Стили: пиксель-арт

Pixel art scene of [сцена],
16-bit SNES aesthetic, limited 32-colour palette,
crisp dithering, visible square pixels, no anti-aliasing
--ar 16:9 --v 8.1 --s 250

Низкий --s (100-250), иначе модель «сгладит» пиксели в иллюстрацию.

Стили: 3D / Pixar

3D render of [персонаж],
Pixar character design, soft subsurface scattering,
clay material with matte finish, studio three-point lighting,
warm pastel palette
--ar 1:1 --v 8.1 --s 300

Стили: бесшовные паттерны

Seamless repeating pattern of [мотив],
flat vector illustration, hand-drawn feel,
limited palette of sage, terracotta and cream
--tile --ar 1:1 --v 8.1 --s 300

Для веб-фонов и упаковки. После генерации проверить стык в редакторе — Midjourney иногда оставляет видимый шов.

Стили: абстракция / фон под текст

Abstract organic gradient background,
soft blurred shapes, muted palette of dusty pink and lavender,
subtle film grain, copy space in centre
--ar 16:9 --v 8.1 --s 500

Для hero-секций лендингов и обложек подкастов, когда нужен фон под текст.

Промты под задачи

Обложка статьи в блог

Editorial illustration for a blog article about [тема],
flat vector style, single central metaphor,
clean composition with negative space,
muted contemporary palette,
no text, no captions
--ar 16:9 --v 8.1 --s 250 --no text

Иллюстрация книги

Children's book illustration of [сцена],
in the style of [автор-референс],
watercolour and ink, warm storytelling light,
soft gentle palette
--ar 4:5 --v 8.1 --s 400

Для серии в одной книге обязательно фиксировать стиль через --sref от первой иллюстрации — иначе персонаж и манера будут «плыть» от страницы к странице.

Реклама / баннер

Advertising photography of [продукт] in [сцена использования],
lifestyle context, natural light, candid moment,
shallow depth of field, 50mm lens,
warm palette, copy space on the right
--ar 16:9 --style raw --v 8.1 --no text, logo

«Copy space» — место под текст, который потом ляжет в Figma поверх картинки.

Концепт-арт персонажа для игры

Character concept sheet of [персонаж],
front, side and 3/4 view on neutral grey background,
ArtStation trending, full body, detailed costume design,
soft even studio lighting
--ar 16:9 --v 8.1 --s 400

Food editorial

Overhead food photograph of [блюдо],
top-down flat lay on linen surface,
beside the dish: ingredients and a wooden spoon,
soft north window light, muted earthy palette
--ar 4:5 --style raw --v 8.1

Обложка музыкального альбома

Album cover artwork for [жанр] album,
single conceptual image with strong central metaphor,
in the style of Hipgnosis design studio,
medium format film aesthetic, muted moody palette
--ar 1:1 --v 8.1 --s 600 --weird 250

Карточка товара для маркетплейса

E-commerce product shot of [товар],
clean white seamless background, soft even lighting,
front view, sharp focus, high commercial quality
--ar 1:1 --style raw --s 0 --v 8.1 --no text, logo, watermark

Логотип

Midjourney не лучший выбор для логотипов: модель плохо рисует точные геометрические формы и читаемый текст. Для финального логотипа используйте Recraft или Ideogram. Midjourney годится для поиска визуальной идеи:

Logo concept for [бренд] [сфера],
minimalist mark, single geometric shape,
flat design, no text,
black on white background
--ar 1:1 --style raw --v 8.1 --no text, letters

Серия в одном стиле и один персонаж

Для серии в одной стилистике: сделать первый промт, скопировать URL понравившейся картинки, во всех следующих промтах добавить --sref [URL]. Серия получается с единой палитрой, светом и манерой.

Для одного персонажа в разных сценах — то же через --cref [URL] --cw 80. --cw 100 сохраняет лицо, волосы и одежду, --cw 0 — только лицо.

sref-коды: фиксированные стили без референса

В --sref можно подставить числовой код вместо URL. Например, --sref 1377372165 — стиль «red and black doodle pop», --sref 947110771 — синий «blueprint». Коды публикуют в сообществе и подборках — удобный способ зафиксировать стиль без картинки-референса. Несколько кодов комбинируются: --sref 1377372165 947110771 --sw 100. В V8.1 старые коды V6 требуют флага --sv 4.

Комбинированные референсы: стиль + персонаж + объект

В одном промте можно использовать --sref (стиль), --cref (персонаж) и --oref (объект) одновременно. Например — реклама бренда косметики, где зафиксированы модель, флакон и общая визуальная подача:

Editorial beauty photograph of model holding a serum bottle,
soft afternoon window light, muted palette
--cref https://example.com/model.jpg --cw 100
--oref https://example.com/bottle.jpg --ow 100
--sref https://example.com/brand-mood.jpg --sw 80
--ar 4:5 --style raw --v 8.1

Самый мощный приём для брендового контента — модель, продукт и подача держатся одинаковыми во всей кампании.

Свет в промтах Midjourney

Свет решает, как воспринимается кадр. Без явного указания модель выдаёт усреднённый дневной. Рабочие формулы:

Тип светаФормулировкаГде использовать
Golden hourwarm golden hour light, long soft shadows, rim light from behindпортрет, реклама, пейзаж
Blue hourcool blue hour twilight, ambient city glowурбан, food на улице
Soft windowsoft north window light, gentle falloffeditorial-портрет, интерьер
Hard directionalhard directional light from camera right, sharp shadowsfashion, продукт
Rim lightingstrong rim light from behind, dark backgroundдраматический портрет, постер
Neon backlightneon backlight in magenta and cyan, atmospheric hazecyberpunk, музыкальные кадры
Volumetric raysvolumetric god rays through dustконцепт-арт, фэнтези, интерьер
Candlelightwarm candlelight, deep amber tones, low contrastвинтаж, интимные сцены
Overcast diffusedovercast diffused light, no shadows, even illuminationдокументальная съёмка
Chiaroscurodramatic chiaroscuro lighting in the style of Caravaggioживописный приём

Сочетания работают: «golden hour with rim light» или «soft window light with subtle volumetric rays». Больше двух источников в одном промте модель сливает в кашу.

Референсы стилей: «in the style of»

Midjourney узнаёт тысячи имён художников, операторов, режиссёров. Точное имя даёт характерную манеру — композицию, палитру, текстуру.

  • Фотографы: Annie Leibovitz (editorial), Steve McCurry (documentary colour), Helmut Newton (high-fashion), Saul Leiter (urban colour street).
  • Операторы: Roger Deakins (warm naturalistic), Emmanuel Lubezki (natural light handheld), Christopher Doyle (saturated Asia).
  • Режиссёры: Wes Anderson (symmetric pastel), Kubrick (one-point cold), Fincher (green-cyan corporate), Villeneuve (vast quiet sci-fi).
  • Цифровые: Greg Rutkowski (fantasy), Craig Mullins (concept), WLOP (anime-realistic), Syd Mead (retro-future).
  • Классические: Caravaggio (chiaroscuro), Monet, Hopper, Rothko.
  • Студии: Studio Ghibli, Pixar, Hipgnosis (album covers), Bauhaus, Saul Bass posters.
  • Российские: Васнецов, Билибин, Айвазовский, Репин — узнаёт большинство классиков.

Один-два референса в промте, не больше. «In the style of Van Gogh and Hokusai and Ghibli and Wes Anderson» даёт кашу. Если нужно смешать — через вес: Van Gogh::2 Hokusai::1.

Что НЕ работает в Midjourney

Длинный текст внутри изображения. V8.1 рендерит читаемый текст из 1-3 слов. Целые фразы плывут — для постеров с длинным текстом Ideogram или вёрстка поверх в Figma.

Точные пропорции и измерения. «Ровно 5 человек», «здание в 3 этажа» — модель воспринимает как настроение, не как факт. Считайте предметы как «несколько», «пара», «толпа».

Сложные руки и кириллица. V8.1 рисует руки в покое и простых жестах. Игра на инструменте, мелкие предметы в пальцах ломаются. Кириллический текст всегда плывёт — русские надписи в редакторе.

Точные логотипы и схемы. Модель рисует «похожий» вариант логотипа, не оригинал. Схемы, диаграммы, карты Midjourney не умеет — нужен Napkin AI или ручная вёрстка.

Магические слова из старых гайдов. «Masterpiece», «high quality», «8k», «hyperdetailed», «trending on artstation» — в V8.1 почти не влияют. Если оставлять, то одно слово, а не гирлянду — лишние забивают вес важных описаний.

Stable Diffusion-стиль. Запятые-теги «1girl, blue hair, masterpiece, score_9» работают в SD, но не в Midjourney — здесь нужны короткие осмысленные фразы, не теги.

Длинные перечисления цветов. «Red, orange, yellow, green, blue, purple» — получится радужная каша. Лучше «palette of warm reds and ambers» или «muted earth tones with single accent of teal».

Типичные ошибки промтинга

  • Слишком длинный промт — V8.1 любит 10-30 слов, литературные описания путают модель.
  • Отрицания в позитиве — «без текста, не размытое» модель не понимает; всё ненужное в --no.
  • Конфликтующие стили — «photorealistic anime in the style of Hopper» модель усреднит до каши.
  • Игнорирование --style raw — для фото без художественной обработки обязательны --style raw + --s 0-100.
  • Серия без --sref — если нужно 10 картинок в одном стиле, --sref от первой одобренной обязателен.
  • Русский для визуальных терминов — golden hour, anamorphic, chiaroscuro работают только на английском.

Midjourney vs DALL-E, FLUX, Stable Diffusion

Промт для Midjourney устроен иначе, чем для других моделей — переносить шаблоны нельзя.

DALL-E и GPT Image работают с естественным языком: «нарисуй кошку в красной шапке на подоконнике в стиле акварельной детской книги». Midjourney на таком теряется — ужимаем: «watercolour children book illustration, cat in red hat on windowsill, soft warm light». DALL-E лучше понимает русский и длинный текст внутри картинки.

FLUX ближе к DALL-E — длинные описательные фразы работают. Сильная сторона — анатомия рук и читаемый текст. Слабая — художественная стилизация: «midjourney look» FLUX не даст.

Stable Diffusion ждёт промт в формате запятых-тегов: «1girl, blue hair, sundress, masterpiece». Веса в скобках: (blue hair:1.2). В Midjourney эта структура не работает.

Суть: Midjourney — «художник», навязывающий свой стиль; DALL-E и FLUX — «исполнители», воспроизводящие сценарий; Stable Diffusion — «конструктор» с максимальным контролем.

Когда брать Midjourney: обложки, постеры, концепт-арт, editorial-фото, серия в едином стиле через --sref.

Когда брать другую модель: длинный текст в картинке → Ideogram, DALL-E; точный логотип → Recraft; анатомия и композиция → Stable Diffusion + ControlNet; бесплатно из РФ → Шедеврум, Kandinsky.

Антипромты: что НЕ писать

  • «Не делай Х». Модель не понимает no/not/without внутри основного промта. Всё ненужное — в --no.
  • «Сделай красиво». Beautiful, amazing, stunning, perfect — пустые слова. Модель не знает, что красиво именно вам.
  • «В стиле всего хорошего». Cinematic + editorial + fashion + concept art в одном промте дают кашу. Один промт — один доминирующий стиль.
  • Противоречия. «Реалистично в стиле акварели» модель усреднит до «акварели, выдающей себя за фото». Выбирайте один путь.
  • Эмоции без триггеров. «Sad scene» модель не нарисует. Дайте визуальный признак: «empty chair by the window in dim grey light».
  • Точные размеры. «5 people exactly», «building 12 meters tall» — модель воспринимает как настроение, не как факт.
  • Кириллица внутри картинки. Превратится в декоративные глифы. Русский текст — поверх в Figma.

Тарифы и доступ

Basic — $10/мес (~200 картинок), Standard — $30/мес (15 часов Fast + Unlimited Relax), Pro — $60/мес (30 часов + Stealth), Mega — $120/мес (60 часов + Stealth). Из РФ — через VPN и зарубежную карту, рабочие способы без VPN — на Midjourney бесплатно. Альтернативы для РФ: Шедеврум, Kandinsky, Recraft, Ideogram, Flux.

FAQ

Какая версия Midjourney актуальна в 2026? V8.1 — дефолтная с 14 апреля 2026. Быстрее V7 в 4-5 раз, рендерит читаемый текст из 1-3 слов, лучше рисует руки, по умолчанию выдаёт 2K. V7 остаётся для художественных задач с «мягкой» подачей.

Можно ли коммерчески использовать картинки? На Standard и выше — да, права принадлежат пользователю. Подробнее — в Midjourney Terms of Service.

Почему получается «midjourney look»? Высокий --s (по умолчанию 100) и отсутствие --style raw. Для нейтрального фото — --s 0 --style raw. Для арта с авторской подачей — --s 300-500.

Что лучше — Midjourney или DALL-E 3? Midjourney выигрывает на художественных и фото-задачах. DALL-E лучше с конкретным сюжетом и длинным текстом. Сравнение — на Midjourney или DALL-E.

Почему модель не рисует то, что я прошу? Три причины: ключевая фраза в конце промта (передвиньте в начало), конфликт стилей, важная деталь забита высоким --s. Поднимите вес ключевой фразы через ::: red dress::2.

Можно ли использовать референсы реальных людей? По правилам нельзя загружать фото живых публичных персон в --cref для компромата или вводящих в заблуждение сцен. Для своего лица в художественных целях — можно.

Где брать референсы стилей? PromptHero, Lexica, сама галерея Midjourney. Удобно сохранять понравившиеся URL и подставлять в --sref.

На каком языке писать промт? На английском. Русский модель понимает, но результат менее предсказуемый. Если английский слабый — опишите сцену по-русски и попросите ChatGPT перевести в визуальные термины.

Какой длины должен быть промт? 10-30 слов плюс параметры. Меньше — модель додумывает половину сцены сама. Больше 60 — теряет фокус. Идеал — 5-7 ключевых визуальных терминов в компактных фразах.

Как добавить текст внутрь изображения? V8.1 рисует читаемый текст из 1-3 коротких английских слов: «OPEN», «CAFE», «SALE». В кавычках: neon sign saying "OPEN". Длинные фразы и кириллица ломаются — для постеров с большим текстом используйте Ideogram или верстайте поверх в Figma.

Чем отличается --sref от --cref? --sref копирует стиль: палитру, освещение, текстуру. Содержимое не переносится. --cref копирует персонажа: лицо, причёску, костюм. Для серии в одном стиле — --sref. Для одного героя в разных сценах — --cref.

Что такое --oref? Object reference — референс конкретного объекта (продукт, бутылка, машина). Появился в V8.1. Используется как --cref, но для любого объекта — удобно в продуктовой съёмке.

Что делать, если результат «слишком красивый»? Типичный «midjourney look». Лечится связкой --style raw --s 0 или --s 50. Дополнительно — термины из лексики реальной фотографии: candid, documentary, 35mm film grain, available natural light.

Можно ли учить Midjourney на своих картинках? Файн-тюнинга нет. Ближайшее — --sref, --cref и --oref через URL. Для полноценного обучения на датасете нужен Stable Diffusion с LoRA или FLUX.1 dev.

Чек-лист перед Generate

  1. Ключевой объект — в начало промта, не в середину.
  2. Указан медиум: photography, illustration, 3D render, oil painting.
  3. Описан свет: golden hour, soft window, hard directional, neon.
  4. Задан ракурс или линза: close-up, wide shot, 85mm, anamorphic.
  5. Указана палитра: muted earth, vivid neon, monochrome.
  6. --ar под задачу: 1:1 соцсети, 16:9 статья, 4:5 фид.
  7. --style raw для фото, без него — для иллюстраций.
  8. --s под задачу: 0-100 фото, 250-500 арт.
  9. Всё ненужное — в --no, а не в основной промт.
  10. Нет противоречий: photorealistic и anime в одном промте не дружат.

Если по любому пункту «не уверен» — добавьте его явно. Midjourney наказывает за умолчания.

Дальше

Полный обзор модели, тарифов и доступа из России — на Midjourney. Если нет зарубежной карты и VPN, рабочие способы пользоваться без подписки — на Midjourney бесплатно.

Альтернативы со своими сильными сторонами: FLUX — лучшая анатомия и текст внутри картинки, DALL-E — длинный текст и точное следование сюжету, Stable Diffusion — полный контроль через ControlNet и LoRA. Сравнение моделей в одной таблице — на Нейросети для картинок.

Более широкая логика промтинга — на Промт для картинки и в общем гайде по Промтам. Готовые шаблоны под задачи — в Библиотеке промтов.