DALL-E и GPT Image — нейросеть OpenAI для картинок
DALL-E — известное название генератора изображений от OpenAI. К июню 2026 линейка перестроена: DALL-E 2 и DALL-E 3 удалены из API 12 мая 2026, на смену пришли модели семейства GPT Image — встроены прямо в архитектуру GPT-5. Текущий флагман — GPT Image 2 (выпущен 21 апреля 2026, API с начала мая), прошлый — GPT Image 1.5 (16 декабря 2025). Источники: официальная страница API OpenAI, гайд по GPT Image 2 от MindWired, сводка ChatGPT Plus от AI Video Bootcamp.
Главное отличие GPT Image от классического DALL-E — картинки рисуются прямо в диалоге: пишете «нарисуй X», получаете изображение в той же беседе с ChatGPT, можно сразу сказать «измени фон» или «убери надпись» — модель помнит контекст и точечно правит только нужный фрагмент, не перерисовывая всё заново.
История линейки: от DALL-E 1 до GPT Image 2
OpenAI запустил генерацию изображений в 2021. За пять лет архитектура поменялась дважды — сначала diffusion, потом autoregressive внутри GPT-5. «DALL-E» в 2026 — уже не отдельная модель, а народное имя для всей линейки.
- DALL-E 1 (январь 2021) — 12-млрд-параметрная вариация GPT-3, разрешение 256×256, только демо в блоге OpenAI.
- DALL-E 2 (апрель 2022) — diffusion поверх CLIP, разрешение 1024×1024, inpainting. Публичный доступ — сентябрь 2022. Удалена из API 12 мая 2026.
- DALL-E 3 (октябрь 2023) — интеграция с ChatGPT, расширение промптов через GPT-4, рендеринг текста ~37% против ~5% у DALL-E 2. С августа 2024 бесплатна в ChatGPT Free. Удалена из API 12 мая 2026.
- GPT Image 1 (апрель 2025) — autoregressive-модель,
gpt-image-1в API. Deprecating 23 октября 2026. - GPT Image 1.5 (16 декабря 2025) — в 4 раза быстрее GPT Image 1, цена API ниже ~20%, точный текст 87%.
- GPT Image 2 (21 апреля 2026) — флагман. Thinking Mode, multi-turn edit, точный текст ~99%, до 100+ объектов на сцене.
Картинки, сгенерированные DALL-E 2/3 до 12 мая 2026, остаются у пользователя и пригодны для коммерции — OpenAI отключил доступ к новой генерации, не отозвал лицензии на старый контент.
Текущее состояние линейки OpenAI в июне 2026
OpenAI окончательно ушёл от diffusion-моделей DALL-E к autoregressive-семейству GPT Image. Эта смена архитектуры даёт принципиально иной уровень работы с текстом на изображении и с контекстной памятью внутри диалога.
| Модель | Назначение | Статус |
|---|---|---|
| GPT Image 2 | Текущий флагман | актуальная, в ChatGPT и API |
| GPT Image 1.5 | Прошлый флагман | актуальная, выпущена 16 декабря 2025 |
| GPT Image 1 | Первая модель семейства | deprecating 23 октября 2026 |
| GPT Image 1 Mini | Бюджетная для API | актуальная, самая дешёвая |
| DALL-E 3 | Прошлое поколение | удалена из API 12 мая 2026 |
| DALL-E 2 | Legacy | удалена из API 12 мая 2026 |
В пользовательских интерфейсах ChatGPT и приложениях везде уже работает GPT Image 1.5 или GPT Image 2. Название «DALL-E» сохранилось как привычное имя для всей продуктовой линейки и активно используется в поиске.
Что произошло с DALL-E 3
По гайду Skywork AI: 14 ноября 2025 OpenAI уведомил разработчиков, 12 мая 2026 dall-e-3 и dall-e-2 пропали из API. Существующие интеграции перестали работать, требуется миграция на gpt-image-2 или gpt-image-1.5. Уже сгенерированные картинки можно использовать коммерчески — удалили доступ к новой генерации, не контент. Причина смены — GPT Image 1.5 в 4 раза быстрее и на 20% дешевле, а текст внутри картинки точнее: 87% против 37% у legacy DALL-E 3.
Что нового в GPT Image 2 и 1.5
GPT Image 2 (21 апреля 2026) — по гайду MindWired: ~99% точности символов на латинице, CJK, хинди, бенгали; Thinking Mode (reasoning и веб-поиск перед генерацией); multi-turn edit без побочных эффектов; до 100+ объектов на сцене связно; стабильность стиля по фотореализму, иллюстрации, 3D, аниме; лидерство в Image Arena +242 пункта над конкурентами.
GPT Image 1.5 (16 декабря 2025) — по обзору Fello AI и гайду Evolink: скорость в 4 раза выше GPT Image 1; точный текст внутри картинок; точечная правка с маской без потери лица и фона; три уровня качества (Low / Medium / High); три разрешения (1024×1024, 1024×1536, 1536×1024).
Доступ через ChatGPT
ChatGPT остаётся главной точкой входа для большинства задач. Картинки доступны на всех тарифах, разница — в лимитах, скорости и доступе к Thinking Mode.
| Тариф | Цена | Картинок в сутки | Режим |
|---|---|---|---|
| Free | $0 | ~3 | только Instant Mode |
| Go | $8/мес | ~30 | Instant Mode |
| Plus | $20/мес | ~200 | Instant + Thinking Mode |
| Pro | $200/мес | без ограничений | Instant + Thinking Mode, приоритет |
Plus и rolling window
По гайду AI Video Bootcamp, на Plus работает rolling window: примерно 50 генераций на каждое окно в 3 часа (около 160 сообщений всего в окне, одна генерация = одно сообщение). Слот восстанавливается ровно через 3 часа после использования, не общим сбросом в полночь. На практике это до ~200 картинок в сутки при равномерном использовании. Эффективная стоимость — меньше $0.01 за картинку, что сопоставимо с API уровня Low.
Что недоступно даже на Pro
- Одна картинка за запрос — без батч-генерации как у Midjourney.
- Без cross-session consistency персонажей без обучения LoRA.
- Без NSFW — фильтр без обхода.
- Без видео — Sora окончательно выключена в марте 2026, OpenAI временно ушёл из видеогенерации.
Доступ через API
Здесь архитектура — поштучная оплата по токенам. Цена зависит от модели, качества (Low / Medium / High) и разрешения (1024×1024 квадрат, 1024×1536 портрет, 1536×1024 landscape).
| Модель | Low | Medium | High |
|---|---|---|---|
| GPT Image 2 | ~$0.006 | ~$0.053 | ~$0.211 |
| GPT Image 1.5 | ~$0.009 | ~$0.04 | ~$0.20 |
| GPT Image 1 Mini | ~$0.005 | ~$0.02 | ~$0.052 |
| GPT Image 1 (deprecating Oct 2026) | ~$0.011 | ~$0.07 | ~$0.25 |
Источники цен — официальная страница API OpenAI и сводка AI Free API.
Несквадратные ориентации (портрет и landscape) дороже пропорционально числу пикселей. Стартовый rate limit — 5 изображений в минуту для новых аккаунтов, выше — после прогрева usage tier.
Для интеграции в продукт и автоматизации больших объёмов API имеет смысл, под малые объёмы (несколько сотен картинок в месяц) выгоднее ChatGPT Plus. Для десятков тысяч картинок в месяц GPT Image 1 Mini на уровне Low — самый дешёвый вариант в линейке. Корпоративный доступ возможен через Microsoft Azure / Foundry.
Бесплатные витрины OpenAI: Bing и Copilot
Microsoft встроил линейку OpenAI Image в свои продукты ещё на этапе DALL-E 3, после замены на GPT Image 1.5 функциональность сохранилась.
- Bing Image Creator (
bing.com/create) — самый щедрый бесплатный лимит среди официальных каналов: ~15 «бустов» в день, по 4 картинки за запрос. Из РФ — VPN + Microsoft Account. - Microsoft Copilot (
copilot.microsoft.com) — встроен в Windows 11 и Edge, ~15 картинок в сутки. Из РФ — VPN. - ChatGPT Free на
chatgpt.com— около 3 картинок в сутки в Instant Mode, без Thinking Mode.
Все три канала рисуют той же моделью GPT Image, что и платный ChatGPT — отличается только лимит, скорость и приоритет на пиках.
Что GPT Image умеет
- Генерация в диалоге. Не отдельный инструмент — рисует прямо в чате ChatGPT. «Нарисуй» → «измени фон» → получаете обновлённую версию с тем же предметом без потери контекста.
- Серии в одной беседе. Можно строить связанные изображения — единый стиль для шапки, обложки и баннера одного материала. В GPT Image 2 при правке одного элемента остальные не съезжают.
- Точный текст на картинке. Главный козырь линейки: GPT Image 2 заявляет ~99% точности символов на латинице, кириллице и иероглифических алфавитах. Под рекламу, обложки, инфографику, мокапы интерфейсов.
- Высокое разрешение. До 1024×1792 и 1536×1024 в стандартных режимах. Портретная и landscape ориентации.
- Стилизация. Десятки стилей: фотореализм, акварель, масло, 3D-рендер, пиксель-арт, иллюстрация, минимализм. Стиль задаётся обычным языком, в том числе русским.
- Edit-режим с маской. Загрузить картинку, отметить область, описать что заменить. В GPT Image 2 multi-turn edit стабильнее — серия правок не копит артефактов.
- Thinking Mode (только GPT Image 2, на Plus и Pro). Модель может поискать в вебе и спланировать композицию перед генерацией. Полезно для сложных сцен с многими объектами или когда нужен фактический контекст (актуальный логотип, форма иконки).
Доступ из России
ChatGPT и GPT Image не работают из РФ напрямую — нужен VPN с зарубежным IP, плюс оплата через Stripe (российские карты не проходят). Free работает через VPN с регистрацией по email; Go / Plus / Pro / API — VPN + зарубежная карта или посредник. Альтернативы без барьеров — Шедеврум, Kandinsky, Алиса картинки, DeepSeek.
Способы оплатить ChatGPT Plus из РФ
Прямой оплаты с российской карты нет — Stripe отбивает любой BIN российского банка. Рабочих обходов в 2026 пять:
- Зарубежная карта — дебетовая или кредитная карта банка в Казахстане, Кыргызстане, Узбекистане, Турции, Сербии, Грузии. Самый надёжный путь, оплата проходит как обычная подписка.
- Виртуальная карта от посредника — российские сервисы выпускают виртуалку зарубежного банка под комиссию ~5-10%. Подходит под разовую подписку.
- Покупка готового аккаунта — Plus-аккаунты с месячным или годовым доступом. Цена ~1.5x от официальной, риск блокировки при нарушении ToS OpenAI и риск для конфиденциальных данных.
- Корпоративный счёт через зарубежное юрлицо — Plus оформляется на корпоративную карту ИП / ООО в Казахстане, Армении, Сербии. Удобно для команды и отчётности.
- Российские агрегаторы — StudyAI, MashaGPT, Syntx AI держат прокси к OpenAI и продают доступ за рубли (от 490 до 19990 ₽/мес). Минус: промпты и история чатов идут через третьего посредника.
Под разовую задачу — посредник или виртуалка. Под регулярную работу — зарубежная карта или корпоративный счёт.
Что с персональными данными и 152-ФЗ
OpenAI — компания США, серверы в США и Европе. Любые данные в промптах уходят за рубеж и обрабатываются на иностранной инфраструктуре. По 152-ФЗ это трансграничная передача персональных данных — для российских пользователей разрешена только при явном согласии субъекта ПДн. Практический вывод:
- Можно в промптах: общие сцены, абстрактные описания, обезличенные товары, маркетинговые концепты без узнаваемых людей.
- Нельзя в промптах: фото реальных сотрудников, клиентские базы, ФИО + контакт, медицинские диагнозы, банковская тайна, паспортные данные, селфи коллег.
- Под вопросом: лицо публичного лица (звезда, политик) — формально ПДн, но обычно покрыто публичным интересом; в РФ практика противоречивая, лучше получать согласие.
Для B2B-задач с реальными данными работайте через Алису, Шедеврум, Kandinsky — серверы в РФ, ПДн не покидают периметр.
Для нашей аудитории
- С VPN и зарубежной картой — Plus за $20/мес покрывает повседневные задачи; эффективная стоимость меньше $0.01 за картинку.
- Маркетологу — баннеры с корректным русским текстом под VK Ads и Telegram, точные подписи / ценники / плашки без правки в Photoshop. Thinking Mode держит логику серии креативов под одну кампанию.
- SMM-специалисту — обложки с надписями, инфографика, серии из 5-10 связанных постов стабильны по стилю в одной беседе. Multi-turn edit — для отрисовки одного объекта в разных позах.
- Дизайнеру и иллюстратору — быстрые мокапы, варианты композиции, mood-board. Тонкий контроль слабее Stable Diffusion, но генерация идей и черновиков — быстрее.
- Без VPN и оплаты — российские альтернативы. Kandinsky 6.0 сейчас догнал GPT Image на задачах с русским текстом. Шедеврум — бесплатный.
Как пользоваться — пошагово
- Зайти на chatgpt.com (через VPN из РФ), авторизоваться (email / Google / Apple ID).
- Написать в чате «Нарисуй [описание]» — на Free получите картинку в Instant Mode (~3/день), на Plus / Pro работает Thinking Mode для сложных сцен.
- Уточнять прямо в диалоге: «увеличь предмет в центре», «измени фон на закат», «добавь надпись «SALE» в правом верхнем углу».
- Для точечной правки — загрузить картинку, выделить область маской, описать что заменить.
Что писать в промте: сначала сцена («фотореализм, кофейня утром»), затем предмет («синяя чашка и круассан»), текст в кавычках («SALE 20%» на красной плашке), стиль и формат («вертикаль 1024×1536, плёночный гран»). Модель понимает русский, переводить не нужно.
Формула промпта и примеры
Рабочая формула, которая закрывает 80% задач — четыре блока в одном предложении или абзаце:
[Сцена / окружение] + [Предмет / герой] + [Текст в кавычках] + [Стиль и формат]
Можно менять порядок, но все четыре блока должны быть. Чем точнее каждый, тем меньше итераций и меньше «творческой импровизации» модели на ровном месте.
5 готовых промптов
1. Фотореалистичный портрет. «Студийный портрет женщины 30 лет, тёплое мягкое освещение слева, светло-серый фон, объектив 85mm f/1.4, плёночное зерно, формат портрет 1024×1536.»
2. Иллюстрация к статье в блог. «Минималистичная векторная иллюстрация: ноутбук на столе, экран показывает диалог с ИИ, пастельные цвета (бежевый, мятный, розовый), плоский стиль без теней, формат landscape 1536×1024.»
3. Рекламный баннер с надписью. «Баннер кофейни на красном фоне, в центре крупная надпись «Скидка 30%» белым шрифтом sans-serif, ниже мелким — «только сегодня», справа фотореалистичная чашка капучино, формат квадрат 1024×1024.»
4. Продуктовое фото для маркетплейса. «Косметическая баночка крема на белом фоне, мягкое студийное освещение сверху, лёгкая тень, отражение на глянцевой поверхности, фотореализм, формат квадрат 1024×1024.»
5. Стикер для Telegram-канала. «Кот-программист в очках перед ноутбуком, плоский стиль иллюстрации, прозрачный фон, толстая чёрная обводка, насыщенные цвета, формат квадрат.»
Что задаёт стиль
- Тип источника: «фотография», «иллюстрация», «3D-рендер», «акварель», «масло», «карандашный набросок», «пиксель-арт».
- Камера и объектив для фотореализма: «Canon 85mm f/1.4», «широкоугольный 24mm», «макро 100mm».
- Освещение: «золотой час», «мягкий рассеянный», «контрастный боковой», «студийное», «лунный».
- Палитра: «тёплая пастель», «холодные сине-фиолетовые», «монохром», «насыщенные неоновые».
- Композиция: «крупный план», «общий план», «правило третей», «симметрично по центру».
- Формат: 1024×1024 (квадрат для соцсетей), 1024×1536 (портрет для Stories / обложек), 1536×1024 (landscape для статей и баннеров).
Кириллица в тексте на картинке
Это слабое место всех генераторов до GPT Image 1.5 и до сих пор болезненная тема в массе моделей. У GPT Image 2 заявлено ~99% точности на кириллице, на практике:
- Хорошо работают: короткие слова (1-2 слова, до ~12 букв), заглавные буквы, простые шрифты типа sans-serif на чистом фоне.
- Хуже работают: длинные фразы (>5 слов), курсив, рукописные стили, перенос строк.
- Совсем плохо: сложные слова с буквами «ы», «ъ», «ё» в редких позициях; модель иногда «галлюцинирует» латинизированный аналог.
Лайфхак под текст в макете: генерировать картинку без текста, потом добавить надпись в Figma / Canva / Photoshop. Получается надёжнее и быстрее правится. Если без надписи никак — пишите слово в кавычках в промпте и проверяйте каждую генерацию.
Частые ошибки в промптах
- Перегруз противоречивыми деталями. «Минималистично, но с обилием декора» — модель выберет случайный полюс.
- Игнор формата. Если не указать ориентацию, получите квадрат — для Stories и обложек YouTube это значит ручную обрезку.
- Слишком абстрактные стили. «Красиво», «современно», «модно» — пустые слова, замените на конкретный референс («стиль обложки Wired», «как у Behance в 2024»).
- Сложные групповые сцены. Больше 5-6 героев в кадре — лица начнут плыть. Лучше разбить на серию из 2-3 крупных планов.
- Дублирование объекта. «Кот с котом смотрят на кота» — модель путается, лица сливаются. Описывайте героев по очереди с явной композицией.
Сильные и слабые стороны
Плюсы: ~99% точности текста (латиница, кириллица, CJK), conversational-режим прямо в чате, контекстная память, multi-turn edit без побочных эффектов, Thinking Mode на Plus и Pro, включён в подписку ChatGPT Plus за $20/мес, до 100+ объектов на сцене связно в GPT Image 2, скорость 1.5 в 4 раза выше предыдущей версии.
Минусы: нужен VPN из РФ, оплата только через Stripe (российские карты не проходят), Free жёсткий (~3 картинки/сутки), одна картинка за запрос (без батча), фотореализм портретов слабее Midjourney, нет тонкого контроля как у Stable Diffusion (ControlNet, LoRA), нет cross-session consistency персонажей без LoRA, API на уровне High дороже многих альтернатив, видеогенерация недоступна (Sora выключена в марте 2026).
DALL-E / GPT Image vs альтернативы
vs Midjourney
Midjourney — лидер фотореализма и художественной подачи. GPT Image — лучше в тексте на изображении и в conversational-режиме (генерация в диалоге). По цене Plus совпадает с Midjourney Basic. Многие держат оба — Midjourney под визуал, GPT Image под текст на картинке и быструю правку в чате.
vs Nano Banana 2
Nano Banana 2 от Google — главный конкурент в семействе Gemini. Разрешение до 4K, стилевая стабильность лучше на сериях, цена API ниже в премиум-сегменте. GPT Image 2 лидирует в Image Arena по conversational-режиму и в тексте на изображении. Выбор зависит от задачи: 4K-баннер — Nano Banana, точный русский текст в рекламном креативе — GPT Image.
vs Flux
Flux от Black Forest Labs — open-source семейство (Flux Pro / Dev / Schnell). Силён в фотореализме и анатомии, дешевле в API (~$0.03 за картинку). По работе с текстом на изображении и conversational-режиму GPT Image впереди, по доступности через open-source и локальной генерации — Flux. Для разовых задач GPT Image удобнее, для продакшна без API-зависимости — Flux Schnell локально.
vs Kandinsky 6.0 и Шедеврум
Kandinsky и Шедеврум — бесплатно, без VPN, на русском. По редактированию и тексту на картинке Kandinsky 6.0 догоняет GPT Image, Шедеврум сопоставим в простых задачах (SMM, иллюстрации к Дзену), в сложных сценах GPT Image впереди.
vs Stable Diffusion
Stable Diffusion — локальная генерация, бесплатно, безлимит, тонкий контроль через ControlNet, LoRA, custom checkpoint. Порог входа выше: нужна видеокарта от 8 ГБ VRAM и время на настройку. Для разовых задач GPT Image удобнее, для продакшна с массовой генерацией под бренд — Stable Diffusion дешевле и гибче.
Use-cases по ролям
- Реклама и креативы. Маркетинговые баннеры с точным русским текстом — основной use-case GPT Image 2 для российских команд. Серия креативов под одну кампанию сохраняет стиль в рамках одной беседы: меняется только фон, плашка или копия. Под VK Ads и Telegram Ads тексты не нужно дорисовывать в Figma.
- Блог и SMM. Обложки статей, превью для соцсетей. Multi-turn edit удобен для серий — «теперь сделай ту же сцену для поста», стиль и герой сохраняются.
- Карточки маркетплейсов. Товары на белом фоне, lifestyle-фото, инфографика «3 преимущества» с надписями. Баннер с цифрами и иконками — за один промпт.
- Концепт-арт и моки. Книжные обложки, постеры, мокапы интерфейсов. Thinking Mode даёт прирост качества на сложных сценах.
- Иконки и стикеры. Telegram-стикеры, иконки приложений, эмодзи-сеты. В одной беседе можно попросить «нарисуй 10 эмоций того же персонажа» — лицо и пропорции стабильны.
- Образование и презентации. Иллюстрации к учебным материалам, схемы, инфографика — с точным русским текстом из чата.
FAQ
DALL-E 3 ещё работает в 2026?
Нет. dall-e-3 и dall-e-2 удалены из API 12 мая 2026. В ChatGPT с конца 2025 работают GPT Image 1.5 и 2. Раньше сгенерированные картинки можно использовать коммерчески — OpenAI отключил доступ к новой генерации, не отозвал лицензии на ранее созданный контент.
Что такое GPT Image? Семейство моделей OpenAI для картинок, встроенное в архитектуру GPT-5. Заменило DALL-E. Генерация прямо в диалоге, autoregressive-архитектура вместо diffusion. Под капотом — та же модель, что отвечает на текстовые сообщения; именно поэтому работает контекстная память и multi-turn edit.
Чем GPT Image 2 отличается от 1.5? GPT Image 2 — флагман с 21 апреля 2026: ~99% точности текста, Thinking Mode, multi-turn edit без побочных эффектов, до 100+ объектов на сцене. GPT Image 1.5 быстрее GPT Image 1 и сильна по тексту, но без Thinking Mode.
Сколько стоит? ChatGPT: Free $0 (~3/день), Go $8/мес (~30), Plus $20/мес (~200), Pro $200/мес (без ограничений). API на GPT Image 2: ~$0.006 Low, ~$0.053 Medium, ~$0.211 High за 1024×1024. GPT Image 1 Mini — самый дешёвый ($0.005-$0.052).
Можно ли бесплатно? Да, тремя путями: ChatGPT Free (~3 картинки/сутки в Instant Mode), Bing Image Creator (~15 «бустов» в день, по 4 картинки), Microsoft Copilot (~15 картинок/сутки). Все три — через VPN из РФ. Thinking Mode и приоритет рендеринга на бесплатных каналах недоступны.
Можно ли оплатить из России? Прямой оплатой нельзя — Stripe не принимает российские карты. Работают пять обходов: зарубежная карта, виртуалка от посредника, готовый аккаунт, корпоративный счёт зарубежного юрлица, российские агрегаторы вроде StudyAI / MashaGPT. Подробности в разделе про доступ из РФ выше.
DALL-E или Midjourney? Midjourney лучше в фотореализме и художественной подаче. GPT Image — в тексте на картинке и conversational-режиме. Многие используют оба: Midjourney под визуал-первое, GPT Image — под рекламные баннеры с надписями и под быструю правку в чате.
Можно ли коммерчески использовать? Да, на любом платном тарифе и через API. На Free допустимо для личных задач, коммерческое использование уточнять по актуальной политике OpenAI. Все права на сгенерированные картинки переходят пользователю — без лицензионных отчислений OpenAI.
Что выбрать без VPN? Kandinsky 6.0, Шедеврум, Алиса картинки — бесплатно, на русском, без VPN. Под рекламные материалы с русским текстом — Kandinsky 6.0.
Какие лимиты у Free, Plus, Pro? Free: примерно 3 картинки в сутки в Instant Mode. Plus: rolling window 50 картинок на каждые 3 часа (~200 в сутки при равномерной нагрузке), Thinking Mode доступен. Pro: без жёстких ограничений, приоритет на пиках. Лимиты меняются — OpenAI корректирует их по мере роста нагрузки.
Обучает ли OpenAI модель на моих изображениях? По стандартным условиям ChatGPT — да, кроме случаев, когда вы вручную отключили обучение в настройках приватности. Для API по умолчанию — нет, данные не используются для обучения. Для бизнес-тарифов ChatGPT Business / Enterprise — тоже нет, это часть SLA.
Работает ли русский текст в промпте? Да. Модель понимает русский напрямую, переводить промпт на английский не нужно. Качество результата сопоставимо. Внутренне ChatGPT всё равно расширяет ваш короткий русский промпт в развёрнутую инструкцию для модели — это работает прозрачно для пользователя.
Можно ли загрузить свою картинку и попросить изменить? Да, edit-режим работает на Plus и Pro: загружаете изображение, выделяете область маской или просто описываете правку текстом. GPT Image 2 умеет multi-turn edit — серию последовательных правок без накопления артефактов.
Что с NSFW и обходом фильтров? Никакой генерации обнажёнки, насилия, узнаваемых публичных лиц в неоднозначных сценариях, дипфейков, политически чувствительных сюжетов. Фильтр строгий, обходы блокируются. Под NSFW или максимальный контроль смотрите Stable Diffusion локально.
Дальше
Соседние модели и переходы по экосистеме: ChatGPT — текстовая часть той же подписки, Midjourney — фотореализм и художественная подача, FLUX — open-source Black Forest Labs, дешевле в API, Nano Banana 2 — Google-конкурент по 4K, Stable Diffusion — локальная генерация с ControlNet и LoRA. Без VPN — Kandinsky 6.0 и Шедеврум.
Читайте также
- Story Yard: $1M ghostwriting-агентство Алекса Либермана — $84K/мес
- $4,5M/год на Shopify-приложениях без рекламы — Эрикос — $375K/мес
- Midjourney бесплатно: есть ли free trial в 2026 и реальные альтернативы
- Recraft: нейросеть для векторной графики и брендинга, обзор 2026
- Hailuo (MiniMax): обзор китайской нейросети для видео в 2026
- Stella: $340K в месяц на приложении аффирмаций — $340K/мес
- Early: $50K/мес на будильнике с отжиманиями — $50K/мес