Блог обзор

DALL-E и GPT Image — нейросеть OpenAI для картинок

DALL-E — известное название генератора изображений от OpenAI. К июню 2026 линейка перестроена: DALL-E 2 и DALL-E 3 удалены из API 12 мая 2026, на смену пришли модели семейства GPT Image — встроены прямо в архитектуру GPT-5. Текущий флагман — GPT Image 2 (выпущен 21 апреля 2026, API с начала мая), прошлый — GPT Image 1.5 (16 декабря 2025). Источники: официальная страница API OpenAI, гайд по GPT Image 2 от MindWired, сводка ChatGPT Plus от AI Video Bootcamp.

Главное отличие GPT Image от классического DALL-E — картинки рисуются прямо в диалоге: пишете «нарисуй X», получаете изображение в той же беседе с ChatGPT, можно сразу сказать «измени фон» или «убери надпись» — модель помнит контекст и точечно правит только нужный фрагмент, не перерисовывая всё заново.

История линейки: от DALL-E 1 до GPT Image 2

OpenAI запустил генерацию изображений в 2021. За пять лет архитектура поменялась дважды — сначала diffusion, потом autoregressive внутри GPT-5. «DALL-E» в 2026 — уже не отдельная модель, а народное имя для всей линейки.

  • DALL-E 1 (январь 2021) — 12-млрд-параметрная вариация GPT-3, разрешение 256×256, только демо в блоге OpenAI.
  • DALL-E 2 (апрель 2022) — diffusion поверх CLIP, разрешение 1024×1024, inpainting. Публичный доступ — сентябрь 2022. Удалена из API 12 мая 2026.
  • DALL-E 3 (октябрь 2023) — интеграция с ChatGPT, расширение промптов через GPT-4, рендеринг текста ~37% против ~5% у DALL-E 2. С августа 2024 бесплатна в ChatGPT Free. Удалена из API 12 мая 2026.
  • GPT Image 1 (апрель 2025) — autoregressive-модель, gpt-image-1 в API. Deprecating 23 октября 2026.
  • GPT Image 1.5 (16 декабря 2025) — в 4 раза быстрее GPT Image 1, цена API ниже ~20%, точный текст 87%.
  • GPT Image 2 (21 апреля 2026) — флагман. Thinking Mode, multi-turn edit, точный текст ~99%, до 100+ объектов на сцене.

Картинки, сгенерированные DALL-E 2/3 до 12 мая 2026, остаются у пользователя и пригодны для коммерции — OpenAI отключил доступ к новой генерации, не отозвал лицензии на старый контент.

Текущее состояние линейки OpenAI в июне 2026

OpenAI окончательно ушёл от diffusion-моделей DALL-E к autoregressive-семейству GPT Image. Эта смена архитектуры даёт принципиально иной уровень работы с текстом на изображении и с контекстной памятью внутри диалога.

МодельНазначениеСтатус
GPT Image 2Текущий флагманактуальная, в ChatGPT и API
GPT Image 1.5Прошлый флагманактуальная, выпущена 16 декабря 2025
GPT Image 1Первая модель семействаdeprecating 23 октября 2026
GPT Image 1 MiniБюджетная для APIактуальная, самая дешёвая
DALL-E 3Прошлое поколениеудалена из API 12 мая 2026
DALL-E 2Legacyудалена из API 12 мая 2026

В пользовательских интерфейсах ChatGPT и приложениях везде уже работает GPT Image 1.5 или GPT Image 2. Название «DALL-E» сохранилось как привычное имя для всей продуктовой линейки и активно используется в поиске.

Что произошло с DALL-E 3

По гайду Skywork AI: 14 ноября 2025 OpenAI уведомил разработчиков, 12 мая 2026 dall-e-3 и dall-e-2 пропали из API. Существующие интеграции перестали работать, требуется миграция на gpt-image-2 или gpt-image-1.5. Уже сгенерированные картинки можно использовать коммерчески — удалили доступ к новой генерации, не контент. Причина смены — GPT Image 1.5 в 4 раза быстрее и на 20% дешевле, а текст внутри картинки точнее: 87% против 37% у legacy DALL-E 3.

Что нового в GPT Image 2 и 1.5

GPT Image 2 (21 апреля 2026) — по гайду MindWired: ~99% точности символов на латинице, CJK, хинди, бенгали; Thinking Mode (reasoning и веб-поиск перед генерацией); multi-turn edit без побочных эффектов; до 100+ объектов на сцене связно; стабильность стиля по фотореализму, иллюстрации, 3D, аниме; лидерство в Image Arena +242 пункта над конкурентами.

GPT Image 1.5 (16 декабря 2025) — по обзору Fello AI и гайду Evolink: скорость в 4 раза выше GPT Image 1; точный текст внутри картинок; точечная правка с маской без потери лица и фона; три уровня качества (Low / Medium / High); три разрешения (1024×1024, 1024×1536, 1536×1024).

Доступ через ChatGPT

ChatGPT остаётся главной точкой входа для большинства задач. Картинки доступны на всех тарифах, разница — в лимитах, скорости и доступе к Thinking Mode.

ТарифЦенаКартинок в суткиРежим
Free$0~3только Instant Mode
Go$8/мес~30Instant Mode
Plus$20/мес~200Instant + Thinking Mode
Pro$200/месбез ограниченийInstant + Thinking Mode, приоритет

Plus и rolling window

По гайду AI Video Bootcamp, на Plus работает rolling window: примерно 50 генераций на каждое окно в 3 часа (около 160 сообщений всего в окне, одна генерация = одно сообщение). Слот восстанавливается ровно через 3 часа после использования, не общим сбросом в полночь. На практике это до ~200 картинок в сутки при равномерном использовании. Эффективная стоимость — меньше $0.01 за картинку, что сопоставимо с API уровня Low.

Что недоступно даже на Pro

  • Одна картинка за запрос — без батч-генерации как у Midjourney.
  • Без cross-session consistency персонажей без обучения LoRA.
  • Без NSFW — фильтр без обхода.
  • Без видео — Sora окончательно выключена в марте 2026, OpenAI временно ушёл из видеогенерации.

Доступ через API

Здесь архитектура — поштучная оплата по токенам. Цена зависит от модели, качества (Low / Medium / High) и разрешения (1024×1024 квадрат, 1024×1536 портрет, 1536×1024 landscape).

МодельLowMediumHigh
GPT Image 2~$0.006~$0.053~$0.211
GPT Image 1.5~$0.009~$0.04~$0.20
GPT Image 1 Mini~$0.005~$0.02~$0.052
GPT Image 1 (deprecating Oct 2026)~$0.011~$0.07~$0.25

Источники цен — официальная страница API OpenAI и сводка AI Free API.

Несквадратные ориентации (портрет и landscape) дороже пропорционально числу пикселей. Стартовый rate limit — 5 изображений в минуту для новых аккаунтов, выше — после прогрева usage tier.

Для интеграции в продукт и автоматизации больших объёмов API имеет смысл, под малые объёмы (несколько сотен картинок в месяц) выгоднее ChatGPT Plus. Для десятков тысяч картинок в месяц GPT Image 1 Mini на уровне Low — самый дешёвый вариант в линейке. Корпоративный доступ возможен через Microsoft Azure / Foundry.

Бесплатные витрины OpenAI: Bing и Copilot

Microsoft встроил линейку OpenAI Image в свои продукты ещё на этапе DALL-E 3, после замены на GPT Image 1.5 функциональность сохранилась.

  • Bing Image Creator (bing.com/create) — самый щедрый бесплатный лимит среди официальных каналов: ~15 «бустов» в день, по 4 картинки за запрос. Из РФ — VPN + Microsoft Account.
  • Microsoft Copilot (copilot.microsoft.com) — встроен в Windows 11 и Edge, ~15 картинок в сутки. Из РФ — VPN.
  • ChatGPT Free на chatgpt.com — около 3 картинок в сутки в Instant Mode, без Thinking Mode.

Все три канала рисуют той же моделью GPT Image, что и платный ChatGPT — отличается только лимит, скорость и приоритет на пиках.

Что GPT Image умеет

  • Генерация в диалоге. Не отдельный инструмент — рисует прямо в чате ChatGPT. «Нарисуй» → «измени фон» → получаете обновлённую версию с тем же предметом без потери контекста.
  • Серии в одной беседе. Можно строить связанные изображения — единый стиль для шапки, обложки и баннера одного материала. В GPT Image 2 при правке одного элемента остальные не съезжают.
  • Точный текст на картинке. Главный козырь линейки: GPT Image 2 заявляет ~99% точности символов на латинице, кириллице и иероглифических алфавитах. Под рекламу, обложки, инфографику, мокапы интерфейсов.
  • Высокое разрешение. До 1024×1792 и 1536×1024 в стандартных режимах. Портретная и landscape ориентации.
  • Стилизация. Десятки стилей: фотореализм, акварель, масло, 3D-рендер, пиксель-арт, иллюстрация, минимализм. Стиль задаётся обычным языком, в том числе русским.
  • Edit-режим с маской. Загрузить картинку, отметить область, описать что заменить. В GPT Image 2 multi-turn edit стабильнее — серия правок не копит артефактов.
  • Thinking Mode (только GPT Image 2, на Plus и Pro). Модель может поискать в вебе и спланировать композицию перед генерацией. Полезно для сложных сцен с многими объектами или когда нужен фактический контекст (актуальный логотип, форма иконки).

Доступ из России

ChatGPT и GPT Image не работают из РФ напрямую — нужен VPN с зарубежным IP, плюс оплата через Stripe (российские карты не проходят). Free работает через VPN с регистрацией по email; Go / Plus / Pro / API — VPN + зарубежная карта или посредник. Альтернативы без барьеров — Шедеврум, Kandinsky, Алиса картинки, DeepSeek.

Способы оплатить ChatGPT Plus из РФ

Прямой оплаты с российской карты нет — Stripe отбивает любой BIN российского банка. Рабочих обходов в 2026 пять:

  1. Зарубежная карта — дебетовая или кредитная карта банка в Казахстане, Кыргызстане, Узбекистане, Турции, Сербии, Грузии. Самый надёжный путь, оплата проходит как обычная подписка.
  2. Виртуальная карта от посредника — российские сервисы выпускают виртуалку зарубежного банка под комиссию ~5-10%. Подходит под разовую подписку.
  3. Покупка готового аккаунта — Plus-аккаунты с месячным или годовым доступом. Цена ~1.5x от официальной, риск блокировки при нарушении ToS OpenAI и риск для конфиденциальных данных.
  4. Корпоративный счёт через зарубежное юрлицо — Plus оформляется на корпоративную карту ИП / ООО в Казахстане, Армении, Сербии. Удобно для команды и отчётности.
  5. Российские агрегаторы — StudyAI, MashaGPT, Syntx AI держат прокси к OpenAI и продают доступ за рубли (от 490 до 19990 ₽/мес). Минус: промпты и история чатов идут через третьего посредника.

Под разовую задачу — посредник или виртуалка. Под регулярную работу — зарубежная карта или корпоративный счёт.

Что с персональными данными и 152-ФЗ

OpenAI — компания США, серверы в США и Европе. Любые данные в промптах уходят за рубеж и обрабатываются на иностранной инфраструктуре. По 152-ФЗ это трансграничная передача персональных данных — для российских пользователей разрешена только при явном согласии субъекта ПДн. Практический вывод:

  • Можно в промптах: общие сцены, абстрактные описания, обезличенные товары, маркетинговые концепты без узнаваемых людей.
  • Нельзя в промптах: фото реальных сотрудников, клиентские базы, ФИО + контакт, медицинские диагнозы, банковская тайна, паспортные данные, селфи коллег.
  • Под вопросом: лицо публичного лица (звезда, политик) — формально ПДн, но обычно покрыто публичным интересом; в РФ практика противоречивая, лучше получать согласие.

Для B2B-задач с реальными данными работайте через Алису, Шедеврум, Kandinsky — серверы в РФ, ПДн не покидают периметр.

Для нашей аудитории

  • С VPN и зарубежной картой — Plus за $20/мес покрывает повседневные задачи; эффективная стоимость меньше $0.01 за картинку.
  • Маркетологу — баннеры с корректным русским текстом под VK Ads и Telegram, точные подписи / ценники / плашки без правки в Photoshop. Thinking Mode держит логику серии креативов под одну кампанию.
  • SMM-специалисту — обложки с надписями, инфографика, серии из 5-10 связанных постов стабильны по стилю в одной беседе. Multi-turn edit — для отрисовки одного объекта в разных позах.
  • Дизайнеру и иллюстратору — быстрые мокапы, варианты композиции, mood-board. Тонкий контроль слабее Stable Diffusion, но генерация идей и черновиков — быстрее.
  • Без VPN и оплаты — российские альтернативы. Kandinsky 6.0 сейчас догнал GPT Image на задачах с русским текстом. Шедеврум — бесплатный.

Как пользоваться — пошагово

  1. Зайти на chatgpt.com (через VPN из РФ), авторизоваться (email / Google / Apple ID).
  2. Написать в чате «Нарисуй [описание]» — на Free получите картинку в Instant Mode (~3/день), на Plus / Pro работает Thinking Mode для сложных сцен.
  3. Уточнять прямо в диалоге: «увеличь предмет в центре», «измени фон на закат», «добавь надпись «SALE» в правом верхнем углу».
  4. Для точечной правки — загрузить картинку, выделить область маской, описать что заменить.

Что писать в промте: сначала сцена («фотореализм, кофейня утром»), затем предмет («синяя чашка и круассан»), текст в кавычках («SALE 20%» на красной плашке), стиль и формат («вертикаль 1024×1536, плёночный гран»). Модель понимает русский, переводить не нужно.

Формула промпта и примеры

Рабочая формула, которая закрывает 80% задач — четыре блока в одном предложении или абзаце:

[Сцена / окружение] + [Предмет / герой] + [Текст в кавычках] + [Стиль и формат]

Можно менять порядок, но все четыре блока должны быть. Чем точнее каждый, тем меньше итераций и меньше «творческой импровизации» модели на ровном месте.

5 готовых промптов

1. Фотореалистичный портрет. «Студийный портрет женщины 30 лет, тёплое мягкое освещение слева, светло-серый фон, объектив 85mm f/1.4, плёночное зерно, формат портрет 1024×1536.»

2. Иллюстрация к статье в блог. «Минималистичная векторная иллюстрация: ноутбук на столе, экран показывает диалог с ИИ, пастельные цвета (бежевый, мятный, розовый), плоский стиль без теней, формат landscape 1536×1024.»

3. Рекламный баннер с надписью. «Баннер кофейни на красном фоне, в центре крупная надпись «Скидка 30%» белым шрифтом sans-serif, ниже мелким — «только сегодня», справа фотореалистичная чашка капучино, формат квадрат 1024×1024.»

4. Продуктовое фото для маркетплейса. «Косметическая баночка крема на белом фоне, мягкое студийное освещение сверху, лёгкая тень, отражение на глянцевой поверхности, фотореализм, формат квадрат 1024×1024.»

5. Стикер для Telegram-канала. «Кот-программист в очках перед ноутбуком, плоский стиль иллюстрации, прозрачный фон, толстая чёрная обводка, насыщенные цвета, формат квадрат.»

Что задаёт стиль

  • Тип источника: «фотография», «иллюстрация», «3D-рендер», «акварель», «масло», «карандашный набросок», «пиксель-арт».
  • Камера и объектив для фотореализма: «Canon 85mm f/1.4», «широкоугольный 24mm», «макро 100mm».
  • Освещение: «золотой час», «мягкий рассеянный», «контрастный боковой», «студийное», «лунный».
  • Палитра: «тёплая пастель», «холодные сине-фиолетовые», «монохром», «насыщенные неоновые».
  • Композиция: «крупный план», «общий план», «правило третей», «симметрично по центру».
  • Формат: 1024×1024 (квадрат для соцсетей), 1024×1536 (портрет для Stories / обложек), 1536×1024 (landscape для статей и баннеров).

Кириллица в тексте на картинке

Это слабое место всех генераторов до GPT Image 1.5 и до сих пор болезненная тема в массе моделей. У GPT Image 2 заявлено ~99% точности на кириллице, на практике:

  • Хорошо работают: короткие слова (1-2 слова, до ~12 букв), заглавные буквы, простые шрифты типа sans-serif на чистом фоне.
  • Хуже работают: длинные фразы (>5 слов), курсив, рукописные стили, перенос строк.
  • Совсем плохо: сложные слова с буквами «ы», «ъ», «ё» в редких позициях; модель иногда «галлюцинирует» латинизированный аналог.

Лайфхак под текст в макете: генерировать картинку без текста, потом добавить надпись в Figma / Canva / Photoshop. Получается надёжнее и быстрее правится. Если без надписи никак — пишите слово в кавычках в промпте и проверяйте каждую генерацию.

Частые ошибки в промптах

  • Перегруз противоречивыми деталями. «Минималистично, но с обилием декора» — модель выберет случайный полюс.
  • Игнор формата. Если не указать ориентацию, получите квадрат — для Stories и обложек YouTube это значит ручную обрезку.
  • Слишком абстрактные стили. «Красиво», «современно», «модно» — пустые слова, замените на конкретный референс («стиль обложки Wired», «как у Behance в 2024»).
  • Сложные групповые сцены. Больше 5-6 героев в кадре — лица начнут плыть. Лучше разбить на серию из 2-3 крупных планов.
  • Дублирование объекта. «Кот с котом смотрят на кота» — модель путается, лица сливаются. Описывайте героев по очереди с явной композицией.

Сильные и слабые стороны

Плюсы: ~99% точности текста (латиница, кириллица, CJK), conversational-режим прямо в чате, контекстная память, multi-turn edit без побочных эффектов, Thinking Mode на Plus и Pro, включён в подписку ChatGPT Plus за $20/мес, до 100+ объектов на сцене связно в GPT Image 2, скорость 1.5 в 4 раза выше предыдущей версии.

Минусы: нужен VPN из РФ, оплата только через Stripe (российские карты не проходят), Free жёсткий (~3 картинки/сутки), одна картинка за запрос (без батча), фотореализм портретов слабее Midjourney, нет тонкого контроля как у Stable Diffusion (ControlNet, LoRA), нет cross-session consistency персонажей без LoRA, API на уровне High дороже многих альтернатив, видеогенерация недоступна (Sora выключена в марте 2026).

DALL-E / GPT Image vs альтернативы

vs Midjourney

Midjourney — лидер фотореализма и художественной подачи. GPT Image — лучше в тексте на изображении и в conversational-режиме (генерация в диалоге). По цене Plus совпадает с Midjourney Basic. Многие держат оба — Midjourney под визуал, GPT Image под текст на картинке и быструю правку в чате.

vs Nano Banana 2

Nano Banana 2 от Google — главный конкурент в семействе Gemini. Разрешение до 4K, стилевая стабильность лучше на сериях, цена API ниже в премиум-сегменте. GPT Image 2 лидирует в Image Arena по conversational-режиму и в тексте на изображении. Выбор зависит от задачи: 4K-баннер — Nano Banana, точный русский текст в рекламном креативе — GPT Image.

vs Flux

Flux от Black Forest Labs — open-source семейство (Flux Pro / Dev / Schnell). Силён в фотореализме и анатомии, дешевле в API (~$0.03 за картинку). По работе с текстом на изображении и conversational-режиму GPT Image впереди, по доступности через open-source и локальной генерации — Flux. Для разовых задач GPT Image удобнее, для продакшна без API-зависимости — Flux Schnell локально.

vs Kandinsky 6.0 и Шедеврум

Kandinsky и Шедеврум — бесплатно, без VPN, на русском. По редактированию и тексту на картинке Kandinsky 6.0 догоняет GPT Image, Шедеврум сопоставим в простых задачах (SMM, иллюстрации к Дзену), в сложных сценах GPT Image впереди.

vs Stable Diffusion

Stable Diffusion — локальная генерация, бесплатно, безлимит, тонкий контроль через ControlNet, LoRA, custom checkpoint. Порог входа выше: нужна видеокарта от 8 ГБ VRAM и время на настройку. Для разовых задач GPT Image удобнее, для продакшна с массовой генерацией под бренд — Stable Diffusion дешевле и гибче.

Use-cases по ролям

  • Реклама и креативы. Маркетинговые баннеры с точным русским текстом — основной use-case GPT Image 2 для российских команд. Серия креативов под одну кампанию сохраняет стиль в рамках одной беседы: меняется только фон, плашка или копия. Под VK Ads и Telegram Ads тексты не нужно дорисовывать в Figma.
  • Блог и SMM. Обложки статей, превью для соцсетей. Multi-turn edit удобен для серий — «теперь сделай ту же сцену для поста», стиль и герой сохраняются.
  • Карточки маркетплейсов. Товары на белом фоне, lifestyle-фото, инфографика «3 преимущества» с надписями. Баннер с цифрами и иконками — за один промпт.
  • Концепт-арт и моки. Книжные обложки, постеры, мокапы интерфейсов. Thinking Mode даёт прирост качества на сложных сценах.
  • Иконки и стикеры. Telegram-стикеры, иконки приложений, эмодзи-сеты. В одной беседе можно попросить «нарисуй 10 эмоций того же персонажа» — лицо и пропорции стабильны.
  • Образование и презентации. Иллюстрации к учебным материалам, схемы, инфографика — с точным русским текстом из чата.

FAQ

DALL-E 3 ещё работает в 2026? Нет. dall-e-3 и dall-e-2 удалены из API 12 мая 2026. В ChatGPT с конца 2025 работают GPT Image 1.5 и 2. Раньше сгенерированные картинки можно использовать коммерчески — OpenAI отключил доступ к новой генерации, не отозвал лицензии на ранее созданный контент.

Что такое GPT Image? Семейство моделей OpenAI для картинок, встроенное в архитектуру GPT-5. Заменило DALL-E. Генерация прямо в диалоге, autoregressive-архитектура вместо diffusion. Под капотом — та же модель, что отвечает на текстовые сообщения; именно поэтому работает контекстная память и multi-turn edit.

Чем GPT Image 2 отличается от 1.5? GPT Image 2 — флагман с 21 апреля 2026: ~99% точности текста, Thinking Mode, multi-turn edit без побочных эффектов, до 100+ объектов на сцене. GPT Image 1.5 быстрее GPT Image 1 и сильна по тексту, но без Thinking Mode.

Сколько стоит? ChatGPT: Free $0 (~3/день), Go $8/мес (~30), Plus $20/мес (~200), Pro $200/мес (без ограничений). API на GPT Image 2: ~$0.006 Low, ~$0.053 Medium, ~$0.211 High за 1024×1024. GPT Image 1 Mini — самый дешёвый ($0.005-$0.052).

Можно ли бесплатно? Да, тремя путями: ChatGPT Free (~3 картинки/сутки в Instant Mode), Bing Image Creator (~15 «бустов» в день, по 4 картинки), Microsoft Copilot (~15 картинок/сутки). Все три — через VPN из РФ. Thinking Mode и приоритет рендеринга на бесплатных каналах недоступны.

Можно ли оплатить из России? Прямой оплатой нельзя — Stripe не принимает российские карты. Работают пять обходов: зарубежная карта, виртуалка от посредника, готовый аккаунт, корпоративный счёт зарубежного юрлица, российские агрегаторы вроде StudyAI / MashaGPT. Подробности в разделе про доступ из РФ выше.

DALL-E или Midjourney? Midjourney лучше в фотореализме и художественной подаче. GPT Image — в тексте на картинке и conversational-режиме. Многие используют оба: Midjourney под визуал-первое, GPT Image — под рекламные баннеры с надписями и под быструю правку в чате.

Можно ли коммерчески использовать? Да, на любом платном тарифе и через API. На Free допустимо для личных задач, коммерческое использование уточнять по актуальной политике OpenAI. Все права на сгенерированные картинки переходят пользователю — без лицензионных отчислений OpenAI.

Что выбрать без VPN? Kandinsky 6.0, Шедеврум, Алиса картинки — бесплатно, на русском, без VPN. Под рекламные материалы с русским текстом — Kandinsky 6.0.

Какие лимиты у Free, Plus, Pro? Free: примерно 3 картинки в сутки в Instant Mode. Plus: rolling window 50 картинок на каждые 3 часа (~200 в сутки при равномерной нагрузке), Thinking Mode доступен. Pro: без жёстких ограничений, приоритет на пиках. Лимиты меняются — OpenAI корректирует их по мере роста нагрузки.

Обучает ли OpenAI модель на моих изображениях? По стандартным условиям ChatGPT — да, кроме случаев, когда вы вручную отключили обучение в настройках приватности. Для API по умолчанию — нет, данные не используются для обучения. Для бизнес-тарифов ChatGPT Business / Enterprise — тоже нет, это часть SLA.

Работает ли русский текст в промпте? Да. Модель понимает русский напрямую, переводить промпт на английский не нужно. Качество результата сопоставимо. Внутренне ChatGPT всё равно расширяет ваш короткий русский промпт в развёрнутую инструкцию для модели — это работает прозрачно для пользователя.

Можно ли загрузить свою картинку и попросить изменить? Да, edit-режим работает на Plus и Pro: загружаете изображение, выделяете область маской или просто описываете правку текстом. GPT Image 2 умеет multi-turn edit — серию последовательных правок без накопления артефактов.

Что с NSFW и обходом фильтров? Никакой генерации обнажёнки, насилия, узнаваемых публичных лиц в неоднозначных сценариях, дипфейков, политически чувствительных сюжетов. Фильтр строгий, обходы блокируются. Под NSFW или максимальный контроль смотрите Stable Diffusion локально.

Дальше

Соседние модели и переходы по экосистеме: ChatGPT — текстовая часть той же подписки, Midjourney — фотореализм и художественная подача, FLUX — open-source Black Forest Labs, дешевле в API, Nano Banana 2 — Google-конкурент по 4K, Stable Diffusion — локальная генерация с ControlNet и LoRA. Без VPN — Kandinsky 6.0 и Шедеврум.