Блог обзор

Kandinsky 6.0 — нейросеть Сбера для картинок

Kandinsky — флагманская генеративная нейросеть от Сбера для создания и редактирования изображений по текстовому описанию. Актуальная версия — Kandinsky 6.0 Image, выпущена в апреле 2026 года. Доступна всем пользователям бесплатно без лимитов через GigaChat, приложение Fusion Brain и Telegram-боты. Работает из РФ без VPN, понимает русский язык напрямую. По официальному обзору SeoNews и разбору IXBT.

Что такое Kandinsky

Kandinsky — линейка моделей для генерации изображений, которую разрабатывает команда исследователей Сбера (Sber AI и AIRI совместно с MTS AI на ранних этапах). Первая публичная версия вышла осенью 2022 года, с тех пор модель прошла шесть крупных итераций и стала одной из самых заметных российских разработок в области генеративного ИИ. Архитектура — диффузионная, в Kandinsky 6.0 добавлен слой Mixture of Experts (MoE), а также модуль Image RAG для опоры на актуальные референсы.

Ключевые свойства:

  • Open-source с открытыми весами. Исходники версий 2.x, 3.0 и частично 4.0 выложены на GitHub и Hugging Face — модель можно запустить локально на своей видеокарте.
  • Русский язык напрямую. Промпт можно писать по-русски, без перевода на английский — обучающая выборка содержала большой объём русскоязычных описаний.
  • Бесплатный публичный доступ. Через GigaChat — без лимитов, через Fusion Brain — бесплатный тариф плюс платные пакеты для коммерции.
  • Доступ из РФ без VPN. Все сервисы Сбера работают с российских IP — это принципиальное отличие от Midjourney и DALL-E.
  • Российская юрисдикция. Данные обрабатываются на серверах Сбера в РФ, что важно для корпоративных сценариев и работы с персональными данными.
  • Конкурент мировых флагманов. По заявлениям Сбера, на задачах редактирования Kandinsky 6.0 сопоставим с Nano Banana от Google, Flux от Black Forest Labs и Qwen-Image от Alibaba.

В 2026 году Kandinsky остаётся одним из двух главных российских генераторов изображений вместе с Шедеврумом от Яндекса. По данным Сбера, за всё время существования сервиса пользователи сгенерировали несколько сотен миллионов изображений.

Версии Kandinsky — что менялось

Kandinsky 1.0 — 3.0

2022-2023 годы. Первая версия вышла осенью 2022 года, через несколько месяцев после публичной демонстрации Stable Diffusion. Версии 2.x улучшали фотореализм и русский язык, веса выложены в открытый доступ. Kandinsky 3.0 (конец 2023) сделала качественный скачок в фотореализме и работе с длинными промптами, тогда же появилась первая версия Kandinsky Video и сайт fusionbrain.ai.

Kandinsky 4.0

Конец 2024 года. Сделала модель массовой: inpainting (дорисовка областей фото), outpainting (расширение кадра), стилизация, контроль композиции. Появился видеогенератор Kandinsky Video. Фотореализм вырос, но картинка уступала Midjourney v6 в художественной подаче.

Kandinsky 5.0

2025 год. Фотореализм портретов сравнялся с зарубежными моделями среднего уровня, появилась корректная генерация русского и латинского текста внутри изображений, улучшилось понимание длинных промптов. В этой версии Kandinsky стал основным генератором картинок внутри GigaChat.

Kandinsky 6.0

Текущая флагманская версия, апрель 2026. Главные изменения по обзору IXBT:

  • Архитектура Mixture of Experts (MoE). Модель состоит из нескольких «экспертов»; роутер выбирает нужного под конкретный запрос. Это сделало генерацию примерно в два раза быстрее без потери качества.
  • Image RAG — встроенный поиск по изображениям. Если в промпте упомянут актуальный персонаж, бренд или событие, модель ищет референсы в собственной базе и генерирует с опорой на них. Решает проблему «модель не знает того, кого не было в обучающей выборке».
  • Реставрация фотографий. Загруженное старое или повреждённое фото восстанавливается за один промпт: убираются царапины, возвращается цвет, повышается резкость.
  • Точные локальные правки. Можно сменить одежду, причёску, фон, добавить аксессуары — без полного перерисовывания всей картинки.
  • Ретушь и цифровой макияж. Чистка кожи, выравнивание тона, макияж модели — за один проход.
  • Корректный текст внутри изображений. Существенно меньше «глючит» кириллицу и латиницу.
  • Понимание сложных многосоставных промптов. Модель аккуратнее обрабатывает запросы с несколькими объектами, действиями и стилистическими указаниями в одной фразе.
  • Меньше галлюцинаций. На сложных сценах с большим числом объектов 6.0 реже ломает анатомию рук, перспективу и взаимное расположение предметов.
  • По заявлениям Сбера, на задачах редактирования Kandinsky 6.0 конкурирует с Nano Banana от Google, Flux от Black Forest Labs и Qwen-Image от Alibaba.

MoE и Image RAG простыми словами

MoE — модель разделена на несколько специализированных «экспертов» (портреты, пейзажи, текст и т.д.). Маленький роутер выбирает, кому отдать конкретный запрос; под каждый промпт активируется только часть параметров — генерация ускоряется, а суммарная ёмкость модели растёт. Та же идея, что в Mixtral и DeepSeek-MoE, перенесённая на картинки.

Image RAG — встроенный поиск визуальных референсов. Если в промпте упомянут актуальный персонаж, бренд или событие, которого не было в обучающей выборке, модель находит похожие изображения в собственной базе и опирается на них. Решает проблему «модель не знает того, кого не училась рисовать».

Где использовать Kandinsky

  1. GigaChat — основной канал. Веб-версия на giga.chat, iOS и Android-приложения. Картинки в том же чате, что и текст. Бесплатно, без лимитов. Подходит, когда нужна быстрая генерация без отдельного интерфейса под визуал.
  2. Fusion Brain — публичная платформа. Сайт fusionbrain.ai. Интерфейс для художников и дизайнеров: больше настроек, inpainting и outpainting через холст, видеогенерация, история работ, выбор стилей и форматов соотношения сторон.
  3. Kandinsky.ai — официальная страница проекта. Демо новой версии, документация, ссылки на API.
  4. Telegram-бот Kandinsky. Поиск по @kandinsky21_bot. Поддерживает версии 3.x, быстрая генерация без захода на сайт. Удобно для генерации с телефона в дороге.
  5. VK-бот Kandinsky. Быстрые генерации в форматах 1:1, 3:2 и 2:3 прямо во ВКонтакте. Подходит для коротких задач — обложка поста, аватарка чата.
  6. Голосовой ассистент Салют. Голосовая генерация через колонки SberBoom и приложение «Салют». Команда «Включи художника» открывает режим генерации голосом — удобно, когда руки заняты.
  7. API через Fusion Brain. Программный доступ для интеграции в свои продукты — маркетплейс с автогенерацией карточек, CMS с автоматическими обложками постов, чат-бот с генерацией картинок по запросу.

Полный список точек входа и пошаговая инструкция по каждому — в гайде hi-tech.mail.ru и обзоре vc.ru.

Какой канал выбрать под задачу

  • SMM, частые генерации — GigaChat: картинка и текст в одном окне.
  • Дизайн, правки кистью, контроль стиля — Fusion Brain: холст, inpainting, история, пресеты.
  • С телефона без браузера — Telegram- или VK-бот.
  • Голосом в колонке — Салют.
  • Встраивание в продукт — API через Fusion Brain.

Доступ из РФ

Kandinsky изначально создан как российский продукт. VPN не нужен ни для одного из официальных каналов: ни для GigaChat, ни для Fusion Brain, ни для Telegram-ботов. Регистрация через Сбер ID, номер телефона или email. Платёжная карта не требуется для бесплатного тарифа.

Это сильное отличие от международных генераторов вроде Midjourney или DALL-E 4, которые из России без VPN и валютной карты недоступны.

Тарифы

GigaChat. Полностью бесплатно, без лимитов для частного использования. Все возможности Kandinsky 6.0 включены.

Fusion Brain. Бесплатный базовый тариф для ознакомления. Платные пакеты — для расширенных режимов и коммерческого использования. Конкретные цены и лимиты Сбер периодически обновляет — актуальная страница тарифов на сайте сервиса.

API через Fusion Brain. Программный доступ оплачивается отдельно, расчёт по количеству генераций. Подходит для встраивания Kandinsky в свои продукты — например, в маркетплейс с автогенерацией карточек товара или в CRM для нейрофотосессий.

Локальный запуск. Открытые веса версий до 4.0 можно запустить на собственной видеокарте — бесплатно, но требуется GPU уровня RTX 3090 / 4090 (минимум 24 ГБ VRAM для комфортной работы). Версии 5.0 и 6.0 в открытый доступ на момент июня 2026 года не выложены.

Корпоративный доступ. Для бизнеса Сбер предлагает интеграцию через GigaChat API с отдельными лимитами, SLA и обработкой данных в выделенном контуре. Запрос — через коммерческий отдел Сбера.

Отдельных подписок «Kandinsky Pro» нет — Сбер встраивает модель в GigaChat и оставляет бесплатной для широкой аудитории. Монетизация идёт через корпоративные интеграции и API, а не через подписку для частников.

Kandinsky vs Шедеврум vs Midjourney vs Nano Banana 2

ПараметрKandinsky 6.0ШедеврумMidjourney V7Nano Banana 2
РазработчикСберЯндексMidjourney Inc.Google
Доступ из РФБез VPNБез VPNЧерез VPNЧерез VPN
Цена для частникаБесплатно, без лимитовБесплатно, есть лимитыОт $10/месБесплатно с лимитами + платно
Русский в промптеПолноценноПолноценноЧерез переводЧерез перевод
Русский текст в картинкеДа, корректноЧастичноСлабоСлабо
ФотореализмВысокийВысокийТопВысокий
Художественный стильХорошийХорошийТопХороший
Реставрация фотоСильная сторонаНетСлабоСильная сторона
ВидеоЧерез Kandinsky VideoДа, встроеноЧерез partner-сервисЧерез Veo
Открытые весаСтарые версии — даНетНетНет

Главный вывод: Kandinsky и Шедеврум закрывают потребности русскоязычной аудитории «здесь и сейчас» без VPN и подписок. Midjourney остаётся эталоном художественной картинки, но требует VPN, валютной карты и обхода санкций. Nano Banana 2 — флагман редактирования фото от Google, прямой конкурент Kandinsky 6.0 на задачах правок и реставрации.

Когда выбрать Kandinsky

  • Нужен корректный русский текст внутри картинки — обложки постов, баннеры, открытки.
  • Реставрация старых семейных фотографий или ретушь портретов.
  • Бесплатно, без лимитов, без VPN и валютной карты.
  • Корпоративные задачи с обработкой данных в РФ.
  • Нейрофотосессии с заменой фона и одежды на готовом портрете.

Когда выбрать другой инструмент

  • Тонкая художественная картинка для арт-проекта — лучше Midjourney V7.
  • Глубокая тонкая настройка через LoRA и ControlNet — Stable Diffusion XL / Flux локально.
  • Социальная лента с готовыми работами и встроенный видеогенератор без отдельного контура — Шедеврум.
  • Сложные многоходовые правки фото с естественным результатом — Nano Banana от Google.

Что делают с помощью Kandinsky

SMM и контент. Обложки постов, превью видео, иллюстрации для рилс и сторис. Бесплатно и без лимитов — можно генерировать пачками для контент-планов.

Реставрация семейных архивов. Возврат цвета, чистка царапин, повышение резкости на старых сканах. Главная фишка версии 6.0.

Рекламные креативы. Постеры, баннеры, превью с корректным русским текстом. Заметное преимущество перед международными моделями, которые ломают кириллицу.

Обучение и образование. Иллюстрации для лекций, учебников, проверочных заданий. Поддержка русского культурного контекста и исторических сцен.

Дизайн и арт-исследование. Мудборды, стилистические референсы, скетчи концептов перед коммерческой работой в нейросетях для дизайнеров.

Карточки товаров и e-commerce. Замена фона, ретушь, нейрофотосессии для маркетплейсов.

Личное использование. Открытки, аватарки, тематические картинки для домашних проектов.

Развёрнутые сценарии для бизнеса

A/B тест рекламных креативов. Маркетолог генерирует серию вариантов баннера: разные сцены, цвета, ракурсы. Дальше — пакетный прогон через VK Ads и отбор по CTR. Входной порог снижается до уровня «опиши задачу словами», без фотосессий.

Контент-план в соцсетях без фотосессии. Кофейня, барбершоп или школа танцев получают иллюстрации к постам без фотографа. Корректный русский текст внутри картинки позволяет вписать название акции прямо в баннер.

Дизайн упаковки и принтов. Эскизы упаковки, текстиля, обоев, открыток. Дизайнер прорабатывает варианты узора и идёт в работу с отобранным концептом.

Карточки товаров для маркетплейсов. Замена фона, добавление лайфстайл-сцены, ретушь. Через API Fusion Brain процесс ставится на поток для каталога из сотен и тысяч позиций.

Учебные материалы и презентации. Иллюстрации к разделам курса, обложки модулей, картинки для слайдов. Поддержка русского контекста полезна для курсов по литературе, истории и страноведению.

Ограничения

  • Английский стабильнее на тонких художественных сценах. Русский Kandinsky понимает полноценно, но в стилистически сложных задачах англоязычный промпт даёт более предсказуемый результат.
  • Текст в картинке улучшен, но не идеален. На коротких надписях — стабильно, на длинных абзацах бывают артефакты.
  • Художественный стиль уступает Midjourney V7. Композиция и атмосфера на хорошем уровне, но в премиум-арте Midjourney впереди.
  • Меньше тонкой настройки, чем у Stable Diffusion. Нет публичных LoRA, нет ControlNet, нет дообучения под свой стиль из обычного интерфейса.
  • Базовое разрешение — 1024×1024. Для печати нужен upscaling — отдельно или внутри Fusion Brain.
  • Запросы могут использоваться для дообучения. Пользовательское соглашение оставляет это за Сбером — для чувствительных коммерческих задач стоит учитывать.

Как начать пользоваться — пошагово

  1. Открыть giga.chat в браузере или поставить приложение GigaChat.
  2. Авторизоваться через Сбер ID, телефон или email.
  3. В чате написать промпт на генерацию: «Нарисуй современный офис в стиле минимализм, мягкий свет, белые стены и зелёное растение в углу».
  4. Подождать 10–30 секунд.
  5. Получить картинку. Можно скачать, уточнить промпт и сгенерировать новую версию.

Для реставрации фото:

  • Прикрепить старое или повреждённое фото в чат GigaChat.
  • Написать: «Восстанови это фото, верни цвет, убери царапины, повысь резкость».
  • Получить отреставрированную версию.

Для смены одежды или фона:

  • Прикрепить исходное фото.
  • Описать правку: «Замени фон на пляж на закате», «Поменяй пиджак на тёмно-синий свитер».
  • Дождаться результата с сохранённой композицией.

Для дизайнерских задач удобнее заходить через Fusion Brain: там есть холст, inpainting кистью, история работ и более тонкая настройка стиля.

Как писать промпты для Kandinsky

Kandinsky 6.0 понимает русский язык напрямую, но качество результата зависит от структуры запроса. Базовая схема: объект → действие и контекст → стиль → свет → композиция → технические уточнения.

Пример: «Фотореалистичный портрет пожилой женщины-учителя в школьном классе, мягкий тёплый свет из окна, лицо в фокусе, размытый фон с книжными полками, плёночная зернистость, формат 1:1».

Стили и пресеты

В Fusion Brain доступны стилевые пресеты, которые выбираются одним кликом: без стиля, реализм, живопись, аниме, графика (чёрно-белые штрихи, тушь), детальное фото (фотореализм с акцентом на текстуры), 4D-рендер (пластиковая глянцевая стилистика).

Если нужного стиля нет в пресете — задайте его текстом: «акварель», «советский плакат», «киберпанк-неон», «масляная живопись XIX века», «гравюра на дереве», «изометрия в стиле Pixar».

Форматы соотношения сторон

  • 1:1 (1024×1024) — лента соцсетей, аватарки, превью.
  • 16:9 — обложки YouTube, презентации, сайтовые баннеры.
  • 9:16 — Reels, Shorts, Stories, вертикальный мобильный формат.
  • 4:3 и 3:4 — печать, обложка книги, классический фото-формат.

Промпт-шаблоны под типовые задачи

Обложка статьи в блог. «Современная иллюстрация для статьи [тема], векторная графика, минимализм, акценты на [объект], мягкий градиентный фон, без текста, формат 16:9».

Карточка товара для маркетплейса. «Фотореалистичная композиция продукта [описание] на светло-сером фоне, мягкое студийное освещение, корректные пропорции, фокус по центру, формат 1:1».

Постер с русским текстом. «Постер с крупной надписью “Привет, лето” в верхней трети, под надписью — летняя сцена: пляж, зонтики, чайки, плоская векторная графика, тёплые цвета, формат 1:1».

Типичные ошибки новичков

  • Слишком короткий промпт («девушка в лесу») — модель додумает за вас, результат непредсказуем.
  • Перегрузка прилагательными. Десять синонимов про красоту не делают картинку лучше.
  • Противоречия внутри промпта («реалистичное фото в стиле акварели») — модель выберет одно из двух наугад.
  • Отрицания в основном поле. Kandinsky плохо обрабатывает фразы «без бороды», «не в очках» — такие уточнения лучше выносить в негативный промпт.
  • Правка нескольких элементов разом. При итерациях меняйте по одной детали — иначе модель «разбалансируется» и переделает то, что устраивало.
  • Отказ от итераций. Первая генерация редко бывает финальной — обычно нужно 3-5 уточнений.

Негативный промпт

В Fusion Brain отдельным полем задаётся, что не должно появиться на картинке: «низкое качество», «размытость», «лишние пальцы», «искажённые лица», «текст», «водяной знак». Это снижает долю брака и стабилизирует серию из 10-20 генераций под один контент-план.

FAQ

Что такое Kandinsky 6.0? Флагманская нейросеть Сбера для генерации и редактирования изображений. Версия 6.0 выпущена в апреле 2026 года. Доступна бесплатно через GigaChat и Fusion Brain.

Сколько стоит Kandinsky? В GigaChat — полностью бесплатно, без лимитов на количество генераций. В Fusion Brain — бесплатный базовый тариф плюс платные пакеты для коммерческого использования. API оплачивается отдельно по количеству генераций.

Где использовать Kandinsky? Основной канал — GigaChat на giga.chat и в мобильном приложении. Также: Fusion Brain (fusionbrain.ai) для дизайнеров, Telegram-боты, ВК-бот, голосовой ассистент Салют, API через Fusion Brain.

Что нового в версии 6.0? Архитектура Mixture of Experts (MoE), скорость генерации выросла примерно вдвое. Появились: Image RAG для актуальных образов, реставрация старых фото, точные локальные правки, ретушь и цифровой макияж, более корректный текст внутри изображений.

Можно ли реставрировать фото через Kandinsky? Да. Это одна из главных функций версии 6.0. Нужно прикрепить старое фото в чат GigaChat и попросить восстановить — модель сама уберёт царапины, вернёт цвет и резкость.

Понимает ли Kandinsky русский язык? Да, полноценно. Модель обучалась с упором на русский язык и культурный контекст, поэтому переводить промпт на английский не нужно. На стилистически тонких художественных задачах англоязычный промпт иногда даёт более стабильный результат.

Нужен ли VPN? Нет. Все официальные каналы Kandinsky — GigaChat, Fusion Brain, Telegram-боты, ВК-бот — работают из РФ напрямую.

Можно ли использовать картинки Kandinsky в коммерческих целях? В GigaChat и на платных тарифах Fusion Brain — да, при соблюдении условий пользовательского соглашения. На полностью бесплатном тарифе Fusion Brain коммерческое использование может быть ограничено — стоит проверить актуальные условия на сайте сервиса перед использованием в платных проектах.

Какое разрешение у картинок? В базовом режиме — 1024×1024 пикселя. Для печати или больших форматов нужно использовать upscaling, в том числе встроенный в Fusion Brain.

Kandinsky или Шедеврум — что лучше? Зависит от задачи. Kandinsky сильнее в редактировании, реставрации фото и корректном тексте на изображениях. Шедеврум — в художественной генерации с нуля, встроенной видеогенерации и социальной ленте с готовыми работами. Многие пользователи держат оба.

Можно ли скачать Kandinsky и запустить локально? Веса версий до 4.0 включительно выложены в открытый доступ на GitHub и Hugging Face. Для запуска нужна видеокарта уровня RTX 3090 / 4090 и базовые навыки работы со стеком Python + PyTorch. Веса Kandinsky 5.0 и 6.0 на момент июня 2026 года в открытом виде не публиковались.

Что такое Image RAG в Kandinsky 6.0? Image RAG — встроенный механизм поиска визуальных референсов. Если в промпте упомянут актуальный персонаж, бренд или событие, модель ищет похожие изображения в собственной базе и опирается на них при генерации. Это решает проблему, когда классическая диффузионная модель не знает того, кого не было в обучающей выборке.

Что такое архитектура MoE и зачем она в генераторе картинок? Mixture of Experts — архитектура, в которой модель разделена на несколько специализированных «экспертов». Маленькая модель-роутер на лету выбирает, кому из экспертов отдать конкретный запрос. В результате под каждый промпт активируется только часть параметров — генерация ускоряется примерно вдвое, а суммарная ёмкость модели растёт без линейного роста времени отклика.

Безопасно ли загружать личные фото в Kandinsky? Сбер обрабатывает данные на серверах в РФ — это снимает часть рисков, связанных с трансграничной передачей данных. При этом пользовательское соглашение допускает использование запросов для дообучения моделей. Для чувствительных фото — паспортов, медицинских снимков, документов — публичные сервисы лучше не использовать. Для корпоративных сценариев есть отдельный контур через GigaChat API с выделенными SLA.

Можно ли генерировать NSFW и провокационный контент? Нет. Встроенные фильтры блокируют обнажённое тело, насилие, экстремистский контент и копии узнаваемых живых людей в компрометирующих сценах — запрос отсекается до выдачи.

Что такое Fusion Brain и чем он отличается от GigaChat? Fusion Brain — отдельная веб-платформа на сайте fusionbrain.ai. Тот же движок Kandinsky, но с интерфейсом для дизайнеров: холст, inpainting кистью, outpainting, история работ, видеогенерация, более тонкая настройка стиля. GigaChat — универсальный чат, где Kandinsky работает в одной строке с текстовой моделью; Fusion Brain — рабочее место под визуальные задачи.

Open-weights и локальный запуск

Открытые веса — отличительная черта проекта Kandinsky. Веса версий 2.0, 2.1, 2.2 и 3.0 выложены на Hugging Face и GitHub под разрешительной лицензией: модель можно скачать и запустить локально, без обращения к публичным сервисам Сбера.

Зачем это нужно:

  • Полный контроль над данными. Промпты и картинки не уходят на чужие серверы — критично для корпоративных задач с чувствительной информацией.
  • Снятие лимитов. Локальная модель работает столько, сколько выдерживает железо. Подходит для пакетной генерации.
  • Дообучение под свой стиль. Открытые веса допускают LoRA-тюнинг и полный fine-tuning на собственном датасете — например, под фирменный стиль бренда.
  • Интеграция в свои продукты без оплаты API. Локальный Kandinsky снимает счёт за каждую генерацию в маркетплейсе или CMS.

Минимальные требования: GPU уровня RTX 3090 / 4090 с 24 ГБ VRAM, 32-64 ГБ RAM, Python 3.10+ и PyTorch с CUDA, 50-100 ГБ места под веса.

Веса 4.0, 5.0 и 6.0 в открытый доступ на момент июня 2026 года не выкладывались — Сбер сместил проект к гибридной модели: открыты прошлые версии, актуальный флагман — только через GigaChat и Fusion Brain. Для проектов, которым нужна свежая модель локально, альтернативой остаются Stable Diffusion XL, FLUX и сопоставимые open-weight модели.

Кандинский и российский регулирующий контекст

Сервис обрабатывает данные на серверах Сбера в РФ — важно для компаний под 152-ФЗ «О персональных данных»: трансграничной передачи данных нет.

При этом 5 марта 2026 года Минцифры РФ оформило отказ во включении Kandinsky в реестр российского ПО — по данным CNews. Это не запрещает использование сервиса, но ограничивает применение там, где по требованию заказчика обязателен софт из реестра, — например, в части госконтрактов.

Для задач уровня паспортов и медицинских снимков публичные GigaChat и Fusion Brain лучше не использовать. Альтернативы: отдельный контур GigaChat API с выделенными SLA или локальный запуск open-weight версий Kandinsky на своей инфраструктуре — тогда данные не покидают периметр компании.

Дальше