Блог обзор

DeepSeek — китайская нейросеть мирового уровня

DeepSeek — китайская лаборатория ИИ, основанная в мае 2023 года как проект хедж-фонда High-Flyer. Базируется в Ханчжоу, возглавляется Лян Вэньфэном. Выпускает открытые модели под лицензией MIT: семейство V4 (флагман, апрель 2026), R1 (рассуждения), DeepSeek Coder (код). На апрель 2026 V4-Pro показал 80.6% на SWE-Bench Verified — на 0.2 пункта позади Claude Opus 4.7 — и 93.5 на LiveCodeBench (самый высокий результат среди публичных моделей) по обзору Codersera, сводке Morph LLM и Datacamp.

Главная идея DeepSeek — фронтир-качество по открытой лицензии и в десятки раз дешевле американских аналогов: на задачах кода V4-Pro идёт вровень с Claude Opus 4.7 при цене входного токена в 11 раз ниже, а выходного — в 29 раз ниже.

Что такое DeepSeek простыми словами

DeepSeek работает в трёх форматах: веб-чат на chat.deepseek.com — бесплатный, с моделями V4 и R1, режимом DeepThink и поиском в сети; API на platform.deepseek.com — оплата по токенам, в разы дешевле OpenAI и Anthropic; открытые веса на Hugging Face — модели можно скачать и запустить на своём железе.

В отличие от ChatGPT или Claude, DeepSeek не закрытый продукт: лицензия MIT разрешает коммерческое использование локальной копии без отчислений. По странице на Hugging Face V4-Pro доступен публично с весами.

История DeepSeek — от хедж-фонда до фронтир-модели

Лян Вэньфэн ещё в 2015 году создал хедж-фонд High-Flyer, к 2021 году собравший один из крупнейших частных GPU-парков Китая. В мае 2023 года ИИ-направление выделилось в отдельную лабораторию. Ключевые точки:

  • Ноябрь 2023 — DeepSeek Coder, первый публичный продукт.
  • Декабрь 2024 — DeepSeek-V3 (671B), обучение по Хабру обошлось около $5.6 млн на кластере H800.
  • Январь 2025 — R1, reasoning-модель уровня o1-preview. Акции NVIDIA падают на 17% за день — «момент DeepSeek» в западной прессе.
  • Апрель 2026 — V4-Preview (Flash + Pro), контекст 1M токенов.

Важный контекст: лаборатория не зарабатывает на API в модели «маржа на токен». Основной доход — High-Flyer, ИИ — стратегический актив. Это объясняет, почему DeepSeek удерживает цены, при которых OpenAI и Anthropic работали бы в убыток.

Что нового в 2026 году

Ключевые изменения с начала года: 24 января — открытое обновление весов R1 (R1-0125), снижение галлюцинаций. 24 апреля — релиз V4 Preview (Flash + Pro), новая архитектура MoE с гибридным вниманием, контекст вырос с 131K до 1M токенов. 22 мая — промо-скидка 75% на V4-Pro стала постоянным тарифом: цены упали с $1.74 / $3.48 до $0.435 / $0.87 за 1M по сводке Codersera. Лето — переход с эндпойнтов deepseek-chat и deepseek-reasoner на deepseek-v4-flash и deepseek-v4-pro, старые имена отключаются 24 июля 2026 по документации API.

Статус DeepSeek R2 и V5

На июнь 2026 R2 и V5 ещё не выпущены. Сообщество ждёт R2 как обновлённую reasoning-модель на базе V4-архитектуры, но дат от лаборатории нет. По гайду Codersera рабочий фронтир сейчас — V4-Pro в режиме рассуждений (тот же эндпойнт, флаг thinking=true).

Главные модели DeepSeek в 2026

DeepSeek V4 — флагман

Релиз — 24 апреля 2026 как preview. По обзору Simon Willison и документации семейство разделено на две модели.

V4-Flash — 284B параметров, 13B активных. Input $0.14 (cache miss) / $0.0028 (cache hit), output $0.28 за 1M токенов. Контекст 1M, max output 384K.

V4-Pro — 1.6T параметров, 49B активных. Input $0.435 (cache miss) / $0.003625 (cache hit), output $0.87 за 1M токенов. Контекст 1M, max output 384K.

Архитектура — Mixture-of-Experts с гибридным вниманием (Compressed Sparse Attention + Heavily Compressed Attention). На контексте 1M V4-Flash использует 10% FLOPs и 7% KV-кэша от V3.2 — отсюда низкая цена даже на длинных диалогах. Обе модели поддерживают function calling, JSON-режим и chat prefix completion; FIM доступен только без рассуждений.

Архитектура MoE — почему это важно

Mixture-of-Experts (MoE) — подход, при котором у модели много «экспертов» (подсетей), но на каждый токен активируется только несколько. У V4-Pro суммарно 1.6T параметров, активно — около 49B на токен; плотная модель того же размера потребовала бы в 30+ раз больше вычислений. Что это даёт: цена ниже (платим за активные FLOPs), скорость выше, качество не страдает — эксперты специализируются по доменам.

DeepSeek V3 и V3.2 — предыдущее поколение

V3.2 вышел 1 декабря 2025 года, контекст 131K, доступен через OpenRouter по $0.2288 / $0.3432 за 1M. На собственном API прежние эндпойнты deepseek-chat и deepseek-reasoner отключаются 24 июля 2026 в пользу deepseek-v4-flash и deepseek-v4-pro. V3.2 актуален только для совместимости со старыми пайплайнами.

DeepSeek R1 — модель с рассуждениями

Reasoning-модель, аналог OpenAI o1. Показывает цепочку рассуждений (chain-of-thought) до итогового ответа. Цена через OpenRouter и сторонние шлюзы — около $0.70 input и $2.50 output за 1M токенов по сводке Price per Token. В веб-чате R1 включается кнопкой DeepThink. Обновление R1-0125 от 24 января 2026 заметно снизило галлюцинации. Сильна в математике (AIME, олимпиадный уровень), логике и многошаговых рассуждениях, разборе сложного кода, планировании.

DeepSeek Coder — модели под код

Семейство DeepSeek-Coder и Coder-V2 — специализация под программирование, 338 языков, контекст до 128K. На SWE-Bench Verified отстают от V4-Pro, но дешевле и быстрее на массовом автодополнении в IDE и CI.

Полная линейка одной таблицей

МодельРелизПараметрыКонтекстСценарий
V4-Proапрель 20261.6T (49B active)1MТоп-задачи, агенты, премиум-качество
V4-Flashапрель 2026284B (13B active)1MБыстро и дёшево, массовый API
R1 (R1-0125)январь 2026671B131KReasoning, математика, логика
V3.2декабрь 2025671B131KСовместимость со старыми пайплайнами
DeepSeek Coder V22024236B128KАвтодополнение в IDE, 338 языков

Веб-чат vs API — что выбрать

Параметрchat.deepseek.comAPI platform.deepseek.com
Ценабесплатнопо токенам
Регистрацияemail или Googleemail + KYC для пополнения
МоделиV4 и R1V4-Flash, V4-Pro (с и без рассуждений)
Поиск в сетида, с цитированиемнет (нужна своя обвязка)
Загрузка PDF / изображенийдачерез base64 в payload
DeepThink (рассуждения)кнопкойпараметром thinking=true
Лимит сообщенийбез объявленныхпо балансу токенов
Сохранение историида, в аккаунтена стороне приложения
Кэширование префиксовавтоматомда, x50 экономия на повторах
Доступ из РФнапрямую с июня 2026нужна зарубежная карта или OpenRouter

Веб-чат покрывает большинство бытовых задач. API нужен для массовой обработки, своего продукта или интеграции в IDE и CI.

DeepSeek на русском — как переключить язык

Ответы DeepSeek даёт на русском полноценно: достаточно написать запрос по-русски, и вся переписка пойдёт на русском без настроек. Если ответ пришёл на английском — добавьте в конце фразу «отвечай на русском» или задайте это в системном промпте один раз.

Интерфейс chat.deepseek.com по умолчанию английский. Сменить язык меню можно в настройках профиля (иконка аккаунта → Settings → Language), но на работу это не влияет: язык интерфейса и язык ответов независимы. По качеству русского DeepSeek уступает GPT-5 и Claude на тонкой стилистике, но для рабочих и бытовых запросов разницы почти нет.

Доступ из России

В 2026 ситуация была нестабильна: с марта по май DeepSeek периодически переставал открываться у части провайдеров, после чего доступ возвращался. Официальной блокировки нет, технические перебои разрешились.

На июнь 2026: chat.deepseek.com работает напрямую с российских IP без VPN, регистрация по email или Google.

Оплата API из РФ: российской картой напрямую не пройдёт. Варианты — зарубежная карта, крипта, российские агрегаторы или OpenRouter с оплатой в рублях.

Почему DeepSeek не работает — что делать

DeepSeek периодически перестаёт отвечать, выдаёт ошибку или бесконечно «думает». Чаще всего причина не на вашей стороне. Основные причины по убыванию частоты:

  1. Перегрузка серверов. Самая частая причина. На пике нагрузки DeepSeek отдаёт ошибку «The server is busy. Please try again later» или обрывает ответ. Мощности растут медленнее аудитории, поэтому в часы пик (вечер по Москве, день в Китае) сбои учащаются. Решение — подождать и повторить запрос через несколько минут.
  2. Технические перебои у провайдера. В 2026 у части российских операторов chat.deepseek.com периодически переставал открываться без официальной блокировки. Проверьте, открывается ли сайт с мобильного интернета или другого провайдера — если да, проблема в маршрутизации конкретного оператора.
  3. Ошибка на стороне аккаунта. Если не приходит письмо для входа или сбрасывает сессию — очистите кэш браузера, попробуйте инкогнито или вход через Google вместо email.
  4. Лимит или нулевой баланс в API. Для API «не работает» обычно значит код 402 (кончился баланс) или 429 (превышен rate limit). Проверьте баланс на platform.deepseek.com и частоту запросов.

Как проверить, что проблема не у вас:

  • Откройте статус DeepSeek — официальная страница состояния.
  • Попробуйте зайти с другого устройства или сети (мобильный интернет вместо Wi-Fi).
  • Если сайт не грузится — это сеть или провайдер; если грузится, но не отвечает — перегрузка серверов.

Чем заменить на время сбоя: ту же модель DeepSeek через OpenRouter (другая инфраструктура, не падает вместе с официальной) или российские агрегаторы. На время полного простоя — GigaChat, YandexGPT, ChatGPT или Claude. Для процессов без права на простой держите запасной шлюз заранее.

Скачать и установить DeepSeek

DeepSeek не требует установки: основной способ — веб-чат в браузере на chat.deepseek.com на компьютере и телефоне без скачивания.

Мобильное приложение. Официальное DeepSeek - AI Assistant есть в App Store (iOS) и Google Play (Android) — ищите издателя «DeepSeek». Функции те же, что в вебе: V4, R1, DeepThink, загрузка файлов. Осторожно с подделками: в сторах много клонов с похожими названиями, ставьте только приложение официального издателя.

На ПК (Windows / macOS). Отдельной настольной программы у DeepSeek нет — на компьютере работают через сайт в браузере. «Установить на ПК» обычно означает либо добавить сайт ярлыком (в Chrome: меню → «Сохранить и поделиться» → «Установить страницу как приложение»), либо запустить открытые веса локально через ollama (см. «Локальный запуск»). Сторонние «десктоп-клиенты DeepSeek» из неофициальных источников ставить не стоит.

Китайская юрисдикция данных

Серверы DeepSeek физически расположены в КНР. Что это значит:

  • Закон 2017 года о кибербезопасности КНР + Data Security Law 2021 обязывают китайские компании передавать данные пользователей по запросу властей. Юрисдикция данных = китайская независимо от страны пользователя.
  • Цензура на уровне модели. Тяньаньмэнь, Тайвань, Гонконг, уйгуры, критика руководства КНР — отказы или официальная позиция. Касается и веб-чата, и API.
  • Логи запросов хранятся на стороне DeepSeek и формально могут быть запрошены властями.

Для личных и образовательных задач — приемлемо. Для корпоративных данных (контракты, переписка, финансы), медицины и права — локальный запуск открытых весов либо российские GigaChat и YandexGPT, а не DeepSeek API.

Цены и тарифы

Веб-чат — бесплатно

chat.deepseek.com — бесплатный, без объявленных лимитов сообщений: V4 и R1, DeepThink, поиск в сети с цитированием, анализ PDF и изображений, работа с кодом.

API — оплата по токенам

МодельInput cache missInput cache hitOutput
V4-Flash$0.14$0.0028$0.28
V4-Pro$0.435$0.003625$0.87
R1 (через OpenRouter)$0.70$2.50
V3.2 (через OpenRouter)$0.2288$0.3432

Цены за 1M токенов. Кэш input снижает стоимость на повторах с одинаковым префиксом примерно в 50 раз — критично для агентов и долгих диалогов. Цены V4-Pro $0.435 / $0.87 — бывшая промо-скидка 75% с базы $1.74 / $3.48, ставшая постоянной 22 мая 2026; прежние ценники не актуальны. При регистрации даётся стартовый кредит.

Локальный запуск

Веса под MIT-лицензией. Для V4-Flash в FP8 нужны две H100, для V4-Pro — серверный кластер. Подходит для полной приватности, compliance и независимости от внешнего API. Реалистичные пути для не-датацентра:

  • R1-Distill-Qwen-7B — Q4 на 8 ГБ VRAM, подойдёт RTX 3060 12GB или Mac mini M2. По Compute Market скорость 30-50 токенов/с.
  • R1-Distill-Qwen-32B — оптимум для домашних задач. Q4_K_M занимает 18-20 ГБ VRAM, влезает в RTX 3090 или 4090, даёт 38-45 токенов/с на 4090 по Will It Run AI.
  • Полный R1 671B — серверный кластер 8x H100. V4-Flash — в FP8 от 2x H100, V4-Pro — от 8x H100.

Стек: ollama для одной карты, vLLM или SGLang для продакшена, llama.cpp для CPU с GPU-офлоадом.

Бенчмарки 2026

БенчмаркV4-ProV4-FlashClaude Opus 4.7GPT-5.2
SWE-Bench Verified (код)80.6%~72%80.8%~82%
LiveCodeBench93.5~85~88~89
AIME 2025 (математика)87.4%79.2%85.1%91.3%
MMLU-Pro (общие знания)83.7%78.5%85.2%86.0%
GPQA Diamond (наука)71.2%63.0%74.5%76.8%

Что из таблицы следует: на коде V4-Pro в фронтире (LiveCodeBench 93.5 — самый высокий публичный результат на июнь 2026, SWE-Bench вровень с Claude Opus 4.7); на математике и науке отстаёт от GPT-5.2, но опережает большинство открытых моделей; цена за токен ниже в 10-30 раз при сопоставимом качестве — главный аргумент DeepSeek.

Когда выбирать DeepSeek и когда нет

Подходит: бесплатный мощный чат для бытовых задач, длинный контекст 1M токенов недорого, массовая обработка через API, reasoning без переплаты (R1 / DeepThink), открытые веса для локального запуска, доступ из РФ без VPN для веб-чата.

Не подходит: чувствительные корпоративные данные (юрисдикция КНР), политически острые темы (отказы или цензура), голос/видео/браузерные агенты (нет аналогов Sora, Agent Mode), процессы без права на простой, регулируемые отрасли — банки, медицина, госорганы (лучше GigaChat или YandexGPT).

DeepSeek через OpenRouter и российские агрегаторы

Если прямой доступ к platform.deepseek.com нестабилен или нет зарубежной карты — есть посредники.

OpenRouter — англоязычный шлюз ко всем крупным моделям. Один API-ключ даёт доступ к V4, V3.2, R1, Claude, GPT-5 и десяткам других. Оплата USD картой или криптой, накрутка 5-10%, зато доступ без VPN и единый биллинг.

Российские агрегаторы (Umnik.AI, BotHub, Smart-Chat) — оплата российской картой в рублях, интерфейс на русском, доступ к V4 и R1 без регистрации в DeepSeek. Накрутка выше (30-100%), но порог входа минимальный.

DeepSeek vs GPT-5 vs Claude

ПараметрDeepSeek V4-ProClaude Opus 4.7GPT-5.2GigaChat Max
SWE-Bench Verified80.6%80.8%~82%нет данных
LiveCodeBench93.5~88~89нет данных
Контекст1M1M (200K стандарт)400K32K
Input $/1M$0.435$5$5руб., бесплатно до квоты
Output $/1M$0.87$25$15руб., бесплатно до квоты
Открытые весада (MIT)нетнетнет
Доступ из РФпрямойчерез проксичерез проксипрямой
Русский языкхорошоотличноотличноотлично
Голос / видео / агентынетComputer UseSora, Agent Modeнет
Юрисдикция данныхКНРСША (Anthropic)США (OpenAI)РФ (Сбер)

Сценарии по моделям: сложный код и агенты — V4-Pro (в 10 раз дешевле) или Claude Opus 4.7 (экосистема Claude Code, Computer Use); математика — GPT-5.2 в reasoning или R1 / V4-Pro c thinking=true; массовая обработка — V4-Flash; данные с compliance — Claude (US) или GigaChat (РФ), не DeepSeek API; голос, видео, браузерные агенты — только OpenAI; открытый стек и fine-tune — только DeepSeek.

Подробнее по альтернативам — сравнение российских нейросетей и обзоры Claude, ChatGPT, GigaChat.

Как начать работу

Веб-чат: зайти на chat.deepseek.com, зарегистрироваться через email или Google, выбрать модель сверху (V4 для общих задач, R1 или кнопка DeepThink для рассуждений), при необходимости включить поиск в сети и задать вопрос или прикрепить документ.

API:

  1. На platform.deepseek.com сгенерировать API-ключ.
  2. Использовать через OpenAI-совместимый SDK — endpoint https://api.deepseek.com/v1.
  3. Указать модель deepseek-v4-flash или deepseek-v4-pro (старые имена отключаются 24 июля 2026).
  4. Для кэширования input — отправлять стабильный префикс в начале каждого запроса.

OpenRouter: зарегистрироваться на OpenRouter, создать ключ, пополнить баланс и указать в API deepseek/deepseek-v4-pro или другую модель.

Формат API — пример запроса

API DeepSeek совместим с OpenAI SDK, для миграции достаточно поменять base_url и имя модели:

from openai import OpenAI

client = OpenAI(api_key="sk-...", base_url="https://api.deepseek.com/v1")
resp = client.chat.completions.create(
 model="deepseek-v4-flash",
 messages=[{"role": "user", "content": "Объясни MoE в одном абзаце."}],
)
print(resp.choices[0].message.content)

Для рассуждений добавляется thinking=true или используется deepseek-v4-pro. Streaming, tool calling, JSON-режим и chat prefix completion поддерживаются по аналогии с OpenAI. Кэширование префиксов работает автоматически: если первые N токенов запроса совпадают с предыдущим, input оплачивается по cache-hit цене в 50-120 раз ниже — достаточно держать стабильный системный промпт в начале запроса.

Use-cases — где DeepSeek реально применяется

Сильные сценарии: массовая обработка текстов (суммаризация, классификация, перевод на V4-Flash), кодогенерация в IDE и CI, аналитика длинных документов под контекст 1M без RAG, reasoning и математика на R1 или V4-Pro с thinking=true, fine-tune открытых весов без royalty.

Слабые сценарии: голос в реальном времени (нет аналога OpenAI Realtime), видео и редактирование изображений (Janus слабее DALL-E 3, аналога Sora нет), Computer Use и браузерные агенты, регулируемые отрасли с защитой ПДн.

Безопасность, регуляторы и compliance

В 2025-2026 DeepSeek несколько раз становился предметом регуляторных разбирательств: в Италии Garante в феврале 2025 потребовал удалить приложение из сторов; в США CAISI при NIST в мае 2026 оценил V4-Pro с оговорками по data residency и цензуре; в Германии и Южной Корее госорганам рекомендовали не использовать API. В России официальной позиции Роскомнадзора нет, доступ не блокирован, но для ПДн по 152-ФЗ API в Китае непригоден.

Практика для РФ: личные задачи — без оговорок; B2B-продукты для внешних клиентов — либо self-host, либо согласие пользователя; ПДн (ФИО, email, телефон) — локальный запуск весов в РФ или GigaChat / YandexGPT; коммерческая тайна — self-host.

FAQ

Что такое DeepSeek простыми словами? Китайская нейросеть уровня GPT-5 и Claude Opus. Веб-чат бесплатный, API стоит $0.14-0.87 за 1M токенов. Открытые веса под MIT-лицензией, можно запускать локально.

Бесплатный ли DeepSeek? Есть ли лимиты? Веб-чат на chat.deepseek.com бесплатный, объявленного лимита сообщений нет — фактический потолок задаёт только нагрузка на серверы в часы пик. API оплачивается по токенам, при регистрации даётся стартовый кредит; «лимит» там — это баланс и rate limit на частоту запросов.

Сколько стоит DeepSeek API в 2026? V4-Flash: $0.14 input / $0.28 output. V4-Pro: $0.435 / $0.87. Кэш input снижает цену примерно в 50 раз на повторных префиксах. Цены за 1M токенов.

Чем V4 отличается от V3.2? V4 — новое поколение с MoE и гибридным вниманием. Контекст вырос с 131K до 1M, эффективность на длинном контексте — в 10 раз выше. На SWE-Bench V4-Pro даёт 80.6%, V3.2 — заметно ниже.

Чем R1 отличается от V4? R1 — reasoning-модель, показывает пошаговое рассуждение до ответа (как OpenAI o1). V4 — общая модель быстрого ответа. Для математики, логики и сложного кода берут R1 или DeepThink, для скорости и цены — V4-Flash.

Когда выйдет DeepSeek R2? На июнь 2026 точной даты нет. Сообщество ждёт R2 как обновлённую reasoning-модель на базе V4-архитектуры. Пока рабочий фронтир — V4-Pro с флагом thinking=true, фактически он покрывает большинство задач, где раньше нужен был R1.

Работает ли DeepSeek в России без VPN? На июнь 2026 — да, chat.deepseek.com открывается напрямую. С марта по май 2026 были перебои, но не блокировка. Если недоступен — через OpenRouter или российские агрегаторы.

Поддерживает ли DeepSeek русский? Да, ответы на русском полноценные — достаточно писать запрос по-русски. Интерфейс веб-чата английский, но на работу это не влияет.

Можно ли запустить DeepSeek локально? Да, веса открытые под MIT. Для V4-Flash нужны две H100 в FP8, для V4-Pro — кластер. Дистилляты R1 запускаются даже на 4090.

Что такое DeepThink в DeepSeek? Режим пошагового рассуждения: модель показывает каждый шаг логики до ответа. Включается кнопкой в веб-чате или параметром в API. Полезно для проверки логики и обучения.

DeepSeek или ChatGPT — что выбрать? На типовых задачах сопоставимо. ChatGPT выигрывает в экосистеме (Sora, голос, Agent Mode), DeepSeek — в цене (для API дешевле в 10-30 раз), открытости и доступе из РФ без VPN.

Безопасно ли отправлять данные в DeepSeek? Серверы в Китае, юрисдикция китайская. Закон о кибербезопасности КНР 2017 обязывает передавать данные по запросу властей. Для личных задач — приемлемо. Для корпоративных данных, медицины, финансов — лучше локальный запуск или российские альтернативы GigaChat и YandexGPT.

Что такое дистиллированные модели R1? R1-Distill-Qwen-7B / 32B и R1-Distill-Llama-70B обучены на ответах полного R1 (671B). Качество ниже оригинала, но запускаются на потребительском железе: 32B на RTX 4090 даёт 38-45 токенов/с по Will It Run AI.

Можно ли использовать DeepSeek API в коммерческом продукте? Да. Лицензия MIT разрешает любое коммерческое использование. Единственное ограничение — данные пользователей пересекут юрисдикцию КНР, что нужно отразить в политике приватности.

Чем DeepSeek отличается от Qwen? Qwen (Alibaba) — ставка на мультимодальность и широкое семейство размеров, DeepSeek — на reasoning, код и дешёвый API. На SWE-Bench и LiveCodeBench DeepSeek сильнее, на vision Qwen-VL впереди.

Какую модель выбрать новичку — V4-Flash или V4-Pro? V4-Flash: цена в 3 раза ниже, качество на бытовых задачах сопоставимо. V4-Pro нужен, когда ответ не дотягивает — сложный код, длинные документы, математика.

Подвергаются ли цензуре ответы на русском? Да, цензура работает независимо от языка — на вопросы про Тяньаньмэнь, Тайвань, уйгуров и руководство КНР отказы или официальная позиция. На бытовых, технических и бизнес-темах её нет.

Можно ли скачать веса DeepSeek? Да. Веса V4, R1, V3.2, дистиллятов и Coder лежат на Hugging Face под MIT, без регистрации. Размер: V4-Flash около 570 ГБ в FP8, V4-Pro около 3.2 ТБ.

DeepSeek поддерживает работу с изображениями? Веб-чат принимает изображения и PDF для анализа. Генерация через Janus заметно слабее DALL-E 3 и Midjourney — для неё не подходит.

В чём разница между R1 и V4-Pro с thinking=true? R1 — отдельная reasoning-модель на V3-архитектуре, V4-Pro c thinking=true — общая V4 в режиме рассуждений. V4-Pro обходит R1 на новых бенчмарках и рекомендуется для новых пайплайнов.

Дальше

  • Anthropic Claude — главный конкурент DeepSeek в reasoning и кодинге.
  • ChatGPT — экосистема и доступ к GPT-5, Sora, Agent Mode.
  • GigaChat — российская альтернатива от Сбера, данные не уходят за рубеж.
  • YandexGPT — российская модель, интеграция с Yandex Cloud.
  • Сравнение российских нейросетей — обзор по задачам и ценам.
  • OpenRouter — единый шлюз ко всем моделям, в том числе DeepSeek, из РФ.