DeepSeek — китайская нейросеть мирового уровня
DeepSeek — китайская лаборатория ИИ, основанная в мае 2023 года как проект хедж-фонда High-Flyer. Базируется в Ханчжоу, возглавляется Лян Вэньфэном. Выпускает открытые модели под лицензией MIT: семейство V4 (флагман, апрель 2026), R1 (рассуждения), DeepSeek Coder (код). На апрель 2026 V4-Pro показал 80.6% на SWE-Bench Verified — на 0.2 пункта позади Claude Opus 4.7 — и 93.5 на LiveCodeBench (самый высокий результат среди публичных моделей) по обзору Codersera, сводке Morph LLM и Datacamp.
Главная идея DeepSeek — фронтир-качество по открытой лицензии и в десятки раз дешевле американских аналогов: на задачах кода V4-Pro идёт вровень с Claude Opus 4.7 при цене входного токена в 11 раз ниже, а выходного — в 29 раз ниже.
Что такое DeepSeek простыми словами
DeepSeek работает в трёх форматах: веб-чат на chat.deepseek.com — бесплатный, с моделями V4 и R1, режимом DeepThink и поиском в сети; API на platform.deepseek.com — оплата по токенам, в разы дешевле OpenAI и Anthropic; открытые веса на Hugging Face — модели можно скачать и запустить на своём железе.
В отличие от ChatGPT или Claude, DeepSeek не закрытый продукт: лицензия MIT разрешает коммерческое использование локальной копии без отчислений. По странице на Hugging Face V4-Pro доступен публично с весами.
История DeepSeek — от хедж-фонда до фронтир-модели
Лян Вэньфэн ещё в 2015 году создал хедж-фонд High-Flyer, к 2021 году собравший один из крупнейших частных GPU-парков Китая. В мае 2023 года ИИ-направление выделилось в отдельную лабораторию. Ключевые точки:
- Ноябрь 2023 — DeepSeek Coder, первый публичный продукт.
- Декабрь 2024 — DeepSeek-V3 (671B), обучение по Хабру обошлось около $5.6 млн на кластере H800.
- Январь 2025 — R1, reasoning-модель уровня o1-preview. Акции NVIDIA падают на 17% за день — «момент DeepSeek» в западной прессе.
- Апрель 2026 — V4-Preview (Flash + Pro), контекст 1M токенов.
Важный контекст: лаборатория не зарабатывает на API в модели «маржа на токен». Основной доход — High-Flyer, ИИ — стратегический актив. Это объясняет, почему DeepSeek удерживает цены, при которых OpenAI и Anthropic работали бы в убыток.
Что нового в 2026 году
Ключевые изменения с начала года: 24 января — открытое обновление весов R1 (R1-0125), снижение галлюцинаций. 24 апреля — релиз V4 Preview (Flash + Pro), новая архитектура MoE с гибридным вниманием, контекст вырос с 131K до 1M токенов. 22 мая — промо-скидка 75% на V4-Pro стала постоянным тарифом: цены упали с $1.74 / $3.48 до $0.435 / $0.87 за 1M по сводке Codersera. Лето — переход с эндпойнтов deepseek-chat и deepseek-reasoner на deepseek-v4-flash и deepseek-v4-pro, старые имена отключаются 24 июля 2026 по документации API.
Статус DeepSeek R2 и V5
На июнь 2026 R2 и V5 ещё не выпущены. Сообщество ждёт R2 как обновлённую reasoning-модель на базе V4-архитектуры, но дат от лаборатории нет. По гайду Codersera рабочий фронтир сейчас — V4-Pro в режиме рассуждений (тот же эндпойнт, флаг thinking=true).
Главные модели DeepSeek в 2026
DeepSeek V4 — флагман
Релиз — 24 апреля 2026 как preview. По обзору Simon Willison и документации семейство разделено на две модели.
V4-Flash — 284B параметров, 13B активных. Input $0.14 (cache miss) / $0.0028 (cache hit), output $0.28 за 1M токенов. Контекст 1M, max output 384K.
V4-Pro — 1.6T параметров, 49B активных. Input $0.435 (cache miss) / $0.003625 (cache hit), output $0.87 за 1M токенов. Контекст 1M, max output 384K.
Архитектура — Mixture-of-Experts с гибридным вниманием (Compressed Sparse Attention + Heavily Compressed Attention). На контексте 1M V4-Flash использует 10% FLOPs и 7% KV-кэша от V3.2 — отсюда низкая цена даже на длинных диалогах. Обе модели поддерживают function calling, JSON-режим и chat prefix completion; FIM доступен только без рассуждений.
Архитектура MoE — почему это важно
Mixture-of-Experts (MoE) — подход, при котором у модели много «экспертов» (подсетей), но на каждый токен активируется только несколько. У V4-Pro суммарно 1.6T параметров, активно — около 49B на токен; плотная модель того же размера потребовала бы в 30+ раз больше вычислений. Что это даёт: цена ниже (платим за активные FLOPs), скорость выше, качество не страдает — эксперты специализируются по доменам.
DeepSeek V3 и V3.2 — предыдущее поколение
V3.2 вышел 1 декабря 2025 года, контекст 131K, доступен через OpenRouter по $0.2288 / $0.3432 за 1M. На собственном API прежние эндпойнты deepseek-chat и deepseek-reasoner отключаются 24 июля 2026 в пользу deepseek-v4-flash и deepseek-v4-pro. V3.2 актуален только для совместимости со старыми пайплайнами.
DeepSeek R1 — модель с рассуждениями
Reasoning-модель, аналог OpenAI o1. Показывает цепочку рассуждений (chain-of-thought) до итогового ответа. Цена через OpenRouter и сторонние шлюзы — около $0.70 input и $2.50 output за 1M токенов по сводке Price per Token. В веб-чате R1 включается кнопкой DeepThink. Обновление R1-0125 от 24 января 2026 заметно снизило галлюцинации. Сильна в математике (AIME, олимпиадный уровень), логике и многошаговых рассуждениях, разборе сложного кода, планировании.
DeepSeek Coder — модели под код
Семейство DeepSeek-Coder и Coder-V2 — специализация под программирование, 338 языков, контекст до 128K. На SWE-Bench Verified отстают от V4-Pro, но дешевле и быстрее на массовом автодополнении в IDE и CI.
Полная линейка одной таблицей
| Модель | Релиз | Параметры | Контекст | Сценарий |
|---|---|---|---|---|
| V4-Pro | апрель 2026 | 1.6T (49B active) | 1M | Топ-задачи, агенты, премиум-качество |
| V4-Flash | апрель 2026 | 284B (13B active) | 1M | Быстро и дёшево, массовый API |
| R1 (R1-0125) | январь 2026 | 671B | 131K | Reasoning, математика, логика |
| V3.2 | декабрь 2025 | 671B | 131K | Совместимость со старыми пайплайнами |
| DeepSeek Coder V2 | 2024 | 236B | 128K | Автодополнение в IDE, 338 языков |
Веб-чат vs API — что выбрать
| Параметр | chat.deepseek.com | API platform.deepseek.com |
|---|---|---|
| Цена | бесплатно | по токенам |
| Регистрация | email или Google | email + KYC для пополнения |
| Модели | V4 и R1 | V4-Flash, V4-Pro (с и без рассуждений) |
| Поиск в сети | да, с цитированием | нет (нужна своя обвязка) |
| Загрузка PDF / изображений | да | через base64 в payload |
| DeepThink (рассуждения) | кнопкой | параметром thinking=true |
| Лимит сообщений | без объявленных | по балансу токенов |
| Сохранение истории | да, в аккаунте | на стороне приложения |
| Кэширование префиксов | автоматом | да, x50 экономия на повторах |
| Доступ из РФ | напрямую с июня 2026 | нужна зарубежная карта или OpenRouter |
Веб-чат покрывает большинство бытовых задач. API нужен для массовой обработки, своего продукта или интеграции в IDE и CI.
DeepSeek на русском — как переключить язык
Ответы DeepSeek даёт на русском полноценно: достаточно написать запрос по-русски, и вся переписка пойдёт на русском без настроек. Если ответ пришёл на английском — добавьте в конце фразу «отвечай на русском» или задайте это в системном промпте один раз.
Интерфейс chat.deepseek.com по умолчанию английский. Сменить язык меню можно в настройках профиля (иконка аккаунта → Settings → Language), но на работу это не влияет: язык интерфейса и язык ответов независимы. По качеству русского DeepSeek уступает GPT-5 и Claude на тонкой стилистике, но для рабочих и бытовых запросов разницы почти нет.
Доступ из России
В 2026 ситуация была нестабильна: с марта по май DeepSeek периодически переставал открываться у части провайдеров, после чего доступ возвращался. Официальной блокировки нет, технические перебои разрешились.
На июнь 2026: chat.deepseek.com работает напрямую с российских IP без VPN, регистрация по email или Google.
Оплата API из РФ: российской картой напрямую не пройдёт. Варианты — зарубежная карта, крипта, российские агрегаторы или OpenRouter с оплатой в рублях.
Почему DeepSeek не работает — что делать
DeepSeek периодически перестаёт отвечать, выдаёт ошибку или бесконечно «думает». Чаще всего причина не на вашей стороне. Основные причины по убыванию частоты:
- Перегрузка серверов. Самая частая причина. На пике нагрузки DeepSeek отдаёт ошибку «The server is busy. Please try again later» или обрывает ответ. Мощности растут медленнее аудитории, поэтому в часы пик (вечер по Москве, день в Китае) сбои учащаются. Решение — подождать и повторить запрос через несколько минут.
- Технические перебои у провайдера. В 2026 у части российских операторов chat.deepseek.com периодически переставал открываться без официальной блокировки. Проверьте, открывается ли сайт с мобильного интернета или другого провайдера — если да, проблема в маршрутизации конкретного оператора.
- Ошибка на стороне аккаунта. Если не приходит письмо для входа или сбрасывает сессию — очистите кэш браузера, попробуйте инкогнито или вход через Google вместо email.
- Лимит или нулевой баланс в API. Для API «не работает» обычно значит код
402(кончился баланс) или429(превышен rate limit). Проверьте баланс на platform.deepseek.com и частоту запросов.
Как проверить, что проблема не у вас:
- Откройте статус DeepSeek — официальная страница состояния.
- Попробуйте зайти с другого устройства или сети (мобильный интернет вместо Wi-Fi).
- Если сайт не грузится — это сеть или провайдер; если грузится, но не отвечает — перегрузка серверов.
Чем заменить на время сбоя: ту же модель DeepSeek через OpenRouter (другая инфраструктура, не падает вместе с официальной) или российские агрегаторы. На время полного простоя — GigaChat, YandexGPT, ChatGPT или Claude. Для процессов без права на простой держите запасной шлюз заранее.
Скачать и установить DeepSeek
DeepSeek не требует установки: основной способ — веб-чат в браузере на chat.deepseek.com на компьютере и телефоне без скачивания.
Мобильное приложение. Официальное DeepSeek - AI Assistant есть в App Store (iOS) и Google Play (Android) — ищите издателя «DeepSeek». Функции те же, что в вебе: V4, R1, DeepThink, загрузка файлов. Осторожно с подделками: в сторах много клонов с похожими названиями, ставьте только приложение официального издателя.
На ПК (Windows / macOS). Отдельной настольной программы у DeepSeek нет — на компьютере работают через сайт в браузере. «Установить на ПК» обычно означает либо добавить сайт ярлыком (в Chrome: меню → «Сохранить и поделиться» → «Установить страницу как приложение»), либо запустить открытые веса локально через ollama (см. «Локальный запуск»). Сторонние «десктоп-клиенты DeepSeek» из неофициальных источников ставить не стоит.
Китайская юрисдикция данных
Серверы DeepSeek физически расположены в КНР. Что это значит:
- Закон 2017 года о кибербезопасности КНР + Data Security Law 2021 обязывают китайские компании передавать данные пользователей по запросу властей. Юрисдикция данных = китайская независимо от страны пользователя.
- Цензура на уровне модели. Тяньаньмэнь, Тайвань, Гонконг, уйгуры, критика руководства КНР — отказы или официальная позиция. Касается и веб-чата, и API.
- Логи запросов хранятся на стороне DeepSeek и формально могут быть запрошены властями.
Для личных и образовательных задач — приемлемо. Для корпоративных данных (контракты, переписка, финансы), медицины и права — локальный запуск открытых весов либо российские GigaChat и YandexGPT, а не DeepSeek API.
Цены и тарифы
Веб-чат — бесплатно
chat.deepseek.com — бесплатный, без объявленных лимитов сообщений: V4 и R1, DeepThink, поиск в сети с цитированием, анализ PDF и изображений, работа с кодом.
API — оплата по токенам
| Модель | Input cache miss | Input cache hit | Output |
|---|---|---|---|
| V4-Flash | $0.14 | $0.0028 | $0.28 |
| V4-Pro | $0.435 | $0.003625 | $0.87 |
| R1 (через OpenRouter) | $0.70 | — | $2.50 |
| V3.2 (через OpenRouter) | $0.2288 | — | $0.3432 |
Цены за 1M токенов. Кэш input снижает стоимость на повторах с одинаковым префиксом примерно в 50 раз — критично для агентов и долгих диалогов. Цены V4-Pro $0.435 / $0.87 — бывшая промо-скидка 75% с базы $1.74 / $3.48, ставшая постоянной 22 мая 2026; прежние ценники не актуальны. При регистрации даётся стартовый кредит.
Локальный запуск
Веса под MIT-лицензией. Для V4-Flash в FP8 нужны две H100, для V4-Pro — серверный кластер. Подходит для полной приватности, compliance и независимости от внешнего API. Реалистичные пути для не-датацентра:
- R1-Distill-Qwen-7B — Q4 на 8 ГБ VRAM, подойдёт RTX 3060 12GB или Mac mini M2. По Compute Market скорость 30-50 токенов/с.
- R1-Distill-Qwen-32B — оптимум для домашних задач. Q4_K_M занимает 18-20 ГБ VRAM, влезает в RTX 3090 или 4090, даёт 38-45 токенов/с на 4090 по Will It Run AI.
- Полный R1 671B — серверный кластер 8x H100. V4-Flash — в FP8 от 2x H100, V4-Pro — от 8x H100.
Стек: ollama для одной карты, vLLM или SGLang для продакшена, llama.cpp для CPU с GPU-офлоадом.
Бенчмарки 2026
| Бенчмарк | V4-Pro | V4-Flash | Claude Opus 4.7 | GPT-5.2 |
|---|---|---|---|---|
| SWE-Bench Verified (код) | 80.6% | ~72% | 80.8% | ~82% |
| LiveCodeBench | 93.5 | ~85 | ~88 | ~89 |
| AIME 2025 (математика) | 87.4% | 79.2% | 85.1% | 91.3% |
| MMLU-Pro (общие знания) | 83.7% | 78.5% | 85.2% | 86.0% |
| GPQA Diamond (наука) | 71.2% | 63.0% | 74.5% | 76.8% |
Что из таблицы следует: на коде V4-Pro в фронтире (LiveCodeBench 93.5 — самый высокий публичный результат на июнь 2026, SWE-Bench вровень с Claude Opus 4.7); на математике и науке отстаёт от GPT-5.2, но опережает большинство открытых моделей; цена за токен ниже в 10-30 раз при сопоставимом качестве — главный аргумент DeepSeek.
Когда выбирать DeepSeek и когда нет
Подходит: бесплатный мощный чат для бытовых задач, длинный контекст 1M токенов недорого, массовая обработка через API, reasoning без переплаты (R1 / DeepThink), открытые веса для локального запуска, доступ из РФ без VPN для веб-чата.
Не подходит: чувствительные корпоративные данные (юрисдикция КНР), политически острые темы (отказы или цензура), голос/видео/браузерные агенты (нет аналогов Sora, Agent Mode), процессы без права на простой, регулируемые отрасли — банки, медицина, госорганы (лучше GigaChat или YandexGPT).
DeepSeek через OpenRouter и российские агрегаторы
Если прямой доступ к platform.deepseek.com нестабилен или нет зарубежной карты — есть посредники.
OpenRouter — англоязычный шлюз ко всем крупным моделям. Один API-ключ даёт доступ к V4, V3.2, R1, Claude, GPT-5 и десяткам других. Оплата USD картой или криптой, накрутка 5-10%, зато доступ без VPN и единый биллинг.
Российские агрегаторы (Umnik.AI, BotHub, Smart-Chat) — оплата российской картой в рублях, интерфейс на русском, доступ к V4 и R1 без регистрации в DeepSeek. Накрутка выше (30-100%), но порог входа минимальный.
DeepSeek vs GPT-5 vs Claude
| Параметр | DeepSeek V4-Pro | Claude Opus 4.7 | GPT-5.2 | GigaChat Max |
|---|---|---|---|---|
| SWE-Bench Verified | 80.6% | 80.8% | ~82% | нет данных |
| LiveCodeBench | 93.5 | ~88 | ~89 | нет данных |
| Контекст | 1M | 1M (200K стандарт) | 400K | 32K |
| Input $/1M | $0.435 | $5 | $5 | руб., бесплатно до квоты |
| Output $/1M | $0.87 | $25 | $15 | руб., бесплатно до квоты |
| Открытые веса | да (MIT) | нет | нет | нет |
| Доступ из РФ | прямой | через прокси | через прокси | прямой |
| Русский язык | хорошо | отлично | отлично | отлично |
| Голос / видео / агенты | нет | Computer Use | Sora, Agent Mode | нет |
| Юрисдикция данных | КНР | США (Anthropic) | США (OpenAI) | РФ (Сбер) |
Сценарии по моделям: сложный код и агенты — V4-Pro (в 10 раз дешевле) или Claude Opus 4.7 (экосистема Claude Code, Computer Use); математика — GPT-5.2 в reasoning или R1 / V4-Pro c thinking=true; массовая обработка — V4-Flash; данные с compliance — Claude (US) или GigaChat (РФ), не DeepSeek API; голос, видео, браузерные агенты — только OpenAI; открытый стек и fine-tune — только DeepSeek.
Подробнее по альтернативам — сравнение российских нейросетей и обзоры Claude, ChatGPT, GigaChat.
Как начать работу
Веб-чат: зайти на chat.deepseek.com, зарегистрироваться через email или Google, выбрать модель сверху (V4 для общих задач, R1 или кнопка DeepThink для рассуждений), при необходимости включить поиск в сети и задать вопрос или прикрепить документ.
API:
- На platform.deepseek.com сгенерировать API-ключ.
- Использовать через OpenAI-совместимый SDK — endpoint
https://api.deepseek.com/v1. - Указать модель
deepseek-v4-flashилиdeepseek-v4-pro(старые имена отключаются 24 июля 2026). - Для кэширования input — отправлять стабильный префикс в начале каждого запроса.
OpenRouter: зарегистрироваться на OpenRouter, создать ключ, пополнить баланс и указать в API deepseek/deepseek-v4-pro или другую модель.
Формат API — пример запроса
API DeepSeek совместим с OpenAI SDK, для миграции достаточно поменять base_url и имя модели:
from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://api.deepseek.com/v1")
resp = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "Объясни MoE в одном абзаце."}],
)
print(resp.choices[0].message.content)
Для рассуждений добавляется thinking=true или используется deepseek-v4-pro. Streaming, tool calling, JSON-режим и chat prefix completion поддерживаются по аналогии с OpenAI. Кэширование префиксов работает автоматически: если первые N токенов запроса совпадают с предыдущим, input оплачивается по cache-hit цене в 50-120 раз ниже — достаточно держать стабильный системный промпт в начале запроса.
Use-cases — где DeepSeek реально применяется
Сильные сценарии: массовая обработка текстов (суммаризация, классификация, перевод на V4-Flash), кодогенерация в IDE и CI, аналитика длинных документов под контекст 1M без RAG, reasoning и математика на R1 или V4-Pro с thinking=true, fine-tune открытых весов без royalty.
Слабые сценарии: голос в реальном времени (нет аналога OpenAI Realtime), видео и редактирование изображений (Janus слабее DALL-E 3, аналога Sora нет), Computer Use и браузерные агенты, регулируемые отрасли с защитой ПДн.
Безопасность, регуляторы и compliance
В 2025-2026 DeepSeek несколько раз становился предметом регуляторных разбирательств: в Италии Garante в феврале 2025 потребовал удалить приложение из сторов; в США CAISI при NIST в мае 2026 оценил V4-Pro с оговорками по data residency и цензуре; в Германии и Южной Корее госорганам рекомендовали не использовать API. В России официальной позиции Роскомнадзора нет, доступ не блокирован, но для ПДн по 152-ФЗ API в Китае непригоден.
Практика для РФ: личные задачи — без оговорок; B2B-продукты для внешних клиентов — либо self-host, либо согласие пользователя; ПДн (ФИО, email, телефон) — локальный запуск весов в РФ или GigaChat / YandexGPT; коммерческая тайна — self-host.
FAQ
Что такое DeepSeek простыми словами? Китайская нейросеть уровня GPT-5 и Claude Opus. Веб-чат бесплатный, API стоит $0.14-0.87 за 1M токенов. Открытые веса под MIT-лицензией, можно запускать локально.
Бесплатный ли DeepSeek? Есть ли лимиты? Веб-чат на chat.deepseek.com бесплатный, объявленного лимита сообщений нет — фактический потолок задаёт только нагрузка на серверы в часы пик. API оплачивается по токенам, при регистрации даётся стартовый кредит; «лимит» там — это баланс и rate limit на частоту запросов.
Сколько стоит DeepSeek API в 2026? V4-Flash: $0.14 input / $0.28 output. V4-Pro: $0.435 / $0.87. Кэш input снижает цену примерно в 50 раз на повторных префиксах. Цены за 1M токенов.
Чем V4 отличается от V3.2? V4 — новое поколение с MoE и гибридным вниманием. Контекст вырос с 131K до 1M, эффективность на длинном контексте — в 10 раз выше. На SWE-Bench V4-Pro даёт 80.6%, V3.2 — заметно ниже.
Чем R1 отличается от V4? R1 — reasoning-модель, показывает пошаговое рассуждение до ответа (как OpenAI o1). V4 — общая модель быстрого ответа. Для математики, логики и сложного кода берут R1 или DeepThink, для скорости и цены — V4-Flash.
Когда выйдет DeepSeek R2? На июнь 2026 точной даты нет. Сообщество ждёт R2 как обновлённую reasoning-модель на базе V4-архитектуры. Пока рабочий фронтир — V4-Pro с флагом thinking=true, фактически он покрывает большинство задач, где раньше нужен был R1.
Работает ли DeepSeek в России без VPN? На июнь 2026 — да, chat.deepseek.com открывается напрямую. С марта по май 2026 были перебои, но не блокировка. Если недоступен — через OpenRouter или российские агрегаторы.
Поддерживает ли DeepSeek русский? Да, ответы на русском полноценные — достаточно писать запрос по-русски. Интерфейс веб-чата английский, но на работу это не влияет.
Можно ли запустить DeepSeek локально? Да, веса открытые под MIT. Для V4-Flash нужны две H100 в FP8, для V4-Pro — кластер. Дистилляты R1 запускаются даже на 4090.
Что такое DeepThink в DeepSeek? Режим пошагового рассуждения: модель показывает каждый шаг логики до ответа. Включается кнопкой в веб-чате или параметром в API. Полезно для проверки логики и обучения.
DeepSeek или ChatGPT — что выбрать? На типовых задачах сопоставимо. ChatGPT выигрывает в экосистеме (Sora, голос, Agent Mode), DeepSeek — в цене (для API дешевле в 10-30 раз), открытости и доступе из РФ без VPN.
Безопасно ли отправлять данные в DeepSeek? Серверы в Китае, юрисдикция китайская. Закон о кибербезопасности КНР 2017 обязывает передавать данные по запросу властей. Для личных задач — приемлемо. Для корпоративных данных, медицины, финансов — лучше локальный запуск или российские альтернативы GigaChat и YandexGPT.
Что такое дистиллированные модели R1? R1-Distill-Qwen-7B / 32B и R1-Distill-Llama-70B обучены на ответах полного R1 (671B). Качество ниже оригинала, но запускаются на потребительском железе: 32B на RTX 4090 даёт 38-45 токенов/с по Will It Run AI.
Можно ли использовать DeepSeek API в коммерческом продукте? Да. Лицензия MIT разрешает любое коммерческое использование. Единственное ограничение — данные пользователей пересекут юрисдикцию КНР, что нужно отразить в политике приватности.
Чем DeepSeek отличается от Qwen? Qwen (Alibaba) — ставка на мультимодальность и широкое семейство размеров, DeepSeek — на reasoning, код и дешёвый API. На SWE-Bench и LiveCodeBench DeepSeek сильнее, на vision Qwen-VL впереди.
Какую модель выбрать новичку — V4-Flash или V4-Pro? V4-Flash: цена в 3 раза ниже, качество на бытовых задачах сопоставимо. V4-Pro нужен, когда ответ не дотягивает — сложный код, длинные документы, математика.
Подвергаются ли цензуре ответы на русском? Да, цензура работает независимо от языка — на вопросы про Тяньаньмэнь, Тайвань, уйгуров и руководство КНР отказы или официальная позиция. На бытовых, технических и бизнес-темах её нет.
Можно ли скачать веса DeepSeek? Да. Веса V4, R1, V3.2, дистиллятов и Coder лежат на Hugging Face под MIT, без регистрации. Размер: V4-Flash около 570 ГБ в FP8, V4-Pro около 3.2 ТБ.
DeepSeek поддерживает работу с изображениями? Веб-чат принимает изображения и PDF для анализа. Генерация через Janus заметно слабее DALL-E 3 и Midjourney — для неё не подходит.
В чём разница между R1 и V4-Pro с thinking=true? R1 — отдельная reasoning-модель на V3-архитектуре, V4-Pro c thinking=true — общая V4 в режиме рассуждений. V4-Pro обходит R1 на новых бенчмарках и рекомендуется для новых пайплайнов.
Дальше
- Anthropic Claude — главный конкурент DeepSeek в reasoning и кодинге.
- ChatGPT — экосистема и доступ к GPT-5, Sora, Agent Mode.
- GigaChat — российская альтернатива от Сбера, данные не уходят за рубеж.
- YandexGPT — российская модель, интеграция с Yandex Cloud.
- Сравнение российских нейросетей — обзор по задачам и ценам.
- OpenRouter — единый шлюз ко всем моделям, в том числе DeepSeek, из РФ.
Читайте также
- $10M на 3 iPhone-приложениях с ИИ — кейс Блейка — $1.6M/мес
- Hush: $48M из $4 000 за 48 месяцев через обзвон клиентов — $1M/мес
- Сократик: российский ИИ-конструктор презентаций — обзор и тарифы
- Selectel: обзор облака, GPU и managed-сервисов в 2026
- Pixverse V5: нейросеть для вертикальных видео, обзор и тарифы 2026
- Early: $50K/мес на будильнике с отжиманиями — $50K/мес
- Stella: $340K в месяц на приложении аффирмаций — $340K/мес