Блог инфра

OpenRouter — единый API для всех нейросетей

OpenRouter — это API-шлюз, через который один ключ открывает доступ сразу к 400+ моделям ИИ от 60+ провайдеров: Claude, GPT-5, Gemini, DeepSeek, Llama, Qwen, Mistral, GigaChat и десятки других. Один баланс, один формат запроса, один SDK. Не нужно регистрироваться в каждом сервисе отдельно и жонглировать набором ключей.

Запущен в 2023 году, к 2026-му стал стандартом де-факто: через openrouter.ai проходит более 100 триллионов токенов в месяц, у платформы 8+ миллионов пользователей и 250 000+ интегрированных приложений. По Wordstat — 26 838 показов в месяц по запросу «openrouter».

Что такое OpenRouter и зачем он нужен

OpenRouter решает три проблемы при работе с несколькими моделями:

  1. Десяток регистраций и ключей. Без шлюза нужны отдельные аккаунты у OpenAI, Anthropic, Google, DeepSeek, Mistral — у каждого свой биллинг и свой SDK. OpenRouter заменяет это одной регистрацией.
  2. Переключение моделей требует переписывания кода. Прямой переход с GPT-5 на Claude Opus — смена SDK, формата сообщений, обработки ошибок. Через OpenRouter меняется одна строка.
  3. Сбои у провайдера = простой продукта. Если Claude недоступен — продакшен встаёт. Шлюз делает fallback: при сбое первой модели запрос идёт ко второй.

Архитектурно OpenRouter — это прокси между приложением и моделями. Запрос приходит на openrouter.ai/api/v1, шлюз выбирает провайдера и возвращает ответ в OpenAI-совместимом формате. Под капотом — собственная edge-инфраструктура, которая снижает задержку до уровня прямого подключения к провайдеру.

Ключевые функции

Unified API

Один HTTP-эндпоинт https://openrouter.ai/api/v1/chat/completions для всех моделей. Формат — стандартный OpenAI chat completions. Любая библиотека или фреймворк, который умеет OpenAI API (LangChain, LlamaIndex, Vercel AI SDK, официальный openai-python, openai-node), работает с OpenRouter без правок — только меняется baseURL и apiKey. То же касается клиентов: Cursor, Continue, Zed, Cline, Aider, Open WebUI — все принимают custom OpenAI-base URL и заводятся на OpenRouter за минуту.

Auto-routing

OpenRouter подбирает оптимального провайдера для модели автоматически: учитывает доступность, цену, задержку, нагрузку. Для популярных моделей (Llama, DeepSeek, Qwen) есть несколько провайдеров одной и той же модели — шлюз роутит на самого дешёвого или быстрого в моменте.

Параметры provider.order, provider.allow_fallbacks, provider.sort настраивают маршрутизацию вручную: зафиксировать провайдера, расширить пул, отсортировать по throughput, latency или price. У моделей бывают суффиксы: :nitro — приоритет на самый быстрый провайдер, :floor — на самый дешёвый, :free — бесплатная версия. Пример: meta-llama/llama-4-maverick:nitro.

Fallback

В одном запросе указывается список моделей в порядке предпочтения:

{
 "models": [
 "anthropic/claude-opus-4.7",
 "openai/gpt-5",
 "google/gemini-2.5-pro"
 ],
 "messages": [...]
}

Если первая модель недоступна или вернула ошибку — OpenRouter автоматически идёт ко второй, потом к третьей. Биллинг — только за успешно отработавшую модель. Прямые API таких возможностей не предлагают: fallback пришлось бы реализовывать в коде вручную, со своей логикой ретраев и таймаутов.

OpenRouter поддерживает плагин web — добавление актуальных данных из интернета в ответ модели. Подключается параметром при запросе:

{
 "model": "anthropic/claude-opus-4.7",
 "plugins": [{ "id": "web" }],
 "messages": [...]
}

Полезно для моделей без встроенного web-доступа (DeepSeek, Llama, Mistral). Тарифицируется отдельно по числу поисковых запросов — не нужно поднимать собственный SerpAPI или Tavily.

Vision

Модели с поддержкой изображений (Claude Opus, GPT-5, Gemini 2.5 Pro, Llama 4 Vision, Qwen3 VL) принимают картинки в стандартном OpenAI-формате: image_url либо base64 в content. OpenRouter прозрачно прокидывает мультимодальные запросы провайдеру. В каталоге у таких моделей стоит тег multimodal.

Prompt Caching

Для моделей с нативным кэшированием контекста (Claude, GPT, Gemini) OpenRouter поддерживает передачу cache-маркеров. Повторные запросы с одинаковой системной частью оплачиваются по сниженной ставке — экономия до 90% на длинных промтах. Особенно заметно в RAG-сценариях и чат-ботах с длинным system prompt.

BYOK

Bring Your Own Key — режим, в котором вы используете OpenRouter как роутер и аналитику, но платите провайдеру напрямую через свой ключ Anthropic / OpenAI / Google. Полезно при крупных оптовых скидках. Лимит — 1 миллион запросов в месяц бесплатно, дальше 5% комиссия. Включается в дашборде: добавляете внешний ключ, помечаете нужные модели, OpenRouter автоматически роутит запросы через него. Аналитика, логи, fallback на резервные модели — продолжают работать.

Структурированный вывод

Параметр response_format транслируется провайдеру: если модель умеет structured output (GPT-5, Gemini 2.5 Pro, Claude Sonnet 4.6), ответ приходит строго по схеме без парсинга markdown. Полезно для извлечения данных, генерации форм, классификации с фиксированной таксономией.

Какие модели доступны

В каталоге OpenRouter — более 400 моделей от всех крупных провайдеров. Ключевые группы:

ПровайдерМодели
AnthropicClaude Opus 4.7, Sonnet 4.6, Haiku 4.5
OpenAIGPT-5, GPT-5 mini, GPT-4.1, GPT-4o, o3, o3-mini
GoogleGemini 2.5 Pro, Gemini 2.5 Flash, Gemini 2.0
DeepSeekDeepSeek-V3.1, DeepSeek-R1
MetaLlama 4 Maverick, Llama 4 Scout, Llama 3.3 70B
MistralMistral Large 3, Codestral, Mixtral 8x22B
xAIGrok 3, Grok 3 mini
QwenQwen3 Max, Qwen3 Coder, Qwen3 VL
Yi, Phi, Cohere, Nousopen-source модели

Полный актуальный список и цены — openrouter.ai/models. Каталог обновляется 1-2 раза в неделю. У каждой модели есть карточка со статистикой throughput, latency и uptime по провайдерам за сутки и неделю.

Image-модели и популярность

Кроме текстовых LLM, OpenRouter маршрутизирует генеративные image-модели: FLUX.1 dev и pro, Stable Diffusion 3.5, Recraft v3, Imagen 3, Ideogram. Запрос идёт через тот же эндпоинт с параметром modalities: ["image"]. Цены сопоставимы с Replicate и fal.ai.

По публичному рейтингу OpenRouter в 2026-м верхние строчки занимают open-source модели: Qwen3-Coder, DeepSeek-R2, MiniMax M2.5 и Llama 4 Maverick. Из проприетарных лидируют Claude Sonnet 4.6 (на длинном кодинге) и GPT-5 mini (универсальный baseline). Тренд — «дешёвая open-source + точечный fallback на флагман».

Тарифы и цены

OpenRouter работает по модели pay-per-use: оплата только за фактически использованные токены, без подписки и фикс-платежей.

Базовая цена за токены равна прайс-листу провайдера — наценки нет. OpenRouter зарабатывает на комиссии при пополнении баланса: 5.5% при оплате картой / банковским переводом / криптой.

Примерные цены на главные модели 2026:

МодельВход (за 1М токенов)Выход (за 1М токенов)
Claude Opus 4.7$15$75
Claude Sonnet 4.6$3$15
Claude Haiku 4.5$1$5
GPT-5$10$40
GPT-5 mini$0.3$1.2
Gemini 2.5 Pro$3.5$10.5
Gemini 2.5 Flash$0.15$0.6
DeepSeek-V3.1$0.27$1.10
Llama 4 Maverick$0.18$0.6

Актуальные цены — на openrouter.ai/models.

Бесплатные модели

OpenRouter держит 25+ бесплатных моделей от 4 провайдеров: DeepSeek R1, Llama 3.3 70B, Gemma 3, Qwen3, Mistral 7B и другие open-source. Лимиты:

  • 20 запросов в минуту
  • 50 запросов в день для аккаунтов без баланса
  • 1000 запросов в день для аккаунтов с балансом от $10

Бесплатных моделей хватает на обучение, прототипы и pet-проекты. Для продакшена с предсказуемым SLA — нужен платный баланс.

Минимальное пополнение

От $5. Этого хватает на тысячи запросов к дешёвым моделям (DeepSeek, Llama, Gemini Flash) или несколько сотен к флагманам. Можно настроить auto-top-up: при падении баланса ниже порога автоматически списывается фиксированная сумма. Скрытых платежей нет: ни минимальной ежемесячной платы, ни абонентки, ни оплаты за неактивные ключи.

Как оптимизировать расходы

Несколько практических приёмов, которые экономят значительную часть бюджета без потери качества:

  • Маршрутизация по сложности. Простые задачи (классификация, извлечение полей) — на DeepSeek-V3.1 или Gemini Flash. Сложная логика и длинный контекст — на Claude Opus или GPT-5.
  • Кэширование системного промта. Длинный system prompt кэшируется один раз и переиспользуется. Поддерживают Claude, GPT, Gemini.
  • max_tokens всегда задавать. Выход дороже входа в 4–5 раз. Без лимита модель может выдать тысячи токенов на простом вопросе.
  • Batch вместо потоковых запросов. У ряда провайдеров есть batch-скидка 50% для отложенных запросов.
  • Аналитика по моделям. В дашборде видно, какая модель сколько ест — это подсказывает, что переносить на дешёвые тарифы.

Доступ из России

OpenRouter — один из немногих зарубежных сервисов на нейросетях, который штатно работает из России: сайт открывается без VPN, регистрация принимает российский email, API-запросы идут с российских IP без прокси, OAuth-вход через Google и GitHub работает.

Что не работает напрямую: оплата российской картой — Stripe фильтрует BIN российских банков. Решения:

  1. Зарубежная виртуальная карта — через Zarub, Wanted, Easy Payments. Привязывается к балансу штатно. Подробнее в гайде по зарубежной карте.
  2. Криптовалюта — USDC через встроенный шлюз OpenRouter (Polygon, Base, Ethereum). USDC покупается через P2P на Bybit, OKX, Bitget. Самый дешёвый путь: комиссия сети — центы, наценки сверху нет.
  3. Сервисы-посредники (Oplatym, EasyPayments, ProxyAPI) — принимают рубли с российской карты, пополняют баланс OpenRouter. Комиссия 5–10%.

После пополнения работа с API из России идёт штатно: эндпоинты openrouter.ai не блокируют запросы с российских IP — выгодное отличие от прямого Anthropic / OpenAI API. Подробный обзор способов оплаты — в материале как пополнить OpenRouter из России на vc.ru.

Как зарегистрироваться

  1. Зайдите на openrouter.ai — без VPN.
  2. Sign in — Google, GitHub, MetaMask или Email.
  3. Credits — пополните баланс зарубежной картой / криптой / через посредника.
  4. Keys — создайте API-ключ (sk-or-...).
  5. Подставьте ключ в свой код или клиент.

Регистрация и создание ключа бесплатные. Баланс нужен только для платных моделей; на бесплатных можно начать без пополнения, в рамках 50 запросов/день.

Как подключить в коде

OpenRouter совместим с OpenAI SDK — поэтому работает с любым клиентом, который поддерживает OpenAI API.

Node.js

import OpenAI from "openai";

const client = new OpenAI({
 baseURL: "https://openrouter.ai/api/v1",
 apiKey: process.env.OPENROUTER_API_KEY,
});

const response = await client.chat.completions.create({
 model: "anthropic/claude-opus-4.7",
 messages: [{ role: "user", content: "Привет!" }],
});

console.log(response.choices[0].message.content);

Python

from openai import OpenAI

client = OpenAI(
 base_url="https://openrouter.ai/api/v1",
 api_key=os.getenv("OPENROUTER_API_KEY"),
)

response = client.chat.completions.create(
 model="anthropic/claude-opus-4.7",
 messages=[{"role": "user", "content": "Привет!"}],
)

curl

curl https://openrouter.ai/api/v1/chat/completions \
 -H "Authorization: Bearer $OPENROUTER_API_KEY" \
 -H "Content-Type: application/json" \
 -d '{
 "model": "anthropic/claude-opus-4.7",
 "messages": [{"role": "user", "content": "Привет!"}]
 }'

Fallback в одном запросе

curl https://openrouter.ai/api/v1/chat/completions \
 -H "Authorization: Bearer $OPENROUTER_API_KEY" \
 -d '{
 "models": [
 "anthropic/claude-opus-4.7",
 "openai/gpt-5",
 "google/gemini-2.5-pro"
 ],
 "messages": [{"role": "user", "content": "Привет!"}]
 }'

OAuth PKCE для приложений

Если строите сервис, где пользователи подключают свои собственные ключи OpenRouter (как Cursor, Cline, Open WebUI), не нужно копировать ключи руками: поддерживается OAuth PKCE через oauth/authorize. Пользователь нажимает «Connect OpenRouter», даёт согласие, ваше приложение получает ключ с ограниченным scope.

OpenRouter vs прямые API провайдеров

ПараметрOpenRouterПрямые API
Регистрацияодин разу каждого провайдера
API-ключиодинпо одному на провайдера
Балансодин общийу каждого свой
Переключение моделисмена строкипереписывание интеграции
Fallback при сбояхвстроенныйреализуется в коде
Доступ из Россииштатныйс прокси / VPN у части провайдеров
Базовая цена за токеныравна прайсу провайдерапрайс провайдера
Комиссия5.5% при пополнениикурсовая разница при оплате
Оптовые скидкичерез BYOKнапрямую у провайдера
Платёжный шлюз из РФодин (зарубежная карта / крипта)у каждого свой

Выбирать прямые API: стабильный высокий объём по одной модели (>$5k/мес) с оптовыми скидками; корпоративный договор и SLA с конкретным вендором; специфичные функции (Batch API у OpenAI, prompt-кэширование с кастомным TTL).

Выбирать OpenRouter: MVP и эксперименты; A/B-тестирование нескольких моделей; продакшен с fallback; несколько моделей под разные задачи; команды из России (упрощается оплата и доступ).

Миграция с OpenAI / Anthropic на OpenRouter

Переезд с прямого ключа OpenAI или Anthropic на OpenRouter занимает 10–15 минут — формат запроса совместим, SDK не меняется.

  1. Поменять baseURL и ключ. В инициализации OpenAI-клиента две строки: baseURL: "https://openrouter.ai/api/v1" и apiKey: process.env.OPENROUTER_API_KEY.
  2. Изменить идентификаторы моделей. Было gpt-4o — стало openai/gpt-4o. Было claude-opus-4-20250101 — стало anthropic/claude-opus-4.7. Полный маппинг — в каталоге моделей.
  3. Добавить fallback. Меняется model: "..." на models: ["...", "...", "..."] — основной бонус миграции, устойчивость к сбоям одного провайдера.
  4. Перенести нагрузку постепенно. На время теста — двойной трафик: 10% через OpenRouter, 90% напрямую. Если метрики качества и задержки не просели — поднять до 100%.

При миграции с Anthropic-SDK на OpenRouter формат сообщений не меняется: шлюз принимает OpenAI-формат и сам конвертирует под Anthropic. Специфичные beta-фичи Anthropic (computer-use и т.п.) — оставлять на прямом ключе.

Когда OpenRouter применяют на практике

  • Продакшен с fallback. При сбое Claude запрос идёт к GPT-5, при сбое OpenAI — к Gemini. Пользователи не замечают локальных аварий.
  • Эксперименты. Один датасет через 5–7 моделей, сравнить точность и стоимость, выбрать оптимум — час вместо нескольких дней.
  • Бесплатные модели для обучения. Курсы используют бесплатные тиры Llama / DeepSeek / Qwen: один ключ на всех с лимитом по API.
  • Multi-provider стратегия. Claude Opus на длинные документы, GPT-5 на сложную логику, Gemini Flash на лёгкие задачи, DeepSeek на классификации — один SDK, один баланс.
  • Без вендор-лока. MVP на DeepSeek-V3 (~$0.27/М токенов), при росте — Claude Opus или GPT-5 без переписывания кода.
  • Аналитика и FinOps. Дашборд показывает помодельный расход, задержку, число запросов и success rate.

Сценарии использования: типовые роли

  • Разработчик AI-агента. Мультишаговый агент с маршрутизацией по этапам: классификация — Llama 4 Maverick, извлечение полей — DeepSeek-V3.1, генерация ответа — Claude Sonnet 4.6. Один SDK на все этапы, fallback на каждом шаге, кэширование длинного system prompt. Бюджет на тысячу обработанных писем — единицы долларов вместо десятков, если бы всё шло через GPT-5.
  • Маркетолог тестирует модели. Один и тот же brief прогоняется через 6 моделей, результаты сравниваются в таблице, выбирается оптимум по соотношению «стиль / цена». Без шлюза — 6 регистраций и 6 биллингов; через OpenRouter — один скрипт и один баланс.
  • Исследователь / data-аналитик. Датасет из тысячи примеров идёт через 3–4 модели для сравнения качества разметки. Скрипт один, модели меняются параметром model. Через provider.sort: "throughput" максимальная скорость — обработка за минуты.
  • Команда курса или школы. Внутренний инструмент: ученики пробуют разные модели в одном интерфейсе. Преподаватель выдаёт ключ с месячным лимитом на студента, аналитика по расходу централизована. Удобнее, чем покупать ChatGPT Plus каждому.

Где OpenRouter не подходит

В нескольких случаях стоит идти напрямую к провайдеру:

  • Premium-фичи без OpenRouter-эквивалента. Computer Use у Anthropic, Operator у OpenAI, Assistants API, Real-time API, Code Interpreter, нативный Files API — шлюз их не транслирует.
  • Корпоративный SLA и DPA с конкретным вендором. Регуляторам (банки, медицина, госсектор) нужен прямой контракт. У OpenRouter Enterprise есть свой DPA, но он покрывает только шлюз.
  • SLA 99.99% по контракту. Шлюз — дополнительный hop; каждый промежуточный сервис добавляет хвост к доступности.
  • Очень крупный объём по одной модели. При $10k+/месяц по Claude или GPT-5 имеет смысл оптовая скидка напрямую или BYOK.
  • Batch API у OpenAI. Скидка 50% на отложенные запросы доступна только напрямую.
  • Fine-tuning. Создание собственной fine-tune модели — только через прямой API провайдера.

152-ФЗ и российские данные

OpenRouter — иностранный шлюз (юрлицо в США), в транзитной роли запросы не хранит. Хранят их провайдеры на другом конце: Anthropic и OpenAI по дефолту удаляют через 30 дней. Если в запросах есть персональные данные граждан РФ, формально нужна их первичная обработка на территории России — закрывается локальными моделями (GigaChat, YandexGPT) или обезличиванием до отправки. Для проектов без персональных данных (генерация текстов, классификация публичной информации, технические агенты) OpenRouter подходит штатно.

Лимиты и ограничения

  • Rate limit на платном тарифе — зависит от модели и провайдера; для большинства флагманов — десятки RPM на старте, повышается по мере прогрева аккаунта.
  • Rate limit на бесплатном тарифе — 20 RPM и 50 запросов в день без баланса, 1000 запросов в день с балансом от $10.
  • Контекст — у каждой модели свой максимум. Claude Opus 4.7 — 200k токенов, GPT-5 — 1M, Gemini 2.5 — 2M. Дополнительных ограничений шлюз не накладывает.
  • Стриминг — на всех моделях через стандартный OpenAI SSE-формат.
  • Function calling / Tools, JSON Schema — на моделях с нативной поддержкой (Claude, GPT, Gemini, Mistral Large).
  • Транспорт — REST и SSE; WebSocket не поддерживается, streaming покрывает 99% сценариев.

Альтернативы OpenRouter

  • Together AI — фокус на open-source (Llama, Mistral, Qwen). Дешевле на отдельных моделях, но не даёт фронтиров от Anthropic / OpenAI.
  • Replicate — больше про image и video, для LLM реже.
  • Anyscale Endpoints — фокус на Llama, не такой широкий выбор провайдеров.
  • Fireworks AI — open-source, акцент на скорости генерации.
  • Прямые подключения к Anthropic API, OpenAI API, DeepSeek API — без посредника, но больше регистраций и интеграционной работы.

Для большинства задач в 2026 OpenRouter остаётся оптимумом по соотношению «универсальность / простота / цена». Подробный обзор — в материале по API нейросетей.

Безопасность и приватность

По официальной политике OpenRouter, шлюз не использует запросы для обучения моделей. Запросы пересылаются провайдеру; политика хранения зависит от провайдера (Anthropic и OpenAI — не дольше 30 дней без явного opt-in).

Для конфиденциальных данных в продакшене стоит:

  • Включить zero-retention в настройках аккаунта OpenRouter — запросы не логируются.
  • Использовать модели провайдеров с явной zero-retention политикой (Claude Enterprise, OpenAI Enterprise).
  • Отдельный ключ для каждой среды (dev / staging / prod) с ограниченными лимитами.
  • Фильтр provider.data_collection: "deny" — запрос идёт только тем, кто не сохраняет данные.

Для регулируемых отраслей (медицина, финансы, госсектор) — прямой контракт с провайдером и подписанный DPA остаются более надёжным вариантом.

FAQ

Работает ли OpenRouter в России? Да, без VPN. Сайт openrouter.ai открывается напрямую, регистрация принимает российский email, API-запросы идут с российских IP без прокси. Единственное ограничение — оплата российской картой не проходит, нужна зарубежная карта, криптовалюта (USDC) или сервис-посредник.

Сколько реально стоит использование? Pet-проект с парой сотен запросов в день к DeepSeek — $1–3/мес. MVP на Claude Sonnet — $30–100/мес. Продакшен с миллионами токенов — $500–5000/мес.

Можно ли использовать OpenRouter бесплатно? Да. На бесплатном тарифе доступно 25+ open-source моделей (DeepSeek R1, Llama 3.3, Qwen3, Gemma 3) с лимитом 20 запросов в минуту и 50 в день. Этого хватает на обучение, прототипы и тесты.

OpenRouter выгоднее прямого OpenAI или Anthropic API? До $1000–2000 в месяц — почти всегда выгоднее за счёт простоты, fallback и единого баланса. На больших объёмах стоит сравнить с оптовыми скидками напрямую или использовать BYOK-режим.

Делает ли OpenRouter наценку на стоимость токенов? Нет. Базовая стоимость за вход/выход равна прайсу провайдера, шлюз показывает ровно те же цены, что у Anthropic / OpenAI / Google. Зарабатывает на комиссии 5.5% при пополнении баланса — токены при списании идут по цене провайдера.

Можно ли подключить OpenRouter к Claude Code или Cursor? Да. В Cursor — Settings → Models → Custom OpenAI Base URL. В Claude Code — переменная ANTHROPIC_BASE_URL. Похожим способом подключаются Cline, Aider, Continue, Zed, Open WebUI.

Какой API-ключ использовать в продакшене? Отдельный ключ для каждой среды (dev, staging, prod). В дашборде задаются лимиты по балансу и числу запросов на ключ. При утечке ключ отзывается отдельно.

Что делать, если модель временно недоступна? Указать fallback-список через параметр models. Шлюз переберёт варианты по порядку и выберет первую работающую; биллинг — только за успешно отработавшую модель. Также provider.allow_fallbacks: true переключает провайдеров внутри одной модели.

Поддерживает ли OpenRouter изображения и vision-модели? Да. Модели с vision (Claude Opus, GPT-5, Gemini 2.5 Pro, Llama 4 Vision, Qwen3 VL) принимают изображения в стандартном OpenAI-формате — image_url или base64 в content. Шлюз прозрачно передаёт мультимодальные запросы провайдеру.

Есть ли у OpenRouter SLA? На pay-as-you-go тарифе — нет формального SLA. Доступность зависит от провайдеров. Для гарантированного uptime — Enterprise-план с кастомным SLA и приоритетной поддержкой.

Что такое BYOK в OpenRouter? Bring Your Own Key — режим, при котором вы используете OpenRouter как маршрутизатор и аналитику, но платите провайдеру напрямую через свой собственный ключ Anthropic / OpenAI / Google. Полезно при оптовых скидках. Лимит — 1 миллион запросов в месяц бесплатно, дальше 5% комиссия со стандартной цены провайдера.

Как мигрировать с прямого OpenAI API на OpenRouter? Меняются две строки в инициализации клиента: baseURL на https://openrouter.ai/api/v1, apiKey на ключ OpenRouter. Имена моделей дополняются префиксом провайдера: gpt-4oopenai/gpt-4o. Формат запроса не меняется — SDK тот же.

Какая модель дешевле всего для продакшена? Самые низкие цены при адекватном качестве — у DeepSeek-V3.1 ($0.27 за миллион входных токенов) и Llama 4 Maverick ($0.18). Для совсем дешёвых сценариев — Gemini 2.5 Flash ($0.15) и Qwen3. Бесплатные модели подходят для тестов, в продакшене лимиты делают их ненадёжными без fallback.

Что значит суффикс :nitro и :floor у моделей? :nitro — приоритет на самого быстрого провайдера, для интерактивных сценариев. :floor — на самого дешёвого, для batch и фоновых задач. :online — доступ к web-поиску через встроенный плагин. :free — бесплатная версия с дневными лимитами.

Можно ли через OpenRouter генерировать изображения? Да: FLUX.1 dev и pro, Stable Diffusion 3.5, Recraft, Imagen 3, Ideogram. Эндпоинт тот же, формат отличается параметром modalities: ["image"]. Один баланс на текстовые и графические модели.

Что произойдёт, если закончатся деньги на балансе? Запросы к платным моделям возвращают 402 (Payment Required). Бесплатные остаются доступны в общих лимитах. Auto-top-up — автоматическое пополнение с привязанной карты при падении баланса ниже порога; страхует продакшен от внезапных простоев.

Дальше

OpenRouter — это шлюз, а не модель. Чтобы выбрать, что именно гонять через него, посмотрите карточки конкретных моделей: ChatGPT и OpenAI API, Anthropic / Claude API, DeepSeek и Qwen. Из российских альтернатив с оплатой рублями — GigaChat и общий обзор в сравнении российских нейросетей. Альтернативный шлюз для open-source — Together AI. Общая картина по API-агрегаторам — в материале API нейросетей.