OpenRouter — единый API для всех нейросетей
OpenRouter — это API-шлюз, через который один ключ открывает доступ сразу к 400+ моделям ИИ от 60+ провайдеров: Claude, GPT-5, Gemini, DeepSeek, Llama, Qwen, Mistral, GigaChat и десятки других. Один баланс, один формат запроса, один SDK. Не нужно регистрироваться в каждом сервисе отдельно и жонглировать набором ключей.
Запущен в 2023 году, к 2026-му стал стандартом де-факто: через openrouter.ai проходит более 100 триллионов токенов в месяц, у платформы 8+ миллионов пользователей и 250 000+ интегрированных приложений. По Wordstat — 26 838 показов в месяц по запросу «openrouter».
Что такое OpenRouter и зачем он нужен
OpenRouter решает три проблемы при работе с несколькими моделями:
- Десяток регистраций и ключей. Без шлюза нужны отдельные аккаунты у OpenAI, Anthropic, Google, DeepSeek, Mistral — у каждого свой биллинг и свой SDK. OpenRouter заменяет это одной регистрацией.
- Переключение моделей требует переписывания кода. Прямой переход с GPT-5 на Claude Opus — смена SDK, формата сообщений, обработки ошибок. Через OpenRouter меняется одна строка.
- Сбои у провайдера = простой продукта. Если Claude недоступен — продакшен встаёт. Шлюз делает fallback: при сбое первой модели запрос идёт ко второй.
Архитектурно OpenRouter — это прокси между приложением и моделями. Запрос приходит на openrouter.ai/api/v1, шлюз выбирает провайдера и возвращает ответ в OpenAI-совместимом формате. Под капотом — собственная edge-инфраструктура, которая снижает задержку до уровня прямого подключения к провайдеру.
Ключевые функции
Unified API
Один HTTP-эндпоинт https://openrouter.ai/api/v1/chat/completions для всех моделей. Формат — стандартный OpenAI chat completions. Любая библиотека или фреймворк, который умеет OpenAI API (LangChain, LlamaIndex, Vercel AI SDK, официальный openai-python, openai-node), работает с OpenRouter без правок — только меняется baseURL и apiKey. То же касается клиентов: Cursor, Continue, Zed, Cline, Aider, Open WebUI — все принимают custom OpenAI-base URL и заводятся на OpenRouter за минуту.
Auto-routing
OpenRouter подбирает оптимального провайдера для модели автоматически: учитывает доступность, цену, задержку, нагрузку. Для популярных моделей (Llama, DeepSeek, Qwen) есть несколько провайдеров одной и той же модели — шлюз роутит на самого дешёвого или быстрого в моменте.
Параметры provider.order, provider.allow_fallbacks, provider.sort настраивают маршрутизацию вручную: зафиксировать провайдера, расширить пул, отсортировать по throughput, latency или price. У моделей бывают суффиксы: :nitro — приоритет на самый быстрый провайдер, :floor — на самый дешёвый, :free — бесплатная версия. Пример: meta-llama/llama-4-maverick:nitro.
Fallback
В одном запросе указывается список моделей в порядке предпочтения:
{
"models": [
"anthropic/claude-opus-4.7",
"openai/gpt-5",
"google/gemini-2.5-pro"
],
"messages": [...]
}
Если первая модель недоступна или вернула ошибку — OpenRouter автоматически идёт ко второй, потом к третьей. Биллинг — только за успешно отработавшую модель. Прямые API таких возможностей не предлагают: fallback пришлось бы реализовывать в коде вручную, со своей логикой ретраев и таймаутов.
Web Search
OpenRouter поддерживает плагин web — добавление актуальных данных из интернета в ответ модели. Подключается параметром при запросе:
{
"model": "anthropic/claude-opus-4.7",
"plugins": [{ "id": "web" }],
"messages": [...]
}
Полезно для моделей без встроенного web-доступа (DeepSeek, Llama, Mistral). Тарифицируется отдельно по числу поисковых запросов — не нужно поднимать собственный SerpAPI или Tavily.
Vision
Модели с поддержкой изображений (Claude Opus, GPT-5, Gemini 2.5 Pro, Llama 4 Vision, Qwen3 VL) принимают картинки в стандартном OpenAI-формате: image_url либо base64 в content. OpenRouter прозрачно прокидывает мультимодальные запросы провайдеру. В каталоге у таких моделей стоит тег multimodal.
Prompt Caching
Для моделей с нативным кэшированием контекста (Claude, GPT, Gemini) OpenRouter поддерживает передачу cache-маркеров. Повторные запросы с одинаковой системной частью оплачиваются по сниженной ставке — экономия до 90% на длинных промтах. Особенно заметно в RAG-сценариях и чат-ботах с длинным system prompt.
BYOK
Bring Your Own Key — режим, в котором вы используете OpenRouter как роутер и аналитику, но платите провайдеру напрямую через свой ключ Anthropic / OpenAI / Google. Полезно при крупных оптовых скидках. Лимит — 1 миллион запросов в месяц бесплатно, дальше 5% комиссия. Включается в дашборде: добавляете внешний ключ, помечаете нужные модели, OpenRouter автоматически роутит запросы через него. Аналитика, логи, fallback на резервные модели — продолжают работать.
Структурированный вывод
Параметр response_format транслируется провайдеру: если модель умеет structured output (GPT-5, Gemini 2.5 Pro, Claude Sonnet 4.6), ответ приходит строго по схеме без парсинга markdown. Полезно для извлечения данных, генерации форм, классификации с фиксированной таксономией.
Какие модели доступны
В каталоге OpenRouter — более 400 моделей от всех крупных провайдеров. Ключевые группы:
| Провайдер | Модели |
|---|---|
| Anthropic | Claude Opus 4.7, Sonnet 4.6, Haiku 4.5 |
| OpenAI | GPT-5, GPT-5 mini, GPT-4.1, GPT-4o, o3, o3-mini |
| Gemini 2.5 Pro, Gemini 2.5 Flash, Gemini 2.0 | |
| DeepSeek | DeepSeek-V3.1, DeepSeek-R1 |
| Meta | Llama 4 Maverick, Llama 4 Scout, Llama 3.3 70B |
| Mistral | Mistral Large 3, Codestral, Mixtral 8x22B |
| xAI | Grok 3, Grok 3 mini |
| Qwen | Qwen3 Max, Qwen3 Coder, Qwen3 VL |
| Yi, Phi, Cohere, Nous | open-source модели |
Полный актуальный список и цены — openrouter.ai/models. Каталог обновляется 1-2 раза в неделю. У каждой модели есть карточка со статистикой throughput, latency и uptime по провайдерам за сутки и неделю.
Image-модели и популярность
Кроме текстовых LLM, OpenRouter маршрутизирует генеративные image-модели: FLUX.1 dev и pro, Stable Diffusion 3.5, Recraft v3, Imagen 3, Ideogram. Запрос идёт через тот же эндпоинт с параметром modalities: ["image"]. Цены сопоставимы с Replicate и fal.ai.
По публичному рейтингу OpenRouter в 2026-м верхние строчки занимают open-source модели: Qwen3-Coder, DeepSeek-R2, MiniMax M2.5 и Llama 4 Maverick. Из проприетарных лидируют Claude Sonnet 4.6 (на длинном кодинге) и GPT-5 mini (универсальный baseline). Тренд — «дешёвая open-source + точечный fallback на флагман».
Тарифы и цены
OpenRouter работает по модели pay-per-use: оплата только за фактически использованные токены, без подписки и фикс-платежей.
Базовая цена за токены равна прайс-листу провайдера — наценки нет. OpenRouter зарабатывает на комиссии при пополнении баланса: 5.5% при оплате картой / банковским переводом / криптой.
Примерные цены на главные модели 2026:
| Модель | Вход (за 1М токенов) | Выход (за 1М токенов) |
|---|---|---|
| Claude Opus 4.7 | $15 | $75 |
| Claude Sonnet 4.6 | $3 | $15 |
| Claude Haiku 4.5 | $1 | $5 |
| GPT-5 | $10 | $40 |
| GPT-5 mini | $0.3 | $1.2 |
| Gemini 2.5 Pro | $3.5 | $10.5 |
| Gemini 2.5 Flash | $0.15 | $0.6 |
| DeepSeek-V3.1 | $0.27 | $1.10 |
| Llama 4 Maverick | $0.18 | $0.6 |
Актуальные цены — на openrouter.ai/models.
Бесплатные модели
OpenRouter держит 25+ бесплатных моделей от 4 провайдеров: DeepSeek R1, Llama 3.3 70B, Gemma 3, Qwen3, Mistral 7B и другие open-source. Лимиты:
- 20 запросов в минуту
- 50 запросов в день для аккаунтов без баланса
- 1000 запросов в день для аккаунтов с балансом от $10
Бесплатных моделей хватает на обучение, прототипы и pet-проекты. Для продакшена с предсказуемым SLA — нужен платный баланс.
Минимальное пополнение
От $5. Этого хватает на тысячи запросов к дешёвым моделям (DeepSeek, Llama, Gemini Flash) или несколько сотен к флагманам. Можно настроить auto-top-up: при падении баланса ниже порога автоматически списывается фиксированная сумма. Скрытых платежей нет: ни минимальной ежемесячной платы, ни абонентки, ни оплаты за неактивные ключи.
Как оптимизировать расходы
Несколько практических приёмов, которые экономят значительную часть бюджета без потери качества:
- Маршрутизация по сложности. Простые задачи (классификация, извлечение полей) — на DeepSeek-V3.1 или Gemini Flash. Сложная логика и длинный контекст — на Claude Opus или GPT-5.
- Кэширование системного промта. Длинный system prompt кэшируется один раз и переиспользуется. Поддерживают Claude, GPT, Gemini.
max_tokensвсегда задавать. Выход дороже входа в 4–5 раз. Без лимита модель может выдать тысячи токенов на простом вопросе.- Batch вместо потоковых запросов. У ряда провайдеров есть batch-скидка 50% для отложенных запросов.
- Аналитика по моделям. В дашборде видно, какая модель сколько ест — это подсказывает, что переносить на дешёвые тарифы.
Доступ из России
OpenRouter — один из немногих зарубежных сервисов на нейросетях, который штатно работает из России: сайт открывается без VPN, регистрация принимает российский email, API-запросы идут с российских IP без прокси, OAuth-вход через Google и GitHub работает.
Что не работает напрямую: оплата российской картой — Stripe фильтрует BIN российских банков. Решения:
- Зарубежная виртуальная карта — через Zarub, Wanted, Easy Payments. Привязывается к балансу штатно. Подробнее в гайде по зарубежной карте.
- Криптовалюта — USDC через встроенный шлюз OpenRouter (Polygon, Base, Ethereum). USDC покупается через P2P на Bybit, OKX, Bitget. Самый дешёвый путь: комиссия сети — центы, наценки сверху нет.
- Сервисы-посредники (Oplatym, EasyPayments, ProxyAPI) — принимают рубли с российской карты, пополняют баланс OpenRouter. Комиссия 5–10%.
После пополнения работа с API из России идёт штатно: эндпоинты openrouter.ai не блокируют запросы с российских IP — выгодное отличие от прямого Anthropic / OpenAI API. Подробный обзор способов оплаты — в материале как пополнить OpenRouter из России на vc.ru.
Как зарегистрироваться
- Зайдите на openrouter.ai — без VPN.
- Sign in — Google, GitHub, MetaMask или Email.
- Credits — пополните баланс зарубежной картой / криптой / через посредника.
- Keys — создайте API-ключ (
sk-or-...). - Подставьте ключ в свой код или клиент.
Регистрация и создание ключа бесплатные. Баланс нужен только для платных моделей; на бесплатных можно начать без пополнения, в рамках 50 запросов/день.
Как подключить в коде
OpenRouter совместим с OpenAI SDK — поэтому работает с любым клиентом, который поддерживает OpenAI API.
Node.js
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://openrouter.ai/api/v1",
apiKey: process.env.OPENROUTER_API_KEY,
});
const response = await client.chat.completions.create({
model: "anthropic/claude-opus-4.7",
messages: [{ role: "user", content: "Привет!" }],
});
console.log(response.choices[0].message.content);
Python
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key=os.getenv("OPENROUTER_API_KEY"),
)
response = client.chat.completions.create(
model="anthropic/claude-opus-4.7",
messages=[{"role": "user", "content": "Привет!"}],
)
curl
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "anthropic/claude-opus-4.7",
"messages": [{"role": "user", "content": "Привет!"}]
}'
Fallback в одном запросе
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-d '{
"models": [
"anthropic/claude-opus-4.7",
"openai/gpt-5",
"google/gemini-2.5-pro"
],
"messages": [{"role": "user", "content": "Привет!"}]
}'
OAuth PKCE для приложений
Если строите сервис, где пользователи подключают свои собственные ключи OpenRouter (как Cursor, Cline, Open WebUI), не нужно копировать ключи руками: поддерживается OAuth PKCE через oauth/authorize. Пользователь нажимает «Connect OpenRouter», даёт согласие, ваше приложение получает ключ с ограниченным scope.
OpenRouter vs прямые API провайдеров
| Параметр | OpenRouter | Прямые API |
|---|---|---|
| Регистрация | один раз | у каждого провайдера |
| API-ключи | один | по одному на провайдера |
| Баланс | один общий | у каждого свой |
| Переключение модели | смена строки | переписывание интеграции |
| Fallback при сбоях | встроенный | реализуется в коде |
| Доступ из России | штатный | с прокси / VPN у части провайдеров |
| Базовая цена за токены | равна прайсу провайдера | прайс провайдера |
| Комиссия | 5.5% при пополнении | курсовая разница при оплате |
| Оптовые скидки | через BYOK | напрямую у провайдера |
| Платёжный шлюз из РФ | один (зарубежная карта / крипта) | у каждого свой |
Выбирать прямые API: стабильный высокий объём по одной модели (>$5k/мес) с оптовыми скидками; корпоративный договор и SLA с конкретным вендором; специфичные функции (Batch API у OpenAI, prompt-кэширование с кастомным TTL).
Выбирать OpenRouter: MVP и эксперименты; A/B-тестирование нескольких моделей; продакшен с fallback; несколько моделей под разные задачи; команды из России (упрощается оплата и доступ).
Миграция с OpenAI / Anthropic на OpenRouter
Переезд с прямого ключа OpenAI или Anthropic на OpenRouter занимает 10–15 минут — формат запроса совместим, SDK не меняется.
- Поменять
baseURLи ключ. В инициализации OpenAI-клиента две строки:baseURL: "https://openrouter.ai/api/v1"иapiKey: process.env.OPENROUTER_API_KEY. - Изменить идентификаторы моделей. Было
gpt-4o— сталоopenai/gpt-4o. Былоclaude-opus-4-20250101— сталоanthropic/claude-opus-4.7. Полный маппинг — в каталоге моделей. - Добавить fallback. Меняется
model: "..."наmodels: ["...", "...", "..."]— основной бонус миграции, устойчивость к сбоям одного провайдера. - Перенести нагрузку постепенно. На время теста — двойной трафик: 10% через OpenRouter, 90% напрямую. Если метрики качества и задержки не просели — поднять до 100%.
При миграции с Anthropic-SDK на OpenRouter формат сообщений не меняется: шлюз принимает OpenAI-формат и сам конвертирует под Anthropic. Специфичные beta-фичи Anthropic (computer-use и т.п.) — оставлять на прямом ключе.
Когда OpenRouter применяют на практике
- Продакшен с fallback. При сбое Claude запрос идёт к GPT-5, при сбое OpenAI — к Gemini. Пользователи не замечают локальных аварий.
- Эксперименты. Один датасет через 5–7 моделей, сравнить точность и стоимость, выбрать оптимум — час вместо нескольких дней.
- Бесплатные модели для обучения. Курсы используют бесплатные тиры Llama / DeepSeek / Qwen: один ключ на всех с лимитом по API.
- Multi-provider стратегия. Claude Opus на длинные документы, GPT-5 на сложную логику, Gemini Flash на лёгкие задачи, DeepSeek на классификации — один SDK, один баланс.
- Без вендор-лока. MVP на DeepSeek-V3 (~$0.27/М токенов), при росте — Claude Opus или GPT-5 без переписывания кода.
- Аналитика и FinOps. Дашборд показывает помодельный расход, задержку, число запросов и success rate.
Сценарии использования: типовые роли
- Разработчик AI-агента. Мультишаговый агент с маршрутизацией по этапам: классификация — Llama 4 Maverick, извлечение полей — DeepSeek-V3.1, генерация ответа — Claude Sonnet 4.6. Один SDK на все этапы, fallback на каждом шаге, кэширование длинного system prompt. Бюджет на тысячу обработанных писем — единицы долларов вместо десятков, если бы всё шло через GPT-5.
- Маркетолог тестирует модели. Один и тот же brief прогоняется через 6 моделей, результаты сравниваются в таблице, выбирается оптимум по соотношению «стиль / цена». Без шлюза — 6 регистраций и 6 биллингов; через OpenRouter — один скрипт и один баланс.
- Исследователь / data-аналитик. Датасет из тысячи примеров идёт через 3–4 модели для сравнения качества разметки. Скрипт один, модели меняются параметром
model. Черезprovider.sort: "throughput"максимальная скорость — обработка за минуты. - Команда курса или школы. Внутренний инструмент: ученики пробуют разные модели в одном интерфейсе. Преподаватель выдаёт ключ с месячным лимитом на студента, аналитика по расходу централизована. Удобнее, чем покупать ChatGPT Plus каждому.
Где OpenRouter не подходит
В нескольких случаях стоит идти напрямую к провайдеру:
- Premium-фичи без OpenRouter-эквивалента. Computer Use у Anthropic, Operator у OpenAI, Assistants API, Real-time API, Code Interpreter, нативный Files API — шлюз их не транслирует.
- Корпоративный SLA и DPA с конкретным вендором. Регуляторам (банки, медицина, госсектор) нужен прямой контракт. У OpenRouter Enterprise есть свой DPA, но он покрывает только шлюз.
- SLA 99.99% по контракту. Шлюз — дополнительный hop; каждый промежуточный сервис добавляет хвост к доступности.
- Очень крупный объём по одной модели. При $10k+/месяц по Claude или GPT-5 имеет смысл оптовая скидка напрямую или BYOK.
- Batch API у OpenAI. Скидка 50% на отложенные запросы доступна только напрямую.
- Fine-tuning. Создание собственной fine-tune модели — только через прямой API провайдера.
152-ФЗ и российские данные
OpenRouter — иностранный шлюз (юрлицо в США), в транзитной роли запросы не хранит. Хранят их провайдеры на другом конце: Anthropic и OpenAI по дефолту удаляют через 30 дней. Если в запросах есть персональные данные граждан РФ, формально нужна их первичная обработка на территории России — закрывается локальными моделями (GigaChat, YandexGPT) или обезличиванием до отправки. Для проектов без персональных данных (генерация текстов, классификация публичной информации, технические агенты) OpenRouter подходит штатно.
Лимиты и ограничения
- Rate limit на платном тарифе — зависит от модели и провайдера; для большинства флагманов — десятки RPM на старте, повышается по мере прогрева аккаунта.
- Rate limit на бесплатном тарифе — 20 RPM и 50 запросов в день без баланса, 1000 запросов в день с балансом от $10.
- Контекст — у каждой модели свой максимум. Claude Opus 4.7 — 200k токенов, GPT-5 — 1M, Gemini 2.5 — 2M. Дополнительных ограничений шлюз не накладывает.
- Стриминг — на всех моделях через стандартный OpenAI SSE-формат.
- Function calling / Tools, JSON Schema — на моделях с нативной поддержкой (Claude, GPT, Gemini, Mistral Large).
- Транспорт — REST и SSE; WebSocket не поддерживается, streaming покрывает 99% сценариев.
Альтернативы OpenRouter
- Together AI — фокус на open-source (Llama, Mistral, Qwen). Дешевле на отдельных моделях, но не даёт фронтиров от Anthropic / OpenAI.
- Replicate — больше про image и video, для LLM реже.
- Anyscale Endpoints — фокус на Llama, не такой широкий выбор провайдеров.
- Fireworks AI — open-source, акцент на скорости генерации.
- Прямые подключения к Anthropic API, OpenAI API, DeepSeek API — без посредника, но больше регистраций и интеграционной работы.
Для большинства задач в 2026 OpenRouter остаётся оптимумом по соотношению «универсальность / простота / цена». Подробный обзор — в материале по API нейросетей.
Безопасность и приватность
По официальной политике OpenRouter, шлюз не использует запросы для обучения моделей. Запросы пересылаются провайдеру; политика хранения зависит от провайдера (Anthropic и OpenAI — не дольше 30 дней без явного opt-in).
Для конфиденциальных данных в продакшене стоит:
- Включить zero-retention в настройках аккаунта OpenRouter — запросы не логируются.
- Использовать модели провайдеров с явной zero-retention политикой (Claude Enterprise, OpenAI Enterprise).
- Отдельный ключ для каждой среды (dev / staging / prod) с ограниченными лимитами.
- Фильтр
provider.data_collection: "deny"— запрос идёт только тем, кто не сохраняет данные.
Для регулируемых отраслей (медицина, финансы, госсектор) — прямой контракт с провайдером и подписанный DPA остаются более надёжным вариантом.
FAQ
Работает ли OpenRouter в России? Да, без VPN. Сайт openrouter.ai открывается напрямую, регистрация принимает российский email, API-запросы идут с российских IP без прокси. Единственное ограничение — оплата российской картой не проходит, нужна зарубежная карта, криптовалюта (USDC) или сервис-посредник.
Сколько реально стоит использование? Pet-проект с парой сотен запросов в день к DeepSeek — $1–3/мес. MVP на Claude Sonnet — $30–100/мес. Продакшен с миллионами токенов — $500–5000/мес.
Можно ли использовать OpenRouter бесплатно? Да. На бесплатном тарифе доступно 25+ open-source моделей (DeepSeek R1, Llama 3.3, Qwen3, Gemma 3) с лимитом 20 запросов в минуту и 50 в день. Этого хватает на обучение, прототипы и тесты.
OpenRouter выгоднее прямого OpenAI или Anthropic API? До $1000–2000 в месяц — почти всегда выгоднее за счёт простоты, fallback и единого баланса. На больших объёмах стоит сравнить с оптовыми скидками напрямую или использовать BYOK-режим.
Делает ли OpenRouter наценку на стоимость токенов? Нет. Базовая стоимость за вход/выход равна прайсу провайдера, шлюз показывает ровно те же цены, что у Anthropic / OpenAI / Google. Зарабатывает на комиссии 5.5% при пополнении баланса — токены при списании идут по цене провайдера.
Можно ли подключить OpenRouter к Claude Code или Cursor?
Да. В Cursor — Settings → Models → Custom OpenAI Base URL. В Claude Code — переменная ANTHROPIC_BASE_URL. Похожим способом подключаются Cline, Aider, Continue, Zed, Open WebUI.
Какой API-ключ использовать в продакшене? Отдельный ключ для каждой среды (dev, staging, prod). В дашборде задаются лимиты по балансу и числу запросов на ключ. При утечке ключ отзывается отдельно.
Что делать, если модель временно недоступна?
Указать fallback-список через параметр models. Шлюз переберёт варианты по порядку и выберет первую работающую; биллинг — только за успешно отработавшую модель. Также provider.allow_fallbacks: true переключает провайдеров внутри одной модели.
Поддерживает ли OpenRouter изображения и vision-модели?
Да. Модели с vision (Claude Opus, GPT-5, Gemini 2.5 Pro, Llama 4 Vision, Qwen3 VL) принимают изображения в стандартном OpenAI-формате — image_url или base64 в content. Шлюз прозрачно передаёт мультимодальные запросы провайдеру.
Есть ли у OpenRouter SLA? На pay-as-you-go тарифе — нет формального SLA. Доступность зависит от провайдеров. Для гарантированного uptime — Enterprise-план с кастомным SLA и приоритетной поддержкой.
Что такое BYOK в OpenRouter? Bring Your Own Key — режим, при котором вы используете OpenRouter как маршрутизатор и аналитику, но платите провайдеру напрямую через свой собственный ключ Anthropic / OpenAI / Google. Полезно при оптовых скидках. Лимит — 1 миллион запросов в месяц бесплатно, дальше 5% комиссия со стандартной цены провайдера.
Как мигрировать с прямого OpenAI API на OpenRouter?
Меняются две строки в инициализации клиента: baseURL на https://openrouter.ai/api/v1, apiKey на ключ OpenRouter. Имена моделей дополняются префиксом провайдера: gpt-4o → openai/gpt-4o. Формат запроса не меняется — SDK тот же.
Какая модель дешевле всего для продакшена? Самые низкие цены при адекватном качестве — у DeepSeek-V3.1 ($0.27 за миллион входных токенов) и Llama 4 Maverick ($0.18). Для совсем дешёвых сценариев — Gemini 2.5 Flash ($0.15) и Qwen3. Бесплатные модели подходят для тестов, в продакшене лимиты делают их ненадёжными без fallback.
Что значит суффикс :nitro и :floor у моделей?
:nitro — приоритет на самого быстрого провайдера, для интерактивных сценариев. :floor — на самого дешёвого, для batch и фоновых задач. :online — доступ к web-поиску через встроенный плагин. :free — бесплатная версия с дневными лимитами.
Можно ли через OpenRouter генерировать изображения?
Да: FLUX.1 dev и pro, Stable Diffusion 3.5, Recraft, Imagen 3, Ideogram. Эндпоинт тот же, формат отличается параметром modalities: ["image"]. Один баланс на текстовые и графические модели.
Что произойдёт, если закончатся деньги на балансе? Запросы к платным моделям возвращают 402 (Payment Required). Бесплатные остаются доступны в общих лимитах. Auto-top-up — автоматическое пополнение с привязанной карты при падении баланса ниже порога; страхует продакшен от внезапных простоев.
Дальше
OpenRouter — это шлюз, а не модель. Чтобы выбрать, что именно гонять через него, посмотрите карточки конкретных моделей: ChatGPT и OpenAI API, Anthropic / Claude API, DeepSeek и Qwen. Из российских альтернатив с оплатой рублями — GigaChat и общий обзор в сравнении российских нейросетей. Альтернативный шлюз для open-source — Together AI. Общая картина по API-агрегаторам — в материале API нейросетей.
Читайте также
- The Bird House: $1M/год на гостинге для Twitter — $65K/мес
- Neuro: $100M на жвачке с ноотропиками — кейс Райана Чена — $10M/мес
- Timeweb Cloud: российский edge-cloud для 2026
- Pixverse V5: нейросеть для вертикальных видео, обзор и тарифы 2026
- DeepSeek: китайская нейросеть, обзор V4 и R1, цены 2026
- Stella: $340K в месяц на приложении аффирмаций — $340K/мес
- GoTall: приложение-предсказатель роста на $100K/мес — $100K/мес