Черновик · все ссылки ведут на dev-контуры платформы
SAMSA AI Войти

Router / API

Меняется базовый адрес и ключ. Остальной код остаётся прежним

Шлюз понимает два протокола — Anthropic Messages API и OpenAI Chat Completions — и проксирует запросы как есть. Любая библиотека и любой клиент, умеющие говорить с этими API, работают без переделки.

Зона Anthropic

Протокол Anthropic Messages API. Сюда ходят Claude Desktop, Claude Code и SDK Anthropic.

Базовый адрес

https://ai-router-dev.dev.0sk.ru/anthropic

Генерация — POST /v1/messages, список моделей — GET /v1/models. Инструменты, thinking, кеширование промпта и потоковый ответ работают как у оригинала.

Зона OpenAI

Протокол OpenAI Chat Completions. Сюда ходит большинство сторонних клиентов и библиотек.

Базовый адрес

https://ai-router-dev.dev.0sk.ru/openai/v1

Генерация — POST /chat/completions, список моделей — GET /models. Здесь живут GPT, Gemini и остальные модели, кроме тех, что доступны только по протоколу Anthropic.

Главное правило: шлюз не переводит запросы между протоколами. Модель нужно запрашивать в той зоне, где она объявлена. Линейка Claude и обе модели DeepSeek доступны в обеих.

Ключ и авторизация

Где взять

В кабинете, раздел «Ключи». Секрет показывается один раз: мы храним только его хэш, восстановить потерянный ключ невозможно — выпускается новый.

Как передавать

Шлюз понимает оба заголовка — Authorization: Bearer и x-api-key. Выбирайте тот, который умеет ваш клиент, но не оба сразу: два заголовка одновременно шлюз отклонит.

Что можно ограничить

Ключу задаются срок действия, месячный лимит расхода и список моделей, к которым он допущен. Ключ можно поставить на паузу обратимо или отозвать окончательно.

Модели и цены

Каталог живой: точный список доступных вам моделей отдаёт GET /v1/models в нужной зоне, с учётом политики вашего ключа. Действующие ставки — в кабинете, в разделе цен: мы намеренно не дублируем их на сайте, чтобы вы не сверялись с устаревшей таблицей.

Claude
Fable, Opus, Sonnet, Haiku — вся линейка Anthropic
GPT
Актуальная линейка OpenAI, включая экономичные варианты
Gemini
Google, в том числе генерация изображений
DeepSeek
Заметно дешевле при сопоставимом качестве на многих задачах
Grok, Kimi, Qwen, GLM
Альтернативные поставщики под конкретные задачи
Sonar
Поисковая модель — ответы с опорой на актуальный веб
Действующие цены в кабинете

Как считаются деньги

Списание одно за запрос, по факту

Мы списываем по фактическому расходу токенов, который вернул поставщик. Если поставщик ответил ошибкой — не списываем ничего. Баланс общий на аккаунт, а не на ключ: по ключу видно расход, но отдельного кошелька у него нет.

Что удивляет чаще всего. Самая заметная статья у агентных клиентов — не сами ответы, а разогрев кеша промпта: длинный системный промпт с набором инструментов тарифицируется как входные токены и записывается заново при переключении модели.

Проверка баланса выполняется перед запросом, лимита внутри запроса нет — один очень дорогой вызов может увести баланс в небольшой минус.

Чего шлюз пока не умеет

Codex CLI
Свежие версии требуют OpenAI Responses API — такого входа у шлюза пока нет.
Подсчёт токенов через API
Метод count_tokens не реализован; клиенты, которые на него рассчитывают, получат 404.
Перевод между протоколами
Модель нужно запрашивать в её зоне. Обращение из чужой зоны вернёт ошибку, а не молча переведёт запрос.

При ошибке шлюз возвращает идентификатор запроса X-Request-Id. Приложите его к обращению — по нему мы находим, что именно произошло.