Перейти к содержанию

Модели и цены

В хабе — модели Anthropic, OpenAI, DeepSeek, z.ai и Moonshot AI. Все они доступны по одному ключу, оплачиваются с одного баланса и видны в одной аналитике.

Модели​

В запросе модель указывается идентификатором из списка — так же, как у самого провайдера:

ПровайдерМодели
Anthropicclaude-opus-5-5 claude-opus-5 claude-sonnet-5-5 claude-sonnet-5 claude-fable-5-1 claude-haiku-4-5-20251001
OpenAIgpt-6.1-sol gpt-6-sol gpt-6-astra gpt-6-luna gpt-5.6-sol gpt-5.6-terra gpt-5.6-luna gpt-5.5-pro gpt-5.4-mini gpt-5.4-nano
DeepSeekdeepseek-v4-pro deepseek-flash
z.aiglm-5.3 glm-5.3-flash glm-5.3-flashx
Moonshot AIkimi-k3 kimi-k2.7-code kimi-k2.7-code-highspeed
Примечание

Модели и цены регулярно обновляются. Актуальный список с ценами — в разделе «Тарифы» в хабе, а для программ — в ответе GET /openai/api/v1/models.

Выбор модели в агенте​

Codex и Claude Code получают каталог моделей от хаба, поэтому модели разных провайдеров появляются прямо в их меню выбора модели. Если у модели нет прямого маршрута для протокола агента, хаб конвертирует запросы сам.

Выбор модели в Claude: модели CoreInfra, включая GLM 5.3 Flash, GPT-5.6 и Kimi K3

Модели хаба в Claude Code.

Выбор модели в Codex: модели CoreInfra, включая DeepSeek V4, GLM 5.3 и Kimi K2.7 Code

Модели хаба в Codex.

Из чего складывается стоимость​

Цены указаны в рублях за миллион токенов. Токен — элементарный блок текста, которым оперирует модель, обычно несколько символов. В запросе учитываются:

  • Input — весь входной контекст: системный промпт, история диалога, код, файлы, описания инструментов и результаты их вызовов.
  • Output — ответ модели вместе с её рассуждениями. Рассуждения (reasoning) входят в output и выделяются только в аналитике.
  • Cache Read — часть контекста, уже посчитанная раньше. Такие токены заметно дешевле обычного input, поэтому кэш сильно снижает стоимость агентской работы.
  • Cache Write — запись контекста в кэш. У Anthropic запись на 5 минут и на 1 час тарифицируется по-разному, некоторые провайдеры запись не тарифицируют.
Формула
Стоимость запроса =
( Input × тариф Input
+ Cache Read × тариф Cache Read
+ Cache Write × тариф Cache Write
+ Output × тариф Output ) / 1 000 000

Веб-поиск, которым пользуются агенты, оплачивается отдельно — за каждый запрос. У части моделей действует тариф длинного контекста: если на входе больше 200 000 токенов, input стоит вдвое дороже, а output — в полтора раза. Подробнее о типах токенов — в статье блога «Что тарифицируют LLM-провайдеры».

Резерв и списание​

Пока запрос выполняется, хаб держит на балансе резерв — оценку его стоимости. Когда ответ получен, хаб списывает фактическую стоимость по токенам и снимает резерв. Если доступного остатка не хватает на новый запрос, хаб отклонит его и сообщит баланс, сумму резерва и доступный остаток со ссылкой на страницу оплаты.