Перейти к содержимому

Как это работает

Один шлюз. Каждая модель. Ваш за минуты.

Kumo стоит перед каждой крупной LLM как единый OpenAI-совместимый endpoint. Вы меняете один base URL; мы берём на себя маршрутизацию, биллинг и доступ — и возвращаем вам оптимизированный тариф.

Как устроен сервис

Что происходит на каждом вызове.

01

Вы обращаетесь к одному endpoint

Наведите ваш текущий OpenAI SDK на api.kumorouter.com/v1 и отправьте запрос, который уже написали. Никакого нового клиента, никакого SDK под каждую модель.

02

Мы применяем оптимизированный тариф

Каждый вызов тарифицируется по оптимизированной эффективной ставке Kumo для конкретно вашей модели — без тарифных планов и переключателей. Закрепите модель — и получите её, без даунгрейда.

03

Вы получаете ответ провайдера дословно

Ответ — апстрим-провайдерский, без изменений. Каждый вызов сообщает, какой моделью он обслужен — так что вы можете проверить это сами, а не верить на слово.

04

Всё списывается с одного баланса

Токены, запросы, задержка и расход стекают в один дашборд. Лимитируйте расход, ставьте алерты, пополняйте раз — и прекращайте сверять пять инвойсов от вендоров.

На чём мы стоим

Реальные аккаунты. Реальные модели. Без обмана.

Kumo — не обёртка вокруг обёртки. У нас прямые, оплаченные аккаунты у самих лабораторий — поэтому каталог, который вы видите, это каталог, который вы реально вызываете, по оптимизированному тарифу Kumo.

Прямые аккаунты у лабораторий

Мы подключаемся напрямую к OpenAI, Anthropic и Google по собственным зарезервированным контрактам — без цепочки реселлеров. Ваш вызов доходит до реального провайдера, каждый раз.

Один живой каталог

30 активных text-моделей и цен, которые вы видите, — это те, что мы реально обслуживаем; тот же список, что читает таблица цен. Никаких фантомных моделей и подмены.

Тариф следует за рынком

Эффективный тариф следует за прайсом апстрим-провайдера — когда лаборатория снижает цену, ваша тоже падает.

Доступ к нескольким провайдерам

Если выбранный провайдер выдаёт ошибку, вы получаете 502 и можете повторить запрос или переключить провайдера вручную.

Почему дешевле — и при этом честно

Те же модели, честная цена.

Вы получаете не подделку. Это GPT, Claude и Gemini, оплачиваемые через Kumo — по сниженному эффективному тарифу, который вы видите точной цифрой до того, как потратите.

Те же модели, реальные аккаунты

GPT, Claude и Gemini, оплачиваемые через Kumo — не подделка и не даунгрейд.

Тариф виден до траты

Точная ставка по модели — заранее. Без скрытых строк и неожиданных множителей.

Покупайте оптом — экономьте больше

Закрепите объём заранее и зафиксируйте более низкий тариф на срок.

Никакой тихой подмены

Закрепите модель — и получите именно её. Каждый ответ — провайдерский, дословно.

30–50%

ниже реальный счёт за токены

Точная экономия зависит от вашего профиля нагрузки и объёма — тариф по модели вы всегда видите до того, как потратите.

Те же model ID, ответ провайдера — дословно: вы просите модель — вы получаете именно её, без тихой замены. Закрепите её — и это гарантировано, а каждый вызов сообщает, какой моделью он обслужен. Так что не верьте на слово — вы можете это проверить.

Независимое исследование: как проверить, что API не подменил модель на слабее →

Drop-in совместимость

Одна строка. Экономия — сразу.

Настоящий интерактивный терминал — введите команду или кликните шаг. Вся миграция, вызов и то, сколько он сэкономил.

kumo — интерактивный терминал
авто-демо
kumo — интерактивный терминал · введите ‘help’ или выберите шаг →
$

Безопасность и шифрование

Ваши данные остаются вашими.

Kumo — это слой биллинга и маршрутизации, а не озеро данных. Мы обрабатываем только то, что нужно для обслуживания и учёта запроса — и ничего более.

Шифрование при передаче и в покое

Каждый запрос идёт по TLS 1.2+; хранимые метаданные и секреты шифруются в покое по AES-256. API-ключи хранятся хэшированными и показываются один раз — при создании.

Никогда не идут в обучение

Промпты и ответы никогда не используются для обучения моделей. Они пересылаются, чтобы обслужить ваш запрос, и затем удаляются.

Тела промптов не логируются

Мы храним метаданные использования для биллинга — количество токенов, модель, таймстемп — а не содержимое ваших промптов или ответов. Используйте собственную политику хранения.

Ключи с областью действия

Каждый ключ ограничен и отзываем, показывается один раз при создании.

FAQ

Вопросы и ответы.

Всё, что нужно знать о покупке и расходе токенов на Kumo.

Нет. Kumo говорит на OpenAI API для подключённых text endpoints. Наведите base URL вашего текущего SDK на https://api.kumorouter.com/v1, подставьте свой ключ Kumo — и оставьте остальной chat/completions-style код.

Поднимите свой шлюз уже сегодня.

Один base URL, один баланс, вся команда за ним. Бесплатный старт.