Перейти к содержимому
← Блог
7 мин чтения

Claude Opus 5.5: что нового и как подключить в Kumo

Anthropic выпустила Claude Opus 5.5 — уровень Fable 5.1 за $4 и $20 за миллион токенов. Цены в Kumo, бенчмарки и две проверки, которыми вы убедитесь, что отвечает оригинальная модель.

anthropicclaudeopus 5.5проверка моделицены

22 сентября 2026 года Anthropic выпустила Claude Opus 5.5 — модель, которая на большинстве рабочих задач держит уровень Claude Fable 5.1, но стоит в 2,5 раза дешевле неё и на 20% дешевле прошлого Opus 5. Модель уже доступна в Kumo: тот же API, оплата с одного баланса рублями или криптовалютой и никаких недельных квот. И это оригинальный Opus 5.5, а не модель попроще под чужим именем, — ниже две проверки, которыми вы убедитесь в этом сами.

Контекст

1M токенов

до 128K токенов в одном ответе

Цена у Anthropic

$4 / $20

вход / выход за 1 млн токенов

Цена в Kumo

$2.2 / $11

−45% от прайса вендора

Terminal-Bench 4.0

66,4%

у Opus 5 — 52,3%

Что такое Claude Opus 5.5

Claude Opus 5.5 — первая модель семейства Claude 5.5 и, по формулировке самой Anthropic, её самый сильный результат на автоматическом аудите поведения за всё время. Идентификатор в API Anthropic — claude-opus-5-5; это не алиас, а закреплённый снимок модели, поэтому запрос по этому имени завтра вернёт ту же модель, что сегодня. Позиционируют её как модель для долгих агентных сессий: разбор репозитория, многошаговый цикл «код — тесты — исправление», работа с компьютером и длинные аналитические задачи.

Окно контекста — 1 млн токенов, максимум в одном ответе — 128 тысяч. Надёжная граница знаний — июнь 2026 года. Адаптивное «мышление» включено всегда, а уровень усилия по умолчанию — medium: модель сама решает, сколько думать над задачей, и на простом запросе не тратит бюджет на рассуждения. Anthropic обещает не выводить её из обращения раньше 22 сентября 2027 года.

Практический смысл релиза — в соотношении цены и уровня. До 22 сентября выбор между «умнее» и «дешевле» стоил кратной разницы в счёте: Fable 5.1 просит $10 за миллион входных токенов и $50 за миллион выходных. Opus 5.5 закрывает большую часть того же класса задач за $4 и $20 — и делает это, по замерам Anthropic, на 30% быстрее на выдаче.

Чем Opus 5.5 отличается от Opus 5

Восемь тестов из анонса Anthropic в порядке убывания результата Opus 5.5. GDPval-AA вынесен под график: это рейтинг Elo, а не проценты, и на одной шкале с ними ему не место.
ТестClaude Opus 5.5Claude Opus 5
Terminal-Bench 4.066,4%52,3%
FrontierCode v1.154,4%48,0%
CursorBench 4.057,8%46,6%
OSWorld 2.0 (частичный зачёт)81,8%74,0%
GDPval-AA v2.11846 Elo1708 Elo
Цифры Anthropic из анонса 22 сентября 2026 года. Методика и условия прогонов — на странице анонса.

Главный скачок — там, где модель работает сама: Terminal-Bench и CursorBench меряют не одиночный ответ, а доведение задачи до конца в терминале и в редакторе. Плюс четырнадцать и плюс одиннадцать пунктов — это разница между «агент дописал» и «агент застрял на третьем шаге».

Anthropic отдельно называет ещё две вещи. Первая — расход: на типовой нагрузке прогон обходится на 40% дешевле, чем у Opus 5, и не только из-за ставки, но и потому, что модель тратит меньше токенов на ту же работу. Вторая — манера отвечать: меньше жаргона и вводных, важное в начале ответа. На ревью диффов и на отчётах это заметно сильнее, чем прирост в процентах.

Что именно подешевело

Сравнение вендора с собственной прошлой моделью. В Kumo Opus 5.5 стоит ещё на 45% ниже перечисленного здесь.

Сколько стоит Claude Opus 5.5

Что тарифицируетсяAnthropicKumo
Вход, без кэша$4$2.2
Выход$20$11
Чтение кэша$0.2$0.11
Запись кэша$5$2.75
USD за 1 млн токенов, без Batch API и специальных режимов. Каталожная скидка Kumo — 40% от прайса вендора, но на Opus 5.5 она глубже: 45%. Действующие цифры всегда в прайсе на странице моделей.
Полая точка — та же модель по цене Kumo. Чем левее и выше, тем больше работы за доллар.

Opus 5.5 уже доступен в Kumo

Модель подключена в общий каталог и работает с того же ключа и того же баланса, что и остальные: отдельной подписки, ожидания квоты и второго счёта не нужно. Оплатить баланс можно российской картой, через СБП или криптовалютой, а тратить — на любую модель каталога.

В Kumo модель называется anthropic/claude-opus-5-5 — под этим именем она стоит в списке моделей. Доступны оба протокола. OpenAI-совместимые клиенты идут на https://api.kumorouter.com/v1, клиенты на протоколе Anthropic Messages — на голый origin https://api.kumorouter.com, потому что они сами дописывают /v1/messages. Ключ принимается и как Authorization: Bearer, и как x-api-key, так что настоящий клиент Claude заводится без прослойки.

Ограничение честно: у каждого ключа свои лимиты расхода и уведомления, и мы не логируем тела запросов — только метаданные тарификации: модель, число токенов и время.

export KUMO_API_KEY="kumo_sk_…"

# OpenAI-совместимые клиенты
export OPENAI_BASE_URL="https://api.kumorouter.com/v1"
export OPENAI_API_KEY="$KUMO_API_KEY"

# клиенты на протоколе Anthropic Messages
export ANTHROPIC_BASE_URL="https://api.kumorouter.com"
export ANTHROPIC_AUTH_TOKEN="$KUMO_API_KEY"

Модель оригинальная — и это можно проверить

Главный страх при покупке доступа через посредника — что под именем дорогой модели ответит модель подешевле. Страх обоснованный: проверить это на глаз нельзя, а разница в счёте между Opus 5.5 и моделью попроще бывает кратной.

Поэтому мы не просим верить на слово. В Kumo модель не подменяется: запросили anthropic/claude-opus-5-5 — отвечает anthropic/claude-opus-5-5, и каждый ответ называет, кто его дал. Ниже — две проверки, которые вы проводите сами, своим ключом. Они дополняют друг друга: первая ловит небрежную подмену, вторая — ту, которую не спрятать за правильной строкой в ответе.

Честная оговорка вперёд: ни одна из этих проверок не является криптографическим доказательством, и мы это не скрываем. Вместе они отсекают самые дешёвые способы подмены — а подделка, которая обходится дороже настоящей модели, не имеет экономического смысла.

Проверка 1. Каталог и эхо модели в ответе

# модель обязана быть в каталоге под своим настоящим идентификатором
curl -s https://api.kumorouter.com/v1/models \
  -H "Authorization: Bearer $KUMO_API_KEY" | grep -o '"anthropic/claude-opus-5-5"'

# поле model в ответе обязано повторять ровно то имя, которое вы отправили
curl -s https://api.kumorouter.com/v1/chat/completions \
  -H "Authorization: Bearer $KUMO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"anthropic/claude-opus-5-5","messages":[{"role":"user","content":"ping"}],"max_tokens":16}' \
  | python3 -c "import sys,json; d=json.load(sys.stdin); print(d['model'], d['usage'])"

Минута работы, и она отсекает самый частый случай: каталог, где под красивым именем стоит алиас на что-то другое. Смотрите на два места — на идентификатор в списке моделей и на поле model в теле ответа. В обоих должно стоять ровно anthropic/claude-opus-5-5.

Что эта проверка не доказывает: аккуратный посредник может вернуть правильную строку и при подмене. Поэтому она первая, а не единственная.

Проверка 2. Окно в 1M токенов и поиск иголки в стоге сена

python3 - <<'PY'
import os, httpx

needle = " Кодовая фраза дня — kumo-opus-55-million. "
filler = "Это служебный текст для заполнения окна контекста. " * 20000
question = " Вопрос: назови кодовую фразу дня одной строкой, без пояснений."
prompt = filler + needle + filler + question

r = httpx.post(
    "https://api.kumorouter.com/v1/chat/completions",
    headers={"Authorization": "Bearer " + os.environ["KUMO_API_KEY"]},
    json={
        "model": "anthropic/claude-opus-5-5",
        "messages": [{"role": "user", "content": prompt}],
        "max_tokens": 64,
    },
    timeout=900,
)
body = r.json()
print(body["usage"]["prompt_tokens"], "токенов на входе")
print(body["choices"][0]["message"]["content"])
PY

Эту проверку дешёвая модель не проходит физически. Окно в 200 тысяч токенов не примет запрос на несколько сотен тысяч — вернётся ошибка о превышении контекста, и подмена вскроется сама. Модель с настоящим миллионным окном примет запрос и назовёт фразу, спрятанную ровно в середине.

Смотрите на оба числа: и на ответ, и на prompt_tokens. Счётчик входа заодно показывает, что запрос дошёл целиком, а не был втихую обрезан посередине.

Проверка не бесплатная: запрос выходит порядка полумиллиона входных токенов, а это по цене Kumo примерно доллар. Дешевле, чем один день работы на модели, которой вы не доверяете.

Что каждая проверка доказывает, а что нет

ПроверкаЧто доказываетЧего не доказывает
Каталог и эхо modelЧто маршрут заявлен под настоящим именемНичего о том, кто на самом деле ответил
Окно 1M и иголкаЧто у модели настоящее миллионное окноНе отличает Opus 5.5 от Fable 5.1
Журнал запросов в консолиЧто списано ровно за ту модельНе проверяет содержимое ответа
Проверки устроены так, чтобы каждая следующая закрывала слепое пятно предыдущей.

Как подключить Opus 5.5 за пять минут

  1. Зарегистрируйтесь в консоли и пополните баланс — картой, через СБП или криптовалютой.
  2. Создайте ключ и сразу поставьте ему лимит расхода: отдельный ключ на проект избавляет от разбирательств, куда ушли деньги.
  3. Пропишите адрес шлюза в своём клиенте — https://api.kumorouter.com/v1 для OpenAI-совместимых, голый origin для клиентов на протоколе Anthropic.
  4. Укажите модель anthropic/claude-opus-5-5 и отправьте первый запрос.
  5. Прогоните проверки 1 и 2 из этой статьи — до того, как начнёте тратить всерьёз.
curl -s https://api.kumorouter.com/v1/chat/completions \
  -H "Authorization: Bearer $KUMO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "anthropic/claude-opus-5-5",
    "messages": [
      {"role": "user", "content": "Найди в этом репозитории все места, где читается переменная окружения, и собери таблицу."}
    ],
    "max_tokens": 2048
  }'

Частые вопросы

Чем Opus 5.5 отличается от Fable 5.1 и что выбрать?
Fable 5.1 остаётся верхней моделью для самых тяжёлых рассуждений и очень длинных агентных сессий. Opus 5.5 закрывает большую часть тех же задач за $4 и $20 против $10 и $50 и отвечает быстрее. Разумный порядок — начинать с Opus 5.5 и подниматься к Fable 5.1 там, где ваши собственные прогоны показали нехватку.
Это точно тот же Opus 5.5, что у Anthropic напрямую?
Да: маршрут ведёт к оригинальной модели, а не к её заменителю. Проверяется это двумя способами из раздела выше — каталогом и эхом идентификатора и миллионным окном с иголкой. Обе проверки вы проводите сами, своим ключом, а за что списан каждый запрос, видно в журнале запросов консоли.
Почему в Kumo дешевле, чем у вендора?
Каталожная скидка — 40% от прайса вендора на обычные входные и выходные токены, а на Opus 5.5 при запуске она глубже: 45%, то есть $2.2 и $11 вместо $4 и $20. На больших объёмах сверху действует лестница пакетов. Сравнивайте одинаковую версию модели и одинаковый вид токенов: обычный вход, чтение кэша и запись кэша тарифицируются по разным ставкам.
Нужна ли подписка и есть ли недельные квоты?
Нет. Оплата идёт по расходу с одного баланса: пополнили — работаете, кончилось — пополнили ещё. Недельных и дневных квот подписки здесь нет, а лимиты расхода вы ставите себе сами на каждый ключ.
Когда появятся Sonnet 5.5 и Haiku 5.5?
Anthropic обещает их в ближайшие недели с похожим приростом. Мы подключаем новые модели вендоров по мере их выхода — следите за страницей моделей и блогом.

Источники

  • Анонс Anthropic: Introducing Claude Opus 5.5 — бенчмарки, цены и данные о безопасности.
  • Документация вендора: обзор моделей Claude — идентификаторы, окно контекста, границы знаний и сроки поддержки.
  • Прайс Anthropic: Pricing — ставки кэша, Batch API и цены на платформах облаков.
  • Цены Kumo: страница моделей — действующие ставки по каждой модели каталога.

Начните строить на Kumo сегодня

Один base URL, один баланс, любая модель — по эффективному тарифу, который виден до того, как потрачен токен