22 сентября 2026 года Anthropic выпустила Claude Opus 5.5 — модель, которая на большинстве рабочих задач держит уровень Claude Fable 5.1, но стоит в 2,5 раза дешевле неё и на 20% дешевле прошлого Opus 5. Модель уже доступна в Kumo: тот же API, оплата с одного баланса рублями или криптовалютой и никаких недельных квот. И это оригинальный Opus 5.5, а не модель попроще под чужим именем, — ниже две проверки, которыми вы убедитесь в этом сами.
Контекст
1M токенов
до 128K токенов в одном ответе
Цена у Anthropic
$4 / $20
вход / выход за 1 млн токенов
Цена в Kumo
$2.2 / $11
−45% от прайса вендора
Terminal-Bench 4.0
66,4%
у Opus 5 — 52,3%
Что такое Claude Opus 5.5
Claude Opus 5.5 — первая модель семейства Claude 5.5 и, по формулировке самой Anthropic, её самый сильный результат на автоматическом аудите поведения за всё время. Идентификатор в API Anthropic — claude-opus-5-5; это не алиас, а закреплённый снимок модели, поэтому запрос по этому имени завтра вернёт ту же модель, что сегодня. Позиционируют её как модель для долгих агентных сессий: разбор репозитория, многошаговый цикл «код — тесты — исправление», работа с компьютером и длинные аналитические задачи.
Окно контекста — 1 млн токенов, максимум в одном ответе — 128 тысяч. Надёжная граница знаний — июнь 2026 года. Адаптивное «мышление» включено всегда, а уровень усилия по умолчанию — medium: модель сама решает, сколько думать над задачей, и на простом запросе не тратит бюджет на рассуждения. Anthropic обещает не выводить её из обращения раньше 22 сентября 2027 года.
Практический смысл релиза — в соотношении цены и уровня. До 22 сентября выбор между «умнее» и «дешевле» стоил кратной разницы в счёте: Fable 5.1 просит $10 за миллион входных токенов и $50 за миллион выходных. Opus 5.5 закрывает большую часть того же класса задач за $4 и $20 — и делает это, по замерам Anthropic, на 30% быстрее на выдаче.
Чем Opus 5.5 отличается от Opus 5
| Тест | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| Terminal-Bench 4.0 | 66,4% | 52,3% |
| FrontierCode v1.1 | 54,4% | 48,0% |
| CursorBench 4.0 | 57,8% | 46,6% |
| OSWorld 2.0 (частичный зачёт) | 81,8% | 74,0% |
| GDPval-AA v2.1 | 1846 Elo | 1708 Elo |
Главный скачок — там, где модель работает сама: Terminal-Bench и CursorBench меряют не одиночный ответ, а доведение задачи до конца в терминале и в редакторе. Плюс четырнадцать и плюс одиннадцать пунктов — это разница между «агент дописал» и «агент застрял на третьем шаге».
Anthropic отдельно называет ещё две вещи. Первая — расход: на типовой нагрузке прогон обходится на 40% дешевле, чем у Opus 5, и не только из-за ставки, но и потому, что модель тратит меньше токенов на ту же работу. Вторая — манера отвечать: меньше жаргона и вводных, важное в начале ответа. На ревью диффов и на отчётах это заметно сильнее, чем прирост в процентах.
Что именно подешевело
Сколько стоит Claude Opus 5.5
| Что тарифицируется | Anthropic | Kumo |
|---|---|---|
| Вход, без кэша | $4 | $2.2 |
| Выход | $20 | $11 |
| Чтение кэша | $0.2 | $0.11 |
| Запись кэша | $5 | $2.75 |
Opus 5.5 уже доступен в Kumo
Модель подключена в общий каталог и работает с того же ключа и того же баланса, что и остальные: отдельной подписки, ожидания квоты и второго счёта не нужно. Оплатить баланс можно российской картой, через СБП или криптовалютой, а тратить — на любую модель каталога.
В Kumo модель называется anthropic/claude-opus-5-5 — под этим именем она стоит в списке моделей. Доступны оба протокола. OpenAI-совместимые клиенты идут на https://api.kumorouter.com/v1, клиенты на протоколе Anthropic Messages — на голый origin https://api.kumorouter.com, потому что они сами дописывают /v1/messages. Ключ принимается и как Authorization: Bearer, и как x-api-key, так что настоящий клиент Claude заводится без прослойки.
Ограничение честно: у каждого ключа свои лимиты расхода и уведомления, и мы не логируем тела запросов — только метаданные тарификации: модель, число токенов и время.
export KUMO_API_KEY="kumo_sk_…"
# OpenAI-совместимые клиенты
export OPENAI_BASE_URL="https://api.kumorouter.com/v1"
export OPENAI_API_KEY="$KUMO_API_KEY"
# клиенты на протоколе Anthropic Messages
export ANTHROPIC_BASE_URL="https://api.kumorouter.com"
export ANTHROPIC_AUTH_TOKEN="$KUMO_API_KEY"
Модель оригинальная — и это можно проверить
Главный страх при покупке доступа через посредника — что под именем дорогой модели ответит модель подешевле. Страх обоснованный: проверить это на глаз нельзя, а разница в счёте между Opus 5.5 и моделью попроще бывает кратной.
Поэтому мы не просим верить на слово. В Kumo модель не подменяется: запросили anthropic/claude-opus-5-5 — отвечает anthropic/claude-opus-5-5, и каждый ответ называет, кто его дал. Ниже — две проверки, которые вы проводите сами, своим ключом. Они дополняют друг друга: первая ловит небрежную подмену, вторая — ту, которую не спрятать за правильной строкой в ответе.
Честная оговорка вперёд: ни одна из этих проверок не является криптографическим доказательством, и мы это не скрываем. Вместе они отсекают самые дешёвые способы подмены — а подделка, которая обходится дороже настоящей модели, не имеет экономического смысла.
Проверка 1. Каталог и эхо модели в ответе
# модель обязана быть в каталоге под своим настоящим идентификатором
curl -s https://api.kumorouter.com/v1/models \
-H "Authorization: Bearer $KUMO_API_KEY" | grep -o '"anthropic/claude-opus-5-5"'
# поле model в ответе обязано повторять ровно то имя, которое вы отправили
curl -s https://api.kumorouter.com/v1/chat/completions \
-H "Authorization: Bearer $KUMO_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"anthropic/claude-opus-5-5","messages":[{"role":"user","content":"ping"}],"max_tokens":16}' \
| python3 -c "import sys,json; d=json.load(sys.stdin); print(d['model'], d['usage'])"
Минута работы, и она отсекает самый частый случай: каталог, где под красивым именем стоит алиас на что-то другое. Смотрите на два места — на идентификатор в списке моделей и на поле model в теле ответа. В обоих должно стоять ровно anthropic/claude-opus-5-5.
Что эта проверка не доказывает: аккуратный посредник может вернуть правильную строку и при подмене. Поэтому она первая, а не единственная.
Проверка 2. Окно в 1M токенов и поиск иголки в стоге сена
python3 - <<'PY'
import os, httpx
needle = " Кодовая фраза дня — kumo-opus-55-million. "
filler = "Это служебный текст для заполнения окна контекста. " * 20000
question = " Вопрос: назови кодовую фразу дня одной строкой, без пояснений."
prompt = filler + needle + filler + question
r = httpx.post(
"https://api.kumorouter.com/v1/chat/completions",
headers={"Authorization": "Bearer " + os.environ["KUMO_API_KEY"]},
json={
"model": "anthropic/claude-opus-5-5",
"messages": [{"role": "user", "content": prompt}],
"max_tokens": 64,
},
timeout=900,
)
body = r.json()
print(body["usage"]["prompt_tokens"], "токенов на входе")
print(body["choices"][0]["message"]["content"])
PY
Эту проверку дешёвая модель не проходит физически. Окно в 200 тысяч токенов не примет запрос на несколько сотен тысяч — вернётся ошибка о превышении контекста, и подмена вскроется сама. Модель с настоящим миллионным окном примет запрос и назовёт фразу, спрятанную ровно в середине.
Смотрите на оба числа: и на ответ, и на prompt_tokens. Счётчик входа заодно показывает, что запрос дошёл целиком, а не был втихую обрезан посередине.
Проверка не бесплатная: запрос выходит порядка полумиллиона входных токенов, а это по цене Kumo примерно доллар. Дешевле, чем один день работы на модели, которой вы не доверяете.
Что каждая проверка доказывает, а что нет
| Проверка | Что доказывает | Чего не доказывает |
|---|---|---|
| Каталог и эхо model | Что маршрут заявлен под настоящим именем | Ничего о том, кто на самом деле ответил |
| Окно 1M и иголка | Что у модели настоящее миллионное окно | Не отличает Opus 5.5 от Fable 5.1 |
| Журнал запросов в консоли | Что списано ровно за ту модель | Не проверяет содержимое ответа |
Как подключить Opus 5.5 за пять минут
- Зарегистрируйтесь в консоли и пополните баланс — картой, через СБП или криптовалютой.
- Создайте ключ и сразу поставьте ему лимит расхода: отдельный ключ на проект избавляет от разбирательств, куда ушли деньги.
- Пропишите адрес шлюза в своём клиенте — https://api.kumorouter.com/v1 для OpenAI-совместимых, голый origin для клиентов на протоколе Anthropic.
- Укажите модель anthropic/claude-opus-5-5 и отправьте первый запрос.
- Прогоните проверки 1 и 2 из этой статьи — до того, как начнёте тратить всерьёз.
curl -s https://api.kumorouter.com/v1/chat/completions \
-H "Authorization: Bearer $KUMO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "anthropic/claude-opus-5-5",
"messages": [
{"role": "user", "content": "Найди в этом репозитории все места, где читается переменная окружения, и собери таблицу."}
],
"max_tokens": 2048
}'
Частые вопросы
- Чем Opus 5.5 отличается от Fable 5.1 и что выбрать?
- Fable 5.1 остаётся верхней моделью для самых тяжёлых рассуждений и очень длинных агентных сессий. Opus 5.5 закрывает большую часть тех же задач за $4 и $20 против $10 и $50 и отвечает быстрее. Разумный порядок — начинать с Opus 5.5 и подниматься к Fable 5.1 там, где ваши собственные прогоны показали нехватку.
- Это точно тот же Opus 5.5, что у Anthropic напрямую?
- Да: маршрут ведёт к оригинальной модели, а не к её заменителю. Проверяется это двумя способами из раздела выше — каталогом и эхом идентификатора и миллионным окном с иголкой. Обе проверки вы проводите сами, своим ключом, а за что списан каждый запрос, видно в журнале запросов консоли.
- Почему в Kumo дешевле, чем у вендора?
- Каталожная скидка — 40% от прайса вендора на обычные входные и выходные токены, а на Opus 5.5 при запуске она глубже: 45%, то есть $2.2 и $11 вместо $4 и $20. На больших объёмах сверху действует лестница пакетов. Сравнивайте одинаковую версию модели и одинаковый вид токенов: обычный вход, чтение кэша и запись кэша тарифицируются по разным ставкам.
- Нужна ли подписка и есть ли недельные квоты?
- Нет. Оплата идёт по расходу с одного баланса: пополнили — работаете, кончилось — пополнили ещё. Недельных и дневных квот подписки здесь нет, а лимиты расхода вы ставите себе сами на каждый ключ.
- Когда появятся Sonnet 5.5 и Haiku 5.5?
- Anthropic обещает их в ближайшие недели с похожим приростом. Мы подключаем новые модели вендоров по мере их выхода — следите за страницей моделей и блогом.
Источники
- Анонс Anthropic: Introducing Claude Opus 5.5 — бенчмарки, цены и данные о безопасности.
- Документация вендора: обзор моделей Claude — идентификаторы, окно контекста, границы знаний и сроки поддержки.
- Прайс Anthropic: Pricing — ставки кэша, Batch API и цены на платформах облаков.
- Цены Kumo: страница моделей — действующие ставки по каждой модели каталога.