Перейти к содержимому
← Блог
8 мин чтения

Grok 4.7: что нового и как подключить в Kumo

xAI выпустила Grok 4.7 — почти вдвое больше решённых задач Terminal-Bench при цене Grok 4.6: $2 и $6 за миллион токенов. Цены в Kumo, бенчмарки и две проверки, которыми вы убедитесь, что отвечает оригинальная модель.

grokgrok 4.7xaiпроверка моделицены

21 сентября 2026 года xAI выпустила Grok 4.7 — новую модель для программирования и интеллектуальной работы, которая стоит ровно столько же, сколько Grok 4.6, и работает с той же скоростью. За те же $2 и $6 за миллион токенов она решает почти вдвое больше задач Terminal-Bench, чем предшественница. Модель уже доступна в Kumo: тот же API, оплата с одного баланса рублями или криптовалютой и никаких недельных квот. И это оригинальный Grok 4.7, а не модель попроще под чужим именем, — ниже две проверки, которыми вы убедитесь в этом сами.

Контекст

500K токенов

на входе текст и изображения

Цена у xAI

$2 / $6

вход / выход за 1 млн, до 200K контекста

Цена в Kumo

$1.1 / $3.3

−45% от прайса вендора

Terminal-Bench 4.0

37,6%

у Grok 4.6 — 20,3%

Что такое Grok 4.7

Grok 4.7 — по формулировке самой xAI, её самая способная модель для программирования и интеллектуальной работы. Она дольше держится на трудных задачах, тщательнее проверяет собственный результат и лучше управляется с длинным контекстом. Отдельно xAI обучила её понимать собственный агентный харнесс Grok Bot — отсюда прирост в разговорных задачах и общей работе со знаниями.

Окно контекста — 500 тысяч токенов. На вход модель принимает текст и изображения (JPG и PNG до 20 МиБ), на выходе — текст. Поддерживаются вызов функций, структурированные ответы и рассуждения с регулируемым усилием: low, medium, high и xhigh, по умолчанию — high. Граница знаний — май 2026 года. Идентификатор у вендора — grok-4.7, в каталоге Kumo — xai/grok-4.7; алиас grok-4.7-latest у xAI со временем переедет на следующую версию, поэтому для воспроизводимых прогонов берите закреплённое имя.

Практический смысл релиза — в том, что цена не сдвинулась. Обычно новая версия приходит с новым прайсом, и апгрейд приходится считать. Здесь считать нечего: xAI подаёт Grok 4.7 по той же цене и с той же скоростью, что Grok 4.6, так что переход — это смена имени модели в запросе. А в Kumo Grok 4.7 даже дешевле предшественника: $1.1 и $3.3 против $1.2 и $3.6 у Grok 4.6. Для тех, кому важнее скорость, xAI держит ещё и быстрый вариант — вдвое быстрее на выдаче и вдвое дороже.

Чем Grok 4.7 отличается от Grok 4.6

Шесть тестов из анонса xAI в порядке убывания результата Grok 4.7. Все четыре модели прогоняла xAI на своём стенде; результат DeepSWE у Grok 4.7 получен на усилии рассуждений high.
ТестGrok 4.7Grok 4.6
Terminal-Bench 4.037,6%20,3%
EEBench64,0%53,0%
HealthBench Professional56,7%48,5%
CursorBench 4.046,3%40,4%
DeepSWE v1.1 (усилие high)71,0%65,2%
Harvey Legal19,6%15,8%
Цифры xAI из анонса 21 сентября 2026 года. Методика и условия прогонов — на странице анонса.

Главный скачок — снова там, где модель работает сама. Terminal-Bench меряет не отдельный ответ, а доведение задачи до конца в терминале, и плюс семнадцать пунктов здесь — это разница между агентом, который бросает задачу на полпути, и агентом, который её сдаёт. Прирост есть на всех шести тестах, от почти четырёх до семнадцати пунктов.

Честная рамка: Grok 4.7 — не новый лидер по программированию. На том же Terminal-Bench Claude Fable 5.1 у xAI набирает 57,9%, а на CursorBench — 51,8% против 46,3%. Зато выход Fable 5.1 стоит $50 за миллион токенов против $6 — больше чем в восемь раз. Grok 4.7 догнал GPT-5.6 Sol на Terminal-Bench и обошёл его на CursorBench, EEBench и Harvey Legal, уступив на DeepSWE и HealthBench.

И оговорка о чужих цифрах: результаты Fable 5.1 и GPT-5.6 Sol здесь — прогоны xAI, не их вендоров. Anthropic для того же Fable 5.1 на Terminal-Bench 4.0 публикует 55,8%: разные стенды дают разные числа, поэтому сравнивайте модели внутри одной таблицы, а не между анонсами.

Ещё одно изменение — защитный контур. xAI называет Grok 4.7 своей самой устойчивой моделью к джейлбрейкам и перестроила систему отказов целиком: на HackerBench v0.3 модель пропускает 3,3% рискованных запросов. Если ваша нагрузка граничит с безопасностью — пентест, разбор вредоносного кода, — прогоните на новой модели собственные промпты, прежде чем переключать трафик.

Что выросло при той же цене

Прирост в процентных пунктах, а не в процентах от старого результата. Цена и скорость у xAI те же, что у Grok 4.6.

Сколько стоит Grok 4.7

Что тарифицируетсяxAIKumo
Вход, контекст до 200K$2$1.1
Вход, контекст от 200K$4$1.1
Выход, контекст до 200K$6$3.3
Выход, контекст от 200K$12$3.3
Чтение кэша, до 200K / от 200K$0.5 / $1$0.3 ($0.275)
USD за 1 млн токенов. У xAI ставка удваивается, когда контекст запроса достигает 200 тысяч токенов; в тарифе Kumo, как и у Grok 4.6, отдельной ставки за длинный контекст нет. Ставка Kumo для Grok 4.7 — скидка 45% от прайса вендора; действующие цифры всегда в прайсе на странице моделей.
Полая точка — та же модель по цене Kumo. Чем левее и выше, тем больше работы за доллар; все три результата — прогоны xAI.

Grok 4.7 уже доступен в Kumo

Модель подключена в общий каталог и работает с того же ключа и того же баланса, что и остальные: отдельной подписки, ожидания квоты и второго счёта не нужно. Оплатить баланс можно российской картой, через СБП или криптовалютой, а тратить — на любую модель каталога, от Grok до Claude и GPT.

Grok в Kumo работает по OpenAI-совместимым протоколам — Chat Completions и Responses. Клиенты идут на https://api.kumorouter.com/v1, ключ передаётся как Authorization: Bearer. Если у вас уже настроен Grok 4.6, достаточно поменять имя модели на xai/grok-4.7.

Ограничение честно: у каждого ключа свои лимиты расхода и уведомления, и мы не логируем тела запросов — только метаданные тарификации: модель, число токенов и время.

export KUMO_API_KEY="kumo_sk_…"

# OpenAI-совместимые клиенты: Chat Completions и Responses
export OPENAI_BASE_URL="https://api.kumorouter.com/v1"
export OPENAI_API_KEY="$KUMO_API_KEY"

Модель оригинальная — и это можно проверить

Главный страх при покупке доступа через посредника — что под именем новой модели ответит модель подешевле. С Grok 4.7 он особенно понятен: у xAI предыдущая версия стоит столько же и работает с тем же окном, так что подмену на Grok 4.6 не выдаст ни прайс вендора, ни длина контекста — её выдаст только качество работы.

Поэтому мы не просим верить на слово. В Kumo модель не подменяется: запросили xai/grok-4.7 — отвечает Grok 4.7, и каждый ответ называет, кто его дал. Ниже — две проверки, которые вы проводите сами, своим ключом: первая занимает минуту и ловит небрежную подмену, вторая опирается на то, чего модель с коротким окном подделать не может.

Честная оговорка вперёд: ни одна из этих проверок не является криптографическим доказательством, и мы это не скрываем. Вместе они отсекают небрежную подмену и модели с окном короче 500 тысяч токенов; отличить Grok 4.7 от Grok 4.6 надёжнее всего ваши собственные задачи — таблица в конце раздела говорит, что какая проверка доказывает.

Проверка 1. Каталог и эхо модели в ответе

# модель обязана быть в каталоге под своим идентификатором
curl -s https://api.kumorouter.com/v1/models \
  -H "Authorization: Bearer $KUMO_API_KEY" | grep -o '"id":"xai/grok-4.7"'

# поле model в ответе обязано называть Grok 4.7
curl -s https://api.kumorouter.com/v1/chat/completions \
  -H "Authorization: Bearer $KUMO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"xai/grok-4.7","messages":[{"role":"user","content":"ping"}],"max_tokens":16}' \
  | python3 -c "import sys,json; d=json.load(sys.stdin); print(d['model'], d['usage'])"

Минута работы, и она отсекает самый частый случай: каталог, где под красивым именем стоит алиас на что-то другое. Смотрите на два места — на идентификатор в списке моделей и на поле model в теле ответа. Там должен стоять Grok 4.7, а не 4.6 и не чужая модель.

Что эта проверка не доказывает: аккуратный посредник может вернуть правильную строку и при подмене. Поэтому она первая, а не единственная.

Проверка 2. Окно в 500K токенов и поиск иголки в стоге сена

python3 - <<'PY'
import json, os, urllib.request

needle = " Кодовая фраза дня — kumo-grok-47-window. "
filler = "Это служебный текст для заполнения окна контекста. " * 12000
question = " Вопрос: назови кодовую фразу дня одной строкой, без пояснений."
prompt = filler + needle + filler + question

request = urllib.request.Request(
    "https://api.kumorouter.com/v1/chat/completions",
    data=json.dumps({
        "model": "xai/grok-4.7",
        "messages": [{"role": "user", "content": prompt}],
        "max_tokens": 64,
    }).encode(),
    headers={
        "Authorization": "Bearer " + os.environ["KUMO_API_KEY"],
        "Content-Type": "application/json",
    },
)
with urllib.request.urlopen(request, timeout=900) as response:
    body = json.load(response)
print(body["usage"]["prompt_tokens"], "токенов на входе")
print(body["choices"][0]["message"]["content"])
PY

Эту проверку модель с коротким окном не проходит физически. Окно в 128 или 200 тысяч токенов не примет запрос на несколько сотен тысяч — вернётся ошибка о превышении контекста, и подмена вскроется сама. Модель с настоящим окном в 500 тысяч примет запрос и назовёт фразу, спрятанную ровно в середине.

Смотрите на оба числа: и на ответ, и на prompt_tokens. Если счётчик входа заметно меньше ожидаемого, запрос был втихую обрезан посередине. Если prompt_tokens перевалил за 500 тысяч — уменьшите множитель у filler: чтобы проверка была честной, запрос должен влезать в окно.

Проверка почти бесплатна: около трёхсот тысяч входных токенов по цене Kumo — примерно треть доллара. Оговорка: у Grok 4.6 окно такое же, так что эта проверка отсекает чужие модели, но не предыдущую версию.

Что каждая проверка доказывает, а что нет

ПроверкаЧто доказываетЧего не доказывает
Каталог и эхо modelЧто маршрут заявлен под настоящим именемНичего о том, кто на самом деле ответил
Окно 500K и иголкаЧто у модели настоящее окно в 500 тысячНе отличает Grok 4.7 от Grok 4.6
Журнал запросов в консолиЧто списано ровно за ту модельНе проверяет содержимое ответа
Каждая проверка закрывает своё слепое пятно; версию внутри семейства различают только ваши собственные задачи.

Как подключить Grok 4.7 за пять минут

  1. Зарегистрируйтесь в консоли и пополните баланс — картой, через СБП или криптовалютой.
  2. Создайте ключ и сразу поставьте ему лимит расхода: отдельный ключ на проект избавляет от разбирательств, куда ушли деньги.
  3. Пропишите адрес шлюза https://api.kumorouter.com/v1 в своём OpenAI-совместимом клиенте.
  4. Укажите модель xai/grok-4.7 и отправьте первый запрос.
  5. Прогоните обе проверки из этой статьи — до того, как начнёте тратить всерьёз.
curl -s https://api.kumorouter.com/v1/chat/completions \
  -H "Authorization: Bearer $KUMO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "xai/grok-4.7",
    "messages": [
      {"role": "user", "content": "Найди в этом репозитории все места, где читается переменная окружения, и собери таблицу."}
    ],
    "max_tokens": 2048
  }'

Частые вопросы

Стоит ли переходить с Grok 4.6 на Grok 4.7?
Да, если вас устраивал Grok 4.6: у xAI цена и скорость те же, в Kumo Grok 4.7 даже дешевле, а прирост есть на всех шести опубликованных тестах. Переход — это смена имени модели в запросе. Одно исключение — промпты на грани политик безопасности: защитный контур у новой модели строже, прогоните их заранее.
Grok 4.7 или Claude — что выбрать?
По цифрам xAI самые тяжёлые агентные задачи в терминале и в редакторе лучше решает Claude Fable 5.1, но его выход стоит больше чем в восемь раз дороже. Grok 4.7 — рабочая лошадка: массовые задачи, длинные документы до 500 тысяч токенов, юридическая и аналитическая работа. Разумный порядок — начинать с дешёвой модели и подниматься там, где ваши собственные прогоны показали нехватку.
Это точно тот же Grok 4.7, что у xAI напрямую?
Да: маршрут ведёт к оригинальной модели, а не к её заменителю. Проверяется это двумя способами из раздела выше — каталогом и эхом идентификатора и окном в 500 тысяч, — а журнал запросов в консоли показывает, за какую модель списаны деньги. Обе проверки вы проводите сами, своим ключом.
Есть ли доплата за контекст длиннее 200 тысяч токенов?
У xAI есть: от 200 тысяч токенов контекста ставки удваиваются. В тарифе Kumo отдельной ставки за длинный контекст у Grok нет — действующая цена всегда на странице моделей.
Почему в Kumo дешевле, чем у вендора?
Для Grok 4.7 скидка — 45% от прайса вендора на обычные входные и выходные токены, а на больших объёмах действует лестница пакетов. Сравнивайте одинаковую версию модели и одинаковый вид токенов: обычный вход и чтение кэша тарифицируются по разным ставкам.
Нужна ли подписка и есть ли недельные квоты?
Нет. Оплата идёт по расходу с одного баланса: пополнили — работаете, кончилось — пополнили ещё. Недельных и дневных квот подписки здесь нет, а лимиты расхода вы ставите себе сами на каждый ключ.
Будет ли быстрый вариант Grok 4.7?
xAI подаёт его отдельно: вдвое быстрее на выдаче и вдвое дороже. Мы подключаем новые модели вендоров по мере их выхода — следите за страницей моделей и блогом.

Источники

  • Анонс xAI: Introducing Grok 4.7 — бенчмарки, цена, быстрый вариант и данные о безопасности.
  • Документация вендора: Grok 4.7 — идентификатор, окно контекста, модальности, уровни усилия и ставки по длине контекста.
  • Обзор моделей xAI: Models and pricing — граница знаний и сравнение с Grok 4.6.
  • Цены Kumo: страница моделей — действующие ставки по каждой модели каталога.

Начните строить на Kumo сегодня

Один base URL, один баланс, любая модель — по эффективному тарифу, который виден до того, как потрачен токен