Перейти к содержимому
← Блог
8 мин чтения

GPT-6 Sol: что нового и как подключить в Kumo

OpenAI выпустила GPT-6 Sol — вдвое дешевле GPT-5.6 Sol и рядом с лучшими моделями Claude при цене задачи в разы ниже. В Kumo — $1.1 и $5.5 за миллион токенов. Бенчмарки и две проверки, которыми вы убедитесь, что отвечает оригинальная модель.

gpt-6gpt-6 solopenaiпроверка моделицены

22 сентября 2026 года OpenAI выпустила GPT-6 Sol — рабочую модель поколения GPT-6 для программирования и агентов, обученную теми же методами, что и флагманская GPT-6 Astra. По опубликованным OpenAI тестам Sol держится на уровне лучших моделей Claude при цене задачи в разы ниже, а стоит вдвое дешевле GPT-5.6 Sol. Модель уже доступна в Kumo — на 45% дешевле прайса OpenAI: тот же API, оплата с одного баланса рублями или криптовалютой и никаких недельных квот. И это оригинальная GPT-6 Sol, а не модель попроще под её именем, — ниже две проверки, которыми вы убедитесь в этом сами.

Контекст

1,05M токенов

до 128K токенов в одном ответе

Цена у OpenAI

$2 / $10

вход / выход за 1 млн токенов

Цена в Kumo

$1.1 / $5.5

−45% от прайса вендора

AutomationBench

33,2%

за 9% цены задачи Claude Opus 5

Что такое GPT-6 Sol

В начале сентября OpenAI представила GPT-6 Astra — свою самую сильную модель. Sol — следующий шаг того же поколения: OpenAI обучала её теми же методами, что и Astra, и переносит её достижения в профессиональной работе, фактической точности, программировании и работе с компьютером в модель быстрее и дешевле. Astra при этом остаётся лучшей моделью линейки, и OpenAI прямо советует брать её там, где нужен максимальный результат без компромиссов.

GPT-6 Sol — рабочая лошадь для сложного программирования и агентных сценариев: разбор репозитория, цикл «код — тесты — исправление», автоматизация процессов в десятках инструментов. Идентификатор в API OpenAI — gpt-6-sol. Вместе с ней OpenAI выпустила GPT-6 Luna — самую экономичную модель поколения для массовых задач; в Kumo она пока недоступна.

Окно контекста — 1 050 000 токенов, до 128 тысяч токенов в одном ответе; на входе текст и изображения, на выходе текст. Граница знаний — 20 апреля 2026 года. Уровень рассуждений настраивается параметром reasoning.effort от none до max, по умолчанию — medium.

Практический смысл релиза — цена. OpenAI снизила ставки Sol на 50% относительно промо-цены GPT-5.6 Sol и объясняет это улучшениями кэширования и инференса, а не акцией: теперь это $2 за миллион входных токенов и $10 за миллион выходных.

Чем Sol лучше предшественницы

Три теста из анонса OpenAI. Соперника и уровень усилия на каждом тесте выбирала OpenAI, поэтому у каждого столбца подписано, с кем именно сравнение.

Главная мысль анонса — не рекорд, а цена результата. На AutomationBench, где агент проходит бизнес-процессы в 47 инструментах от продаж до финансов, Sol на уровне усилия xhigh набирает 33,2% и обходит Claude Opus 5 на max, тратя 9% его цены за задачу. На DeepSWE v1.1 — долгих задачах в реальных репозиториях — Sol на max набирает 68,8%, в 1,1 пункта от лучшего результата Claude Fable 5, примерно на 80% дешевле за задачу. На OSWorld 2.0 в работе с компьютером Sol и Opus 5 практически вровень, 60,5% против 60,3%, и снова с разницей в цене около 80%. На Agents’ Last Exam, где агенты решают долгие профессиональные задачи из 55 отраслей, Sol на max набирает 56,4% — выше лучшего результата Opus 5 при цене задачи на 60% ниже.

Две вещи OpenAI называет отдельно. Фактическая точность: на внутренней выборке разговоров, где пользователи отмечали ошибки, Sol ошибается примерно вдвое реже GPT-5.6 Sol. Манера ответа: от Astra модель унаследовала более ясную речь — меньше жаргона, меньше лишних деталей, ответы чуть короче без потери содержания; в разговорах о коде это заметнее всего.

И честная оговорка: все сравнения — с Claude Opus 5 и Fable 5.1, а не с Claude Opus 5.5, вышедшим в тот же день. Прямого сравнения с ним OpenAI не публиковала, так что выбирать между ними стоит по собственным задачам.

Цену задачи OpenAI называет в долларах только для Sol; остальные точки пересчитаны из её же множителей (3,9×, 8,9×, 11,1×). Стоимость Fable 5.1 занижена: в ней нет фолбэков на Opus 5, которые понадобились примерно в 40% задач.

Что именно подешевело

Прайс OpenAI и ставки Kumo до и после, проценты посчитаны из самих цен. У OpenAI GPT-5.6 Sol сравнивается по промо-цене.

Вторая половина экономии — кэш. Для GPT-6 OpenAI улучшила кэширование промптов: кэшированные входные токены стоят 10% обычной ставки, доля попаданий в кэш по умолчанию выросла, а смена уровня рассуждений и набора инструментов посреди диалога больше не сбрасывает кэш. Для агентов, которые раз за разом отправляют один и тот же длинный контекст, это заметнее, чем снижение базовой ставки.

Сколько стоит GPT-6 Sol

Что тарифицируетсяOpenAIKumo
Вход, без кэша$2$1.1
Чтение кэша$0.2$0.1 ($0.11)
Запись кэша$2.5$1.4 ($1.375)
Выход$10$5.5
Запрос длиннее 272K токенов×2 на вход и кэш, ×1,5 на выходте же ставки
USD за 1 млн токенов, стандартная обработка, без Batch, Flex и ускоренного режима. Ставка Kumo на 45% ниже прайса вендора; в скобках — точная ставка, если на витрине она округлена. Действующие цифры — всегда в прайсе на странице моделей.

GPT-6 Sol уже доступна в Kumo

Модель подключена в общий каталог и работает с того же ключа и того же баланса, что и остальные: отдельной подписки, ожидания квоты и второго счёта не нужно. Оплатить баланс можно российской картой, через СБП или криптовалютой, а тратить — на любую модель каталога, включая GPT-6 Astra и модели Claude.

В Kumo модель называется openai/gpt-6-sol. Работают оба OpenAI-протокола на https://api.kumorouter.com/v1: Responses API (/v1/responses) и Chat Completions (/v1/chat/completions). Если агенту нужны инструменты, берите Responses API: это ограничение самой OpenAI — в Chat Completions вызов функций у GPT-6 работает только с reasoning_effort, равным none.

Контроль — у вас: у каждого ключа свои лимиты расхода и уведомления, а тела запросов мы не логируем — только метаданные тарификации: модель, число токенов и время.

export KUMO_API_KEY="kumo_sk_…"

# OpenAI-совместимые клиенты и SDK
export OPENAI_BASE_URL="https://api.kumorouter.com/v1"
export OPENAI_API_KEY="$KUMO_API_KEY"

Модель оригинальная — и это можно проверить

Главный страх при покупке доступа через посредника — что под именем дорогой модели ответит модель подешевле. Проверить это на глаз нельзя, а соблазн у посредника есть: у той же OpenAI есть модели в разы дешевле Sol, и тихо отдать одну из них — самая выгодная подмена.

Поэтому мы не просим верить на слово. В Kumo модель не подменяется: запросили openai/gpt-6-sol — отвечает GPT-6 Sol, и каждый ответ называет, кто его дал. Ниже — две проверки, которые вы проводите сами, своим ключом и за несколько минут. Первая ловит небрежную подмену, вторая — ту, которую не спрятать за правильной строкой в ответе.

Честная оговорка вперёд: ни одна из этих проверок не является криптографическим доказательством, и модель того же поколения OpenAI они надёжно не отличают. Вместе они закрывают дешёвые способы подмены, а в конце — что делать с той, которую они не ловят.

Проверка 1. Каталог и эхо модели в ответе

# модель обязана быть в каталоге под своим настоящим именем
curl -s https://api.kumorouter.com/v1/models \
  -H "Authorization: Bearer $KUMO_API_KEY" | grep -o '"openai/gpt-6-[a-z]*"'

# поле model в ответе обязано назвать ту модель, которую вы запросили
curl -s https://api.kumorouter.com/v1/responses \
  -H "Authorization: Bearer $KUMO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-6-sol","input":"ping","max_output_tokens":512}' \
  | python3 -c "import sys,json; d=json.load(sys.stdin); print(d['model'], d['usage'])"

Минута работы, и она отсекает самый частый случай: каталог, где под красивым именем стоит алиас на что-то другое. Смотрите на два места — на имя в списке моделей и на поле model в теле ответа. В списке модель значится как openai/gpt-6-sol, а поле model повторяет ровно то имя, которое вы отправили, — без суффиксов и без чужих имён.

Что эта проверка не доказывает: аккуратный посредник может вернуть правильную строку и при подмене. Поэтому она первая, а не единственная.

Проверка 2. Окно в 1,05M токенов и поиск иголки в стоге сена

python3 - <<'PY'
import os, httpx

needle = " Кодовая фраза дня — kumo-gpt6-million. "
filler = "Это служебный текст для заполнения окна контекста. " * 20000
question = " Вопрос: назови кодовую фразу дня одной строкой, без пояснений."

r = httpx.post(
    "https://api.kumorouter.com/v1/responses",
    headers={"Authorization": "Bearer " + os.environ["KUMO_API_KEY"]},
    json={
        "model": "openai/gpt-6-sol",
        "input": filler + needle + filler + question,
        "reasoning": {"effort": "low"},
        "max_output_tokens": 1024,
    },
    timeout=900,
)
body = r.json()
print(body["usage"]["input_tokens"], "токенов на входе")
print(body["output"][-1]["content"][0]["text"])
PY

Эту проверку модель с коротким окном не проходит физически. Окно в 128 или 400 тысяч токенов не примет запрос на полмиллиона с лишним токенов — вернётся ошибка о превышении контекста, и подмена вскроется сама. Модель с настоящим окном в 1,05 миллиона примет запрос и назовёт фразу, спрятанную ровно в середине.

Смотрите на оба числа: и на ответ, и на input_tokens. Счётчик входа заодно показывает, что запрос дошёл целиком, а не был втихую обрезан посередине.

Проверка не бесплатная, но дешёвая: полмиллиона с небольшим входных токенов по ставке Kumo — около 60 центов, потому что надбавки за длинный контекст в Kumo нет. Это дешевле, чем один день работы на модели, которой вы не доверяете.

Что каждая проверка доказывает, а что нет

ПроверкаЧто доказываетЧего не доказывает
Каталог и эхо modelЧто маршрут заявлен под настоящим именемНичего о том, кто на самом деле ответил
Окно 1,05M и иголкаЧто у модели настоящее окно больше миллионаНе отличает Sol от других моделей GPT-6
Журнал запросов в консолиЧто списано ровно за ту модельНе проверяет содержимое ответа
Проверки устроены так, чтобы каждая следующая закрывала слепое пятно предыдущей. Модель того же поколения OpenAI надёжно не отличает ни одна из них — это делают ваши собственные задачи и журнал запросов.

Как подключить GPT-6 Sol за пять минут

  1. Зарегистрируйтесь в консоли и пополните баланс — картой, через СБП или криптовалютой.
  2. Создайте ключ и сразу поставьте ему лимит расхода: отдельный ключ на проект избавляет от разбирательств, куда ушли деньги.
  3. Пропишите в своём клиенте адрес шлюза https://api.kumorouter.com/v1 и ключ Kumo вместо ключа OpenAI.
  4. Укажите модель openai/gpt-6-sol и отправьте первый запрос; для инструментов — через Responses API.
  5. Прогоните обе проверки из этой статьи — до того, как начнёте тратить всерьёз.
curl -s https://api.kumorouter.com/v1/responses \
  -H "Authorization: Bearer $KUMO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-6-sol",
    "reasoning": {"effort": "high"},
    "input": "Напиши на Go функцию, которая читает конфигурацию из переменных окружения с проверкой обязательных полей, и тесты к ней.",
    "max_output_tokens": 4096
  }'

Частые вопросы

GPT-6 Sol или GPT-6 Astra?
Astra — для самых тяжёлых задач, где важен лучший результат, а не цена. Sol — основная модель для программирования и агентов: по тестам OpenAI она обходит Astra на low и держится рядом с лучшими моделями Claude, а в Kumo стоит $1.1 и $5.5 против $6 и $30 у Astra. Разумный порядок — начинать с Sol и подниматься к Astra там, где ваши собственные прогоны показали нехватку.
GPT-6 Sol или Claude Opus 5.5?
По прайсу вендоров Sol вдвое дешевле: $2 и $10 против $4 и $20 за миллион токенов. По качеству прямого сравнения нет — OpenAI сравнивала Sol с Claude Opus 5 и Fable 5.1, а Opus 5.5 вышел в тот же день. Обе модели доступны в Kumo с одного ключа, так что честнее всего прогнать одни и те же задачи на обеих и сравнить результат и списание в журнале запросов.
Это точно та же GPT-6 Sol, что у OpenAI напрямую?
Да: маршрут ведёт к оригинальной модели, а не к её заменителю. Проверяется это двумя способами из раздела выше — каталогом и эхом имени и окном в 1,05 миллиона, — а журнал запросов в консоли показывает, за какую модель списаны деньги. Обе проверки вы проводите сами, своим ключом.
Почему в Kumo дешевле, чем у вендора?
Маршрутизационная скидка у GPT-6 Sol на день публикации — 45% от прайса OpenAI на все виды токенов, а на больших объёмах действует ещё и лестница пакетов. Сравнивайте одинаковый вид токенов: обычный вход, чтение кэша и запись кэша тарифицируются по разным ставкам.
Нужна ли подписка и есть ли недельные квоты?
Нет. Оплата идёт по расходу с одного баланса: пополнили — работаете, кончилось — пополнили ещё. Недельных и дневных квот подписки здесь нет, а лимиты расхода вы ставите себе сами на каждый ключ.
Когда появится GPT-6 Luna?
Мы открываем модель для запросов только после того, как проверили её маршрут, поэтому Luna в Kumo пока недоступна. Когда она появится, это будет видно на странице моделей и в блоге.
Что будет с GPT-5.6 Sol?
OpenAI не объявляла о её выводе, и в каталоге Kumo она остаётся. Но GPT-6 Sol вдвое дешевле и по тестам вендора сильнее, так что переходить есть смысл — достаточно поменять имя модели в запросе.

Источники

  • Анонс OpenAI: Introducing GPT-6 Sol and Luna — бенчмарки, цены, кэширование и данные о безопасности.
  • Документация вендора: страница GPT-6 Sol — окно контекста, лимит ответа, граница знаний, ставки кэша и длинного контекста.
  • Кэширование: Better prompt caching for GPT-6 — что изменилось в кэше промптов.
  • Цены Kumo: страница моделей — действующие ставки по каждой модели каталога.

Начните строить на Kumo сегодня

Один base URL, один баланс, любая модель — по эффективному тарифу, который виден до того, как потрачен токен