22 сентября 2026 года OpenAI выпустила GPT-6 Sol — рабочую модель поколения GPT-6 для программирования и агентов, обученную теми же методами, что и флагманская GPT-6 Astra. По опубликованным OpenAI тестам Sol держится на уровне лучших моделей Claude при цене задачи в разы ниже, а стоит вдвое дешевле GPT-5.6 Sol. Модель уже доступна в Kumo — на 45% дешевле прайса OpenAI: тот же API, оплата с одного баланса рублями или криптовалютой и никаких недельных квот. И это оригинальная GPT-6 Sol, а не модель попроще под её именем, — ниже две проверки, которыми вы убедитесь в этом сами.
Контекст
1,05M токенов
до 128K токенов в одном ответе
Цена у OpenAI
$2 / $10
вход / выход за 1 млн токенов
Цена в Kumo
$1.1 / $5.5
−45% от прайса вендора
AutomationBench
33,2%
за 9% цены задачи Claude Opus 5
Что такое GPT-6 Sol
В начале сентября OpenAI представила GPT-6 Astra — свою самую сильную модель. Sol — следующий шаг того же поколения: OpenAI обучала её теми же методами, что и Astra, и переносит её достижения в профессиональной работе, фактической точности, программировании и работе с компьютером в модель быстрее и дешевле. Astra при этом остаётся лучшей моделью линейки, и OpenAI прямо советует брать её там, где нужен максимальный результат без компромиссов.
GPT-6 Sol — рабочая лошадь для сложного программирования и агентных сценариев: разбор репозитория, цикл «код — тесты — исправление», автоматизация процессов в десятках инструментов. Идентификатор в API OpenAI — gpt-6-sol. Вместе с ней OpenAI выпустила GPT-6 Luna — самую экономичную модель поколения для массовых задач; в Kumo она пока недоступна.
Окно контекста — 1 050 000 токенов, до 128 тысяч токенов в одном ответе; на входе текст и изображения, на выходе текст. Граница знаний — 20 апреля 2026 года. Уровень рассуждений настраивается параметром reasoning.effort от none до max, по умолчанию — medium.
Практический смысл релиза — цена. OpenAI снизила ставки Sol на 50% относительно промо-цены GPT-5.6 Sol и объясняет это улучшениями кэширования и инференса, а не акцией: теперь это $2 за миллион входных токенов и $10 за миллион выходных.
Чем Sol лучше предшественницы
Главная мысль анонса — не рекорд, а цена результата. На AutomationBench, где агент проходит бизнес-процессы в 47 инструментах от продаж до финансов, Sol на уровне усилия xhigh набирает 33,2% и обходит Claude Opus 5 на max, тратя 9% его цены за задачу. На DeepSWE v1.1 — долгих задачах в реальных репозиториях — Sol на max набирает 68,8%, в 1,1 пункта от лучшего результата Claude Fable 5, примерно на 80% дешевле за задачу. На OSWorld 2.0 в работе с компьютером Sol и Opus 5 практически вровень, 60,5% против 60,3%, и снова с разницей в цене около 80%. На Agents’ Last Exam, где агенты решают долгие профессиональные задачи из 55 отраслей, Sol на max набирает 56,4% — выше лучшего результата Opus 5 при цене задачи на 60% ниже.
Две вещи OpenAI называет отдельно. Фактическая точность: на внутренней выборке разговоров, где пользователи отмечали ошибки, Sol ошибается примерно вдвое реже GPT-5.6 Sol. Манера ответа: от Astra модель унаследовала более ясную речь — меньше жаргона, меньше лишних деталей, ответы чуть короче без потери содержания; в разговорах о коде это заметнее всего.
И честная оговорка: все сравнения — с Claude Opus 5 и Fable 5.1, а не с Claude Opus 5.5, вышедшим в тот же день. Прямого сравнения с ним OpenAI не публиковала, так что выбирать между ними стоит по собственным задачам.
Что именно подешевело
Вторая половина экономии — кэш. Для GPT-6 OpenAI улучшила кэширование промптов: кэшированные входные токены стоят 10% обычной ставки, доля попаданий в кэш по умолчанию выросла, а смена уровня рассуждений и набора инструментов посреди диалога больше не сбрасывает кэш. Для агентов, которые раз за разом отправляют один и тот же длинный контекст, это заметнее, чем снижение базовой ставки.
Сколько стоит GPT-6 Sol
| Что тарифицируется | OpenAI | Kumo |
|---|---|---|
| Вход, без кэша | $2 | $1.1 |
| Чтение кэша | $0.2 | $0.1 ($0.11) |
| Запись кэша | $2.5 | $1.4 ($1.375) |
| Выход | $10 | $5.5 |
| Запрос длиннее 272K токенов | ×2 на вход и кэш, ×1,5 на выход | те же ставки |
GPT-6 Sol уже доступна в Kumo
Модель подключена в общий каталог и работает с того же ключа и того же баланса, что и остальные: отдельной подписки, ожидания квоты и второго счёта не нужно. Оплатить баланс можно российской картой, через СБП или криптовалютой, а тратить — на любую модель каталога, включая GPT-6 Astra и модели Claude.
В Kumo модель называется openai/gpt-6-sol. Работают оба OpenAI-протокола на https://api.kumorouter.com/v1: Responses API (/v1/responses) и Chat Completions (/v1/chat/completions). Если агенту нужны инструменты, берите Responses API: это ограничение самой OpenAI — в Chat Completions вызов функций у GPT-6 работает только с reasoning_effort, равным none.
Контроль — у вас: у каждого ключа свои лимиты расхода и уведомления, а тела запросов мы не логируем — только метаданные тарификации: модель, число токенов и время.
export KUMO_API_KEY="kumo_sk_…"
# OpenAI-совместимые клиенты и SDK
export OPENAI_BASE_URL="https://api.kumorouter.com/v1"
export OPENAI_API_KEY="$KUMO_API_KEY"
Модель оригинальная — и это можно проверить
Главный страх при покупке доступа через посредника — что под именем дорогой модели ответит модель подешевле. Проверить это на глаз нельзя, а соблазн у посредника есть: у той же OpenAI есть модели в разы дешевле Sol, и тихо отдать одну из них — самая выгодная подмена.
Поэтому мы не просим верить на слово. В Kumo модель не подменяется: запросили openai/gpt-6-sol — отвечает GPT-6 Sol, и каждый ответ называет, кто его дал. Ниже — две проверки, которые вы проводите сами, своим ключом и за несколько минут. Первая ловит небрежную подмену, вторая — ту, которую не спрятать за правильной строкой в ответе.
Честная оговорка вперёд: ни одна из этих проверок не является криптографическим доказательством, и модель того же поколения OpenAI они надёжно не отличают. Вместе они закрывают дешёвые способы подмены, а в конце — что делать с той, которую они не ловят.
Проверка 1. Каталог и эхо модели в ответе
# модель обязана быть в каталоге под своим настоящим именем
curl -s https://api.kumorouter.com/v1/models \
-H "Authorization: Bearer $KUMO_API_KEY" | grep -o '"openai/gpt-6-[a-z]*"'
# поле model в ответе обязано назвать ту модель, которую вы запросили
curl -s https://api.kumorouter.com/v1/responses \
-H "Authorization: Bearer $KUMO_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"openai/gpt-6-sol","input":"ping","max_output_tokens":512}' \
| python3 -c "import sys,json; d=json.load(sys.stdin); print(d['model'], d['usage'])"
Минута работы, и она отсекает самый частый случай: каталог, где под красивым именем стоит алиас на что-то другое. Смотрите на два места — на имя в списке моделей и на поле model в теле ответа. В списке модель значится как openai/gpt-6-sol, а поле model повторяет ровно то имя, которое вы отправили, — без суффиксов и без чужих имён.
Что эта проверка не доказывает: аккуратный посредник может вернуть правильную строку и при подмене. Поэтому она первая, а не единственная.
Проверка 2. Окно в 1,05M токенов и поиск иголки в стоге сена
python3 - <<'PY'
import os, httpx
needle = " Кодовая фраза дня — kumo-gpt6-million. "
filler = "Это служебный текст для заполнения окна контекста. " * 20000
question = " Вопрос: назови кодовую фразу дня одной строкой, без пояснений."
r = httpx.post(
"https://api.kumorouter.com/v1/responses",
headers={"Authorization": "Bearer " + os.environ["KUMO_API_KEY"]},
json={
"model": "openai/gpt-6-sol",
"input": filler + needle + filler + question,
"reasoning": {"effort": "low"},
"max_output_tokens": 1024,
},
timeout=900,
)
body = r.json()
print(body["usage"]["input_tokens"], "токенов на входе")
print(body["output"][-1]["content"][0]["text"])
PY
Эту проверку модель с коротким окном не проходит физически. Окно в 128 или 400 тысяч токенов не примет запрос на полмиллиона с лишним токенов — вернётся ошибка о превышении контекста, и подмена вскроется сама. Модель с настоящим окном в 1,05 миллиона примет запрос и назовёт фразу, спрятанную ровно в середине.
Смотрите на оба числа: и на ответ, и на input_tokens. Счётчик входа заодно показывает, что запрос дошёл целиком, а не был втихую обрезан посередине.
Проверка не бесплатная, но дешёвая: полмиллиона с небольшим входных токенов по ставке Kumo — около 60 центов, потому что надбавки за длинный контекст в Kumo нет. Это дешевле, чем один день работы на модели, которой вы не доверяете.
Что каждая проверка доказывает, а что нет
| Проверка | Что доказывает | Чего не доказывает |
|---|---|---|
| Каталог и эхо model | Что маршрут заявлен под настоящим именем | Ничего о том, кто на самом деле ответил |
| Окно 1,05M и иголка | Что у модели настоящее окно больше миллиона | Не отличает Sol от других моделей GPT-6 |
| Журнал запросов в консоли | Что списано ровно за ту модель | Не проверяет содержимое ответа |
Как подключить GPT-6 Sol за пять минут
- Зарегистрируйтесь в консоли и пополните баланс — картой, через СБП или криптовалютой.
- Создайте ключ и сразу поставьте ему лимит расхода: отдельный ключ на проект избавляет от разбирательств, куда ушли деньги.
- Пропишите в своём клиенте адрес шлюза https://api.kumorouter.com/v1 и ключ Kumo вместо ключа OpenAI.
- Укажите модель openai/gpt-6-sol и отправьте первый запрос; для инструментов — через Responses API.
- Прогоните обе проверки из этой статьи — до того, как начнёте тратить всерьёз.
curl -s https://api.kumorouter.com/v1/responses \
-H "Authorization: Bearer $KUMO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-6-sol",
"reasoning": {"effort": "high"},
"input": "Напиши на Go функцию, которая читает конфигурацию из переменных окружения с проверкой обязательных полей, и тесты к ней.",
"max_output_tokens": 4096
}'
Частые вопросы
- GPT-6 Sol или GPT-6 Astra?
- Astra — для самых тяжёлых задач, где важен лучший результат, а не цена. Sol — основная модель для программирования и агентов: по тестам OpenAI она обходит Astra на low и держится рядом с лучшими моделями Claude, а в Kumo стоит $1.1 и $5.5 против $6 и $30 у Astra. Разумный порядок — начинать с Sol и подниматься к Astra там, где ваши собственные прогоны показали нехватку.
- GPT-6 Sol или Claude Opus 5.5?
- По прайсу вендоров Sol вдвое дешевле: $2 и $10 против $4 и $20 за миллион токенов. По качеству прямого сравнения нет — OpenAI сравнивала Sol с Claude Opus 5 и Fable 5.1, а Opus 5.5 вышел в тот же день. Обе модели доступны в Kumo с одного ключа, так что честнее всего прогнать одни и те же задачи на обеих и сравнить результат и списание в журнале запросов.
- Это точно та же GPT-6 Sol, что у OpenAI напрямую?
- Да: маршрут ведёт к оригинальной модели, а не к её заменителю. Проверяется это двумя способами из раздела выше — каталогом и эхом имени и окном в 1,05 миллиона, — а журнал запросов в консоли показывает, за какую модель списаны деньги. Обе проверки вы проводите сами, своим ключом.
- Почему в Kumo дешевле, чем у вендора?
- Маршрутизационная скидка у GPT-6 Sol на день публикации — 45% от прайса OpenAI на все виды токенов, а на больших объёмах действует ещё и лестница пакетов. Сравнивайте одинаковый вид токенов: обычный вход, чтение кэша и запись кэша тарифицируются по разным ставкам.
- Нужна ли подписка и есть ли недельные квоты?
- Нет. Оплата идёт по расходу с одного баланса: пополнили — работаете, кончилось — пополнили ещё. Недельных и дневных квот подписки здесь нет, а лимиты расхода вы ставите себе сами на каждый ключ.
- Когда появится GPT-6 Luna?
- Мы открываем модель для запросов только после того, как проверили её маршрут, поэтому Luna в Kumo пока недоступна. Когда она появится, это будет видно на странице моделей и в блоге.
- Что будет с GPT-5.6 Sol?
- OpenAI не объявляла о её выводе, и в каталоге Kumo она остаётся. Но GPT-6 Sol вдвое дешевле и по тестам вендора сильнее, так что переходить есть смысл — достаточно поменять имя модели в запросе.
Источники
- Анонс OpenAI: Introducing GPT-6 Sol and Luna — бенчмарки, цены, кэширование и данные о безопасности.
- Документация вендора: страница GPT-6 Sol — окно контекста, лимит ответа, граница знаний, ставки кэша и длинного контекста.
- Кэширование: Better prompt caching for GPT-6 — что изменилось в кэше промптов.
- Цены Kumo: страница моделей — действующие ставки по каждой модели каталога.