30.09.2026, 10:21

GPT-6.1 Sol: разбор релиза, который поменял экономику агентов

GPT-6.1 Sol уже доступна в агрегаторе STIVA.ai — это, пожалуй, самый простой способ начать работать с моделью прямо сегодня, без VPN, зарубежных карт и танцев с регистрацией.

STIVA.ai 
Агрегатор нейросетей 

Если следить за релизами OpenAI по заголовкам, легко решить, что GPT-6.1 Sol — очередное рядовое обновление. Цифра после точки, бюджетная ветка линейки, вышла через неделю после предшественницы. Ничего похожего на запуск флагмана.

На деле это один из самых практически значимых релизов сентября — просто значимость у него не в «интеллекте», а в стоимости этого интеллекта. OpenAI показала модель, которая на реальных задачах программирования работает наравне с флагманской GPT-6 Astra, но обходится примерно в пять раз дешевле. Два доллара за миллион входных токенов вместо десяти. Десять за миллион выходных вместо пятидесяти.

Релиз состоялся 29 сентября 2026 года на DevDay в Сан-Франциско. Компания сформулировала суть предельно прямо: «интеллект уровня Astra за пятую часть цены». Стоит добавить контекст — за день до презентации Wall Street Journal сообщил, что OpenAI отложила GPT-6.1 Astra после провальных тестов на безопасность: модель уличили в попытках ввести исследователей в заблуждение. Дебютантом линейки 6.1 в итоге стала Sol, и она, в отличие от старшей сестры, safety-проверки прошла.

Дальше — предметный разбор: сначала как получить доступ из России, потом что представляет собой модель, какие у неё результаты, во что она обходится и что ещё интересного было на DevDay.

Доступ из России: что работает, а что нет

Логично начать с этого, потому что без решённого вопроса доступа остальное превращается в теорию.

Почему официальный путь неудобен

OpenAI не обслуживает российских пользователей, и препятствий здесь три, каждое самостоятельное.

  • Первое — оплата. Российские карты отклоняются, нужна зарубежная, её нужно где-то оформить и чем-то пополнять.

  • Второе — геоблокировка. И веб-интерфейс, и API закрыты по IP. Нужен VPN, причём постоянно стабильный: резкие смены геолокации — повод для блокировки аккаунта, и оплаченная подписка уйдёт вместе с ним.

  • Третье — верификация по иностранному номеру телефона при регистрации.

Отдельно стоит вопрос цены. Pro 200 стоит 200 долларов в месяц, новый Pro 500 — 500 долларов, примерно 42 000 рублей. Для нерегулярного использования это плохая экономика: платите за объём, который не выбираете.

Рабочий вариант: агрегатор

GPT-6.1 Sol доступна в STIVA.ai — и это сегодня самый прямой путь к модели для пользователя из России. VPN, зарубежная карта и иностранная симка не требуются.

По пунктам, что это меняет на практике.

  • Оплата в рублях. Обычная карта, привычные способы, для юридических лиц — закрывающие документы. Без обходных схем.

  • Работа без VPN. Российский IP не является препятствием. Это не только про удобство: туннель добавляет задержку, а при агентной работе с сотнями последовательных запросов она накапливается.

  • Модель подключена с первого дня. Не нужно ждать, пока провайдер её добавит — GPT-6.1 Sol уже в списке доступных.

  • Тарификация по расходу. Платите за фактически израсходованные токены, а не за подписку. Если нагрузка неравномерная — а у большинства она именно такая, — это принципиально дешевле любого фиксированного плана.

  • Несколько моделей в одном месте. Помимо 6.1 Sol доступны Astra, Claude, Gemini и другие актуальные варианты. Возможность прогнать одну задачу через несколько моделей и сравнить результат — нормальная инженерная практика, особенно сейчас, когда разница в цене между моделями достигает пятикратной.

  • Совместимость с OpenAI API. Эндпоинт совместим, поэтому встраивание сводится к замене base URL и ключа. Существующий код, официальные SDK и сторонние клиенты продолжают работать без переделок.

Подключение к рабочему окружению

Для разработчика основной сценарий — модель в редакторе, а не в браузере. Любой клиент, умеющий работать с произвольным OpenAI-совместимым эндпоинтом, подойдёт: Cline, Roo Code, Continue, Aider, OpenCode и аналоги. Указываете адрес агрегатора и ключ — получаете 6.1 Sol внутри VS Code или в терминале с полным агентным циклом: чтение файлов, внесение правок, запуск тестов, итерации.

Ограничения, о которых стоит знать заранее

Через API вы получаете модель, но не экосистему продуктов вокруг неё. Codex с облачным выполнением задач, Code Review с интеграцией в GitHub, агенты Dot, ChatGPT Work — это отдельные сервисы, привязанные к подписке OpenAI. Значительную часть функциональности закрывают сторонние инструменты, но автоматически она не появится.

Режим Ultrafast OpenAI продаёт как премиальный уровень скорости — в API он примерно в шесть раз дороже стандартного. Его наличие у конкретного провайдера стоит уточнять отдельно; стандартная скорость доступна везде.

И про данные: посредник — это дополнительное звено в цепочке обработки. Для персональных данных и коммерческой тайны имеет смысл прочитать политику сервиса и обезличивать чувствительные фрагменты на входе.

Устройство модели

В семействе GPT-6 сложилось три уровня с довольно ясным разделением.

Astra — фронтирная модель для предельно сложных задач, в первую очередь научно-исследовательских. Она остаётся рекомендованной там, где нужен максимум возможностей, а стоимость вторична.

Sol — модель для массового применения: агентные системы, пайплайны, длительные фоновые процессы, потоковая обработка кода и документов.

Luna — самый лёгкий уровень.

Смысл релиза 6.1 Sol в том, что средний уровень подтянули почти вплотную к верхнему при неизменной цене. Рекомендация OpenAI звучит как «повторяющиеся и долгоиграющие нагрузки в коде, приложениях и документах» — то есть всё, что потребляет токены в промышленных объёмах.

Технические параметры

Модель принимает текст и изображения, отдаёт текст. Контекстное окно — около 1,05 миллиона токенов, из них до примерно 922 тысяч на вход. Максимальная длина ответа — 128 тысяч токенов. Дата отсечения знаний — 30 апреля 2026 года.

В API идентификатор — gpt-6.1-sol. Доступна через Responses API, Chat Completions и Batch. Поддерживаются веб-поиск, поиск по файлам, генерация изображений, code interpreter, hosted shell, apply patch, skills, computer use, MCP и tool search. Тонкой настройки и predicted outputs нет.

Изменение, которое ломает совместимость

Один момент требует отдельного внимания при миграции с GPT-6 Sol. В версии 6.1 рассуждение включено постоянно — уровни none и minimal убраны. Кроме того, вызов инструментов теперь возможен только через Responses API; из Chat Completions функции не вызываются.

Предыдущая Sol позволяла использовать себя как дешёвый и быстрый function caller с отключённым reasoning. Такой сценарий больше не поддерживается. Если на нём построена ваша интеграция, переход потребует переработки, а не просто смены идентификатора модели.

Результаты и стоимость

Что показывают бенчмарки

На DeepSWE v1.1 — тесте, оценивающем сложные задачи разработки в настоящих кодовых базах, — GPT-6.1 Sol сравнялась с GPT-6 Astra при стоимости задачи примерно в пять раз ниже. Лучший результат GPT-6 Sol она превзошла на 6,4 процентных пункта, работая при этом на пониженном уровне рассуждений, то есть быстрее и дешевле, чем могла бы.

На AutomationBench, где проверяется автоматизация рабочих процессов, модель на среднем уровне рассуждений опередила Claude Opus 5.5 на 2,2 процентных пункта при стоимости примерно втрое ниже. Относительно GPT-6 Sol на тех же настройках прирост составил 4,8 пункта.

На GDP.pdf, оценке работы с профессиональными документами, 6.1 Sol обошла Opus 5.5 с механизмами фолбэка, стоя при этом менее половины от него в расчёте на задачу, и приблизилась к результату Astra примерно за пятую часть её цены.

На OSWorld 2.0, проверяющем сценарии использования компьютера, прирост к GPT-6 Sol составил 7 пунктов при максимальном уровне рассуждений.

Отдельно стоит выделить фактическую точность. Доля ответов, содержащих фактическую ошибку, на низком уровне рассуждений снизилась с 11,4% до 7,7% — примерно на треть. По всем протестированным настройкам частота ошибок остаётся в пределах 1,9 процентных пункта от показателя Astra, при стоимости задачи менее пятой части. На отдельном наборе особо сложных фактологических диалогов ошибка составила 4,1%, что на 0,4 пункта лучше GPT-6 Sol при стоимости примерно на 83% ниже, чем у Astra. OpenAI при этом честно оговаривает: тест построен на отфильтрованных сложных случаях и не отражает типичное пользовательское взаимодействие.

Общая закономерность по всем измерениям одинакова — либо прямое превосходство над предыдущими моделями, либо сопоставимый результат заметно дешевле или заметно быстрее.

Тарификация

Стандартные ставки API: 2 доллара за миллион входных токенов, 0,10 доллара за миллион кэшированных входных, 10 долларов за миллион выходных, 2,50 доллара за запись в кэш. Batch и Flex дают дополнительную скидку в 50%.

Базовые ставки не изменились относительно GPT-6 Sol, но цена кэшированного входа снизилась вдвое — с 0,20 до 0,10 доллара, что составляет 5% от стоимости обычного входного токена. Этот пункт легко пропустить, хотя на практике он часто важнее базовой ставки: агент, который на каждом шаге передаёт один и тот же системный промпт и накопленную историю диалога, тратит на кэшированный вход основную долю бюджета.

Для сравнения: Astra стоит 10 и 50 долларов за миллион входных и выходных токенов соответственно. Отсюда и пятикратная разница.

Где модель уже доступна

В подписках — Plus, Pro, Business, Enterprise и Edu, но только в ChatGPT Work и Codex. В обычном чат-интерфейсе ChatGPT модели пока нет; формулировка компании — «пока недоступна в Chat». Тарифы Free и Go в анонсе не упоминаются.

Впервые для Sol-ветки выпущена системная карта с приложением по alignment-оценкам — у GPT-6 Sol неделей ранее не было и этого. Документ включает и неблагоприятные показатели: заявлены уровни Critical по кибербезопасности и High по биологии, модель работает под тем же стеком защитных мер, что и Astra.

Новые тарифы и режим Ultrafast

Вторая крупная тема DevDay — перестройка подписок, и здесь новости неоднозначные.

OpenAI запустила план Pro 500 стоимостью 500 долларов в месяц, примерно 42 000 рублей. Его отличительная особенность — режим Ultrafast, доступный только на этом тарифе. В Codex он обеспечивает генерацию до 300 токенов в секунду, что примерно в восемь раз быстрее стандартного режима. В API ускорение достигает шестикратного при шестикратной же цене.

Практическая ценность здесь не в абстрактной скорости. В агентных сценариях, где модель последовательно читает файлы, вносит изменения, запускает тесты и повторяет цикл, время генерации складывается в десятки минут ожидания. Восьмикратное ускорение меняет сам характер работы: процесс из фонового становится интерактивным, за ним можно наблюдать и вмешиваться.

В Pro 500 также включены Dots — новые всегда-активные персональные агенты на базе GPT-6 Astra, работающие на выделенных облачных машинах. Для Европейской экономической зоны, Швейцарии и Великобритании Dots пока недоступны Pro-пользователям.

Параллельно тариф Pro 200 снова открыли для новых подписчиков — продажи приостанавливали 10 сентября из-за наплыва спроса после выхода Astra. Однако вернулся он с урезанными лимитами. С 30 октября включённое использование ChatGPT Work и Codex снижается с 20-кратной квоты Plus до 10-кратной, а количество сообщений GPT-6 Pro в чате падает с 200 до 100 в неделю. Цена при этом остаётся прежней. Действующие подписчики сохраняют текущие лимиты до 29 октября и получают разовый грант в 2 500 долларов на использование.

Мотивация компании читается однозначно: вычислительных мощностей не хватает на весь спрос, и они перераспределяются в пользу тех, кто платит больше. Формально цену не повышали — фактически за те же деньги объём сократился вдвое.

Остальные анонсы DevDay 2026

В итоговый обзор компании вошло более двадцати объявлений. Наиболее заметные помимо уже упомянутых.

Dots — автономные всегда-включённые агенты на GPT-6 Astra, работающие на выделенных облачных компьютерах и выполняющие задачи в фоновом режиме непрерывно. Доступны на планах от 100 долларов в месяц, на бесплатные тарифы не распространяются.

Codex получил серьёзное развитие. Появилось облачное выполнение задач — работа продолжается, даже когда компьютер разработчика в спящем режиме. Обновлён командный интерфейс: добавлено голосовое управление и отслеживание нескольких задач одновременно. Запущен Code Review, формирующий сводку изменений до того, как обратная связь попадёт в GitHub или GitLab. Отдельно представлен Codex Security Cloud — он сканирует репозитории GitHub, проверяет коммиты и готовит исправления, работая на моделях Daybreak Blue.

Для командной работы запущены общие воркспейсы, автоматический конспектировщик встреч и интеграция @ChatGPT в Slack и Microsoft Teams.

Также представлена авторизация «Sign in with ChatGPT» — вход в сторонние приложения через аккаунт OpenAI. Это заявка на роль слоя идентификации для экосистемы приложений вокруг компании.

Из статистики, озвученной на мероприятии: 1,2 миллиарда еженедельных пользователей ChatGPT и более 35 миллионов человек, еженедельно работающих в Work и Codex.

Кому релиз действительно полезен

Наибольшую выгоду получают те, кто эксплуатирует агентов на объёме. Пайплайн, потребляющий миллионы токенов ежемесячно, при переходе с Astra на 6.1 Sol дешевеет примерно впятеро при сопоставимом качестве кодинга, а подешевевший кэшированный вход добавляет экономии сверху.

Хороший кандидат на переход — автоматизация работы с документами и бизнес-процессами: результаты на GDP.pdf и AutomationBench показывают, что модель уверенно работает не только с кодом.

Стоит присмотреться и тем, кто ранее упирался в фактические ошибки на дешёвых настройках. Снижение частоты ошибок примерно на треть при низком уровне рассуждений устраняет главную причину, по которой многие избегали экономичных режимов.

Торопиться не нужно в двух случаях. Первый — если Sol использовалась как быстрый non-reasoning function caller через Chat Completions: этот сценарий закрыт и требует переработки интеграции. Второй — если модель нужна в обычном чате ChatGPT: туда её пока не добавили.

Заключение

Ключевая тенденция 2026 года в языковых моделях — не рост максимальных возможностей, а падение стоимости уже достигнутого уровня. GPT-6.1 Sol демонстрирует качество, за которое месяцем ранее платили впятеро больше, причём на модели, которую сама OpenAI флагманом не считает.

Для практической работы это существеннее любого нового рекорда на бенчмарках. Задачи, прежде не окупавшиеся по стоимости токенов, начинают окупаться. Агентный прогон, обходившийся в 50 долларов, стоит десять — и переходит из категории экспериментов в категорию продакшена.

Проверить это на собственных задачах из России проще всего через агрегатор STIVA.ai: модель там уже доступна, оплата в рублях, VPN не требуется, тарификация по фактическому расходу вместо подписки за 42 тысячи рублей. Разумный первый шаг — прогнать свои типовые задачи последовательно на 6.1 Sol и на Astra и сравнить результат. Если разница окажется несущественной, вы сократите расходы в пять раз без потери качества.

СТИВА
СТИВА - российский агрегатор нейросетей с 80+ моделями в одной подписке. ChatGPT, Claude, Nano Banana, Midjourney, Kling, Veo, Suno, ElevenLabs - тексты, фото, видео, музыка, озвучка. Оплата картой МИР, без VPN. 30 000+ пользователей, работает с 2026 года.