22.09.2026, 14:08

Grok 4.7 против GPT-5.6 Sol: новая модель SpaceXAI выигрывает в коде — и вот как её попробовать из России

SpaceXAI (так теперь официально называется xAI) выпустила Grok 4.7 — новое поколение своего флагмана, заточенное под длинные задачи: многочасовое программирование, работу с документами и агентные сценарии. В бенчмарке CursorBench 4.0 новинка обошла GPT-5.6 Sol от OpenAI на 4,6 п.п., уступив лишь Claude Fable 5.1 от Anthropic. Разбираемся, что умеет модель, сколько она стоит и как её попробовать из России — без VPN и зарубежных карт.

Как пользоваться Grok 4.7 из России: инструкция на примере STIVA.ai

С прямой дорогой у российских пользователей традиционно сложно: сайт Grok требует VPN, верификацию зарубежным номером, а подписка и API оплачиваются только иностранными картами. Проще всего — через агрегаторы нейросетей. Покажем на примере STIVA.ai — русскоязычной платформы с 80+ моделями (ChatGPT, Claude, Gemini, Grok, DeepSeek, Qwen, Perplexity и другие), которая работает без VPN и принимает российские карты.

Начать стоит с регистрации. Зайдите на stiva.ai и создайте аккаунт по электронной почте — без VPN и без зарубежного номера, интерфейс полностью на русском. Новым пользователям начисляют 100 бесплатных токенов, этого хватит, чтобы попробовать модели в деле до покупки подписки.

Дальше выберите модель. Откройте каталог («Все нейросети» → текстовые модели) и найдите Grok в списке. 

Если бесплатных токенов окажется мало, оформляется подписка — от 495 ₽ в месяц, либо покупаются пакеты токенов под разовые задачи. Оплата проходит российскими картами, без посредников и крипты. Сами запросы можно писать по-русски: платформа сама переводит их на язык модели, а инструмент «Улучшение промпта» помогает довести формулировку до ума. Для рабочих задач есть готовые шаблоны — генерация презентаций, анализ документов, поиск в интернете, а история чатов и «проекты» позволяют вести несколько задач параллельно.

Что нового в Grok 4.7

Релиз состоялся 21 сентября 2026 года, после нескольких переносов сроков. По словам разработчиков, Grok 4.7 — это не «докрученная» четвёрка, а модель на новой, более крупной базовой архитектуре. Её обучали преимущественно на задачах, которые занимают «много часов работы», — отсюда ориентир на многочасовое кодинг-агентство и профессиональные рабочие процессы.

Вторая заметная перемена — более тщательная самопроверка. Grok 4.7 перепроверяет собственную работу эффективнее предшественницы, что особенно важно в длинных агентных сессиях, где цена одной ошибки накапливается с каждым шагом. Контекстное окно осталось прежним — 500 000 токенов, как у Grok 4.6, но управляется оно, по словам xAI, заметно лучше. Наконец, в модели полностью переработали систему защитных механизмов — о ней расскажем ниже.

Бенчмарки: где обошла OpenAI, а где — нет

Главная интрига релиза — сравнение с актуальными флагманами OpenAI и Anthropic. По данным SpaceXAI, в CursorBench 4.0, который проверяет способность моделей выполнять длительные задачи по разработке ПО, Grok 4.7 набрала 46,3%, опередив GPT-5.6 Sol Max с её 41,7%, но уступив Fable 5.1 Max с 51,8%. Для сравнения: Grok 4.6 в этом же тесте набирала 40,4%. Ключевое — в «длинном» программировании Grok 4.7 обошла модель OpenAI на 4,6 п.п. и при этом оказалась дешевле по соотношению цены и производительности.

В Terminal-Bench 4.0, где проверяется работа с терминалом, результат вырос с 20,3% у Grok 4.6 до 38,0% — почти вдвое, что позволило обойти GPT-5.6 Sol (37,3%), хотя до Fable 5.1 (57,9%) всё ещё далеко. В агентной разработке на DeepSWE v1.1 Grok 4.7 набрала 71,0% против 65,2% у предшественницы, чуть-чуть не дотянув до 72,7% у GPT-5.6 Sol. Заметнее всего прогресс в специализированных областях: в электрической инженерии (EEBench) модель получила 64,0% против 53,0% у Grok 4.6 и всего 39,4% у GPT-5.6 Sol, а в юридических агентных задачах на Harvey Legal Agent Benchmark показала 19,6% — более чем в семь раз выше, чем у модели OpenAI.

В тестах на создание презентаций, документов и другие офисные задачи Grok 4.7 также обошла GPT-6 Astra, но снова уступила Fable 5.1. Стоит держать в уме: все цифры — из собственной таблицы SpaceXAI, а часть сравнений проводилась при разных уровнях «усилия» рассуждений (reasoning effort). Так что воспринимать их стоит как ориентир, а не приговор конкурентам. Впрочем, даже Илон Маск перед релизом оценил модель скромнее маркетинга: «примерно на уровне Opus 5.0, но не 5.1».

Безопасность

В Grok 4.7 полностью переработали систему защитных механизмов. По данным компании, во внутреннем тесте HackerBench v0.3 модель пропустила лишь 3,3% «опасных» запросов двойного назначения, при этом «редко» блокировала легитимные задачи по кибербезопасности. Это классическая дилемма современных моделей — ужесточение фильтров обычно ломает полезную функциональность, — и xAI заявляет, что решила её без потерь. Также Grok 4.7 возглавила бенчмарк биобезопасности LatchBio с результатом 62,4%, а отдельным партнёрам в сфере кибербезопасности начали предоставлять инвайт-доступ к red-team-возможностям модели для исследований защиты.

Цена и доступность

Цена не изменилась со времён Grok 4.6 — и это, пожалуй, главная сюжетная линия релиза. Работа с моделью стоит $2 за миллион входных и $6 за миллион выходных токенов при промпте до 200 тысяч токенов, кэшированный контекст обходится в $0,50 за миллион. Если контекст длиннее (вплоть до максимума в 500 тысяч токенов), тариф вырастает до $4 и $12 соответственно. Модель поддерживает режимы рассуждений low, medium, high (по умолчанию) и xhigh, принимает на вход текст и изображения, а отдаёт текст.

Доступна Grok 4.7 уже в нескольких местах. В Cursor она стала моделью по умолчанию на всех тарифах. В Grok Build — инструменте для вайб-кодинга внутри чат-бота Grok — модель можно потестировать бесплатно, правда, на ограниченное время: сроки xAI не раскрыла. Наконец, разработчикам она доступна через Grok API.

Что в итоге

Grok 4.7 — прицельный, а не революционный апгрейд: та же цена, тот же контекст, но заметный прирост в многочасовом кодинге (Terminal-Bench вырос почти вдвое) и профессиональных задачах. В «длинном» программировании SpaceXAI впервые за долгое время обошла OpenAI, однако Anthropic с Fable 5.1 по-прежнему впереди по большинству метрик. Зато по цене за задачу Grok выглядит самым выгодным предложением среди флагманов — и именно за соотношением цены и возможностей стоит следить в ближайшие месяцы. Российским пользователям ждать не обязательно: тестировать линейку Grok (и её конкурентов) уже можно через агрегаторы вроде STIVA.ai — без VPN и в рублях.

СТИВА
СТИВА - российский агрегатор нейросетей с 80+ моделями в одной подписке. ChatGPT, Claude, Nano Banana, Midjourney, Kling, Veo, Suno, ElevenLabs - тексты, фото, видео, музыка, озвучка. Оплата картой МИР, без VPN. 30 000+ пользователей, работает с 2026 года.