Claude Opus 5.5: полный разбор модели и доступ из России
Двадцать второго сентября 2026 года, в 16:31 по UTC, Anthropic опубликовала пост о выходе Claude Opus 5.5. Через минуту модель уже была в каталоге OpenRouter под идентификатором anthropic/claude-opus-5.5, ещё через несколько минут документация, релизные заметки и прайс-страница обновились. Это третий Opus за год и первая модель нового семейства 5.5.
Релиз получился нетипичный. Обычно флагман выходит дороже предыдущего флагмана, и это воспринимают как норму. Здесь всё наоборот: Opus 5.5 дешевле Opus 5, быстрее Opus 5 и при этом обгоняет Fable 5.1, которая стоит дороже и формально занимает более высокую ступень в линейке. Фактически Anthropic взяла топовую производительность и опустила её в средний ценовой сегмент. Ниже разберём, что именно изменилось, что при этом сломается в существующих интеграциях и где официальные цифры расходятся с независимыми замерами.
Про доступ из России, потому что это первый вопрос
Официальные каналы у нас закрыты. API Anthropic, Amazon Bedrock, Google Cloud и Microsoft Foundry требуют зарубежную карту и платёжный адрес не из России, приложения Claude добавляют к этому гео-проверку.
Claude Opus 5.5 уже лежит в агрегаторе нейросетей STIVA.ai. Модель доступна в веб-интерфейсе на русском языке, без VPN, без ключа Anthropic и без иностранной карты — оплата в рублях обычной российской картой, отдельно есть вариант для юридических лиц.
По деньгам картина такая. Бесплатный тариф «Старт» даёт небольшую порцию токенов, чтобы просто потестировать модель. «Базовый» стоит 495 рублей в месяц и включает 3 000 токенов, «Эксперт» — 990 рублей и 10 000 токенов, «Бизнес» — 4 950 рублей, 50 000 токенов и до двадцати аккаунтов. Токены можно докупать разовыми пакетами от 495 рублей, причём с бонусом от десяти до двадцати процентов сверху, и они не сгорают, а тратятся уже после месячного лимита. Одна генерация Opus 5.5 обходится в 400 токенов, так что «Базовый» — это примерно семь запросов в месяц, а «Эксперт» — около двадцати пяти. Для постоянной работы разумно брать второй, для экспериментов с длинным контекстом — разовый пакет.
Что под капотом
Идентификатор модели в API — claude-opus-5-5. Контекстное окно — миллион токенов, и, что важнее, без отдельного long-context тарифа: наценки за длинный контекст нет, вы платите по обычным ставкам. Максимальный выход — 128 тысяч токенов синхронно, а через Message Batches API под beta-заголовком можно получить до 300 тысяч. На вход модель принимает текст и изображения, на выход отдаёт текст. Knowledge cutoff и training data cutoff совпадают — июнь 2026 года. Рассуждения адаптивные и всегда включены, отключить их нельзя, уровень по умолчанию — medium. Задержка в документации помечена как умеренная. Доступность — приложения Claude, Claude Platform, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Code.
Прайс целиком, все ставки за миллион токенов. Вход — 4 доллара против 5 у Opus 5, выход — 20 против 25. Чтение из кэша подешевело с 50 центов до 20, это минус шестьдесят процентов. Запись в кэш на пять минут — 5 долларов вместо 6,25, на час — 8 вместо 10. Пакетная обработка — 2 и 10 долларов вместо 2,50 и 12,50. Fast mode, который пока в статусе research preview, стоит 8 и 40 долларов; у Opus 5 он обходился в 10 и 50. Подписчикам Pro, Max, Team и Enterprise с seat-based-лицензиями подняли пятичасовые лимиты и выдали rate limit reset, который можно приберечь и потратить в тяжёлый день.
Три вещи, которые сломаются при миграции
Первая и главная — рассуждения больше не выключаются. У Opus 5 extended thinking можно было отключить и получить быстрый дешёвый ответ на простой запрос. У Opus 5.5 такой возможности нет в принципе: рассуждения адаптивные и работают всегда. Единственный рычаг — параметр effort с уровнями low, medium, high и xhigh, по умолчанию стоит medium. Anthropic отдельно подчёркивает, что выкручивать его на максимум «просто потому что можно» не стоит: сравнивать нужно итоговое качество, задержку и расход токенов, а не исходить из того, что выше всегда лучше. Практическое следствие простое — если у вас был пайплайн, где лёгкие запросы шли без thinking, а тяжёлые с thinking, он больше не работает, и лёгкие запросы теперь тоже оплачивают рассуждения.
Вторая — в Claude Code появился режим Responsive. Модель сначала выдаёт первую фразу ответа, а уже потом запускает рассуждения и инструменты. Для терминального интерфейса это не косметика: раньше вы смотрели в пустой терминал и не понимали, процесс думает или отвалился.
Третья — пакетный API отдаёт до 300 тысяч выходных токенов под beta-заголовком. Для офлайн-обработки больших объёмов, например ревью по тысяче файлов, разница между 128 и 300 тысячами на батч вполне ощутимая, а входные токены в batch-режиме вдвое дешевле.
Есть и четвёртое изменение, которое не ломает код, но сильно влияет на агентные пайплайны. В релизных заметках Anthropic прямо пишет, что Opus 5.5 выполняет сопоставимые задачи за меньшее число шагов и с меньшим расходом токенов, чем Opus 5, и при этом понятнее отчитывается о работе — что сделала, что нашла, что нужно от пользователя. Меньше шагов означает меньше точек отказа и меньше служебного трафика, и для длинных агентов это часто важнее, чем пара процентов в бенчмарке.
Откуда берутся «минус сорок процентов»
Anthropic заявляет, что на типичных нагрузках Opus 5.5 обходится примерно на сорок процентов дешевле Opus 5. Это не одна скидка, а сумма трёх слагаемых. Первое — сами ставки ниже на двадцать процентов. Второе — чтение из кэша подешевело на шестьдесят процентов. Третье — модель расходует меньше токенов на задачу.
Второй пункт недооценивают, а он главный. В агентных и кодинг-нагрузках основную часть счёта формирует не новый ввод, а перечитывание закэшированного контекста: системный промпт, репозиторий, история шагов агента. Когда ставка на cache read падает с 50 до 20 центов, длинный агентный цикл дешевеет непропорционально сильно. Добавьте к этому отсутствие наценки за длинный контекст при окне в миллион токенов — раньше на больших объёмах вы платили по повышенному тарифу, теперь нет.
Fast mode при этом стоит вдвое дороже обычного и даёт до двух с половиной раз по скорости. Логика применения очевидна: интерактивная работа с человеком — включаем, фоновые батчи — нет.
В качестве иллюстрации Anthropic приводит два внутренних эксперимента. Первый — портирование HAProxy с C на Rust: Opus 5.5 справилась за девять с половиной часов, Fable 5.1 за двенадцать, при этом новая модель обошлась на пятьдесят один процент дешевле, а регрессионные тесты проекта прошли почти полностью в обоих случаях. Второй — аудит кодовой базы на двести тысяч строк: меньше трёх часов против двадцати с лишним раньше. Относитесь к этим цифрам как к демонстрации порядка величин: ни harness, ни условия прогонов Anthropic не опубликовала, воспроизвести такое стороннему исследователю не получится.
Бенчмарки и места, где цифры расходятся
Начнём с независимых замеров. Artificial Analysis поставила Opus 5.5 на первое место в своём Intelligence Index с результатом 58 баллов при максимальном усилии. Для контекста: GPT-6 Astra — 53, Fable 5.1 — 53, Opus 5 — 51, GPT-5.6 Sol — 47. Лидерство зафиксировано на шести из десяти базовых оценок индекса, включая Humanity’s Last Exam с 61,4 процента и SciCode с 66,9 процента. На knowledge-work оценке AA-Briefcase модель показала 1822 Elo, это на 143 пункта выше Fable 5.1.
Теперь цифры, которые опубликовала сама Anthropic при максимальном усилии и включённых production safeguards. На Terminal-Bench 4.0 у Opus 5.5 — 66,4 процента против 57,9 у GPT-6 Astra, 55,8 у Fable 5.1, 52,3 у Opus 5 и 37,3 у GPT-5.6 Sol. На FrontierCode v1.1 Main — 54,4 процента против 53,3 у GPT-6 Astra, 50,3 у Fable 5.1 и 48,0 у Opus 5. На CursorBench 4.0, который имитирует реальные кодинг-сессии, — 57,8 процента против 51,8 у Fable 5.1 и 46,6 у Opus 5; результат GPT-6 Astra OpenAI здесь не публиковала. На GDPval-AA v2.1, оценке профессиональной работы в формате Elo, — 1846, новый максимум против 1735 у Fable 5.1 и 1708 у Opus 5. Humanity’s Last Exam с инструментами — 67,7 процента против 65,6 у Fable 5.1. Computer use на OSWorld 2.0 с частичным зачётом — 81,8 процента, визуальные рассуждения на Chartography с инструментами — 89,0 процента, что, кстати, хорошо объясняет, зачем модели поддержка изображений на входе.
Теперь про то, где флагман не первый. На AutomationBench, оценке бизнес-процессов, у Opus 5.5 — 40,0 процента, а у GPT-6 Astra — 41,4. На Terminal-Bench-Science 0.1, агентных научных задачах, — 58,7 процента против 64,6 у Astra. То есть заголовки в духе «Opus 5.5 победила всех и везде» не соответствуют опубликованным же данным.
Отдельно стоит сказать про расхождение замеров, потому что это лучшая прививка от маркетинга. Artificial Analysis прогнала Terminal-Bench 4.0 самостоятельно и получила 59,6 процента вместо 66,4 — минус шесть и восемь десятых пункта. По Humanity’s Last Exam её замер дал 61,4 процента против 67,7 у Anthropic, минус шесть и три десятых. Разные harness’ы, разные настройки усилия, разные условия запуска — всё это нормально, но вывод из этого следует аккуратный. Модель стабильно в топе и заметно сильнее собственного предыдущего Opus — это факт. Утверждение, что она во всём превосходит GPT-6 Astra, фактом не является.
И наконец нюанс, который виден только в данных Artificial Analysis: расход выходных токенов. На задачах индекса Opus 5.5 генерирует примерно 119 тысяч токенов против 27 тысяч у GPT-6 Astra и 78 тысяч у Fable 5.1. Модель разговорчивая, и при цене 20 долларов за миллион выходных часть экономии на ставках просто съедается объёмом вывода. Поэтому подбор effort — не косметика, а прямая статья бюджета: на low расход падает до примерно 6,8 тысячи токенов на задачу при 42 баллах индекса, на medium получается 51 балл при 14 тысячах токенов. Для большинства рабочих сценариев оптимум по соотношению качества и стоимости лежит именно на medium, а не на high или xhigh.
Сейфти как инженерная задача, а не как пресс-релиз
Это самая недооценённая часть релиза. Opus 5.5 оценили как сопоставимую с Claude Mythos 5.1 по био- и кибернаправлениям, а Mythos у Anthropic находится под плотным контролем доступа. Отсюда набор ограничений, включённых по умолчанию.
Запросы по кибербезопасности проходят трёхступенчатый скрининг. Сначала probe, который смотрит на внутренние активации модели, затем лёгкий классификатор, работающий на самой Opus 5.5, затем отдельный обученный классификатор. Если запрос заблокирован, он прозрачно уходит на Claude Opus 4.8. Слово «прозрачно» здесь ключевое: ответ вы получите, но от другой, более слабой модели. Запросы по чувствительным биологическим темам фильтруют расширенные классификаторы, которые уже работали на Fable 5 и Fable 5.1, а блокировки уходят на Opus 5. Мера preserved thinking, направленная против дистилляции, применяется к Fable 5.1 и Opus 5.5 для API-аккаунтов, созданных 31 августа 2026 года и позже. Программу Cyber Verification в ближайшие недели расширят до трёх уровней доверенного доступа вплоть до моделей Mythos, для бионаправлений отдельно работает Life Sciences Verification Program.
Перед релизом модель проверили внешние оценщики METR и Frontier Design, плюс Anthropic работала с US Center for AI Standards and Innovation при NIST над замером кибер- и био-возможностей. По внутренней поведенческой оценке примерно на две тысячи симулированных сценариев Opus 5.5 показала лучший результат среди всех предыдущих Claude.
Для инженеров из этого следует одна практическая вещь: логируйте, какая модель реально дала ответ. При включённых фолбэках предположение «я вызвал Opus 5.5, значит отвечал Opus 5.5» перестаёт быть надёжным, а деградацию качества в агентном пайплайне без логов вы будете искать очень долго.
Каденс релизов и неловкий тайминг
Посмотрите на ритм выпусков. Fable 5 и Mythos 5 вышли 9 июня 2026 года, Sonnet 5 — 30 июня, Opus 5 — 24 июля, Fable 5.1 вместе с Mythos 5.1 — 1 сентября, Opus 5.5 — 22 сентября. Между Fable 5.1 и Opus 5.5 прошло двадцать один день.
Двенадцатого сентября Дарио Амодеи публикует текст о том, что индустрии стоит притормозить с наращиванием возможностей, чтобы практики безопасности успевали за моделями. Через десять дней выходит флагман, который обгоняет предыдущий флагман и берёт первое место в независимом индексе. Anthropic этот момент не обходит стороной: в анонсе прямо сказано, что это первый релиз после призыва задавать темп фронтиру, а внешние оценки до выхода — как раз тот механизм сдержек, о котором шла речь. Аргумент понятен, но факт остаётся фактом: темп не снизился. По таймингу релиз лёг ещё и на день иска BC AG к OpenAI и через три дня после сообщений о подготовке Anthropic к IPO.
Дальше по плану Sonnet 5.5 и Haiku 5.5 в ближайшие недели, с теми же улучшениями по производительности, эффективности и безопасности. Судя по паттерну, Sonnet 5.5 заберёт себе основную массу повседневных задач по цене примерно в четыре раза ниже Opus, поэтому большинству команд логично целиться именно туда, оставив Opus 5.5 для тяжёлых агентных сценариев.
Кому мигрировать, а кому подождать
Переходить на Opus 5.5 имеет смысл, если у вас длинные агентные циклы с большим закэшированным контекстом — там экономия на cache read самая ощутимая. Если вы работаете с репозиториями целиком: миграции, аудиты, рефакторинг на большой базе. Если занимаетесь документооборотом и аналитикой, где в один запрос нужно положить десятки связанных файлов и не резать их на куски. И если у вас computer use или визуальный разбор графиков, диаграмм и скриншотов.
Подождать стоит в трёх случаях. Когда у вас короткие запросы в духе «перепиши абзац» — вы просто переплатите за всегда включённый thinking. Когда пайплайн завязан на отключение extended thinking и переписать его быстро не получится. И когда задачи в основном про бизнес-автоматизацию или научные агентные сценарии: там по опубликованным цифрам впереди GPT-6 Astra.
Итог
Opus 5.5 — это не очередной флагман, а пересборка ценовой линейки: топовое качество теперь отдаётся по цене среднего тира. Миллион токенов контекста без наценки, 128 тысяч на выход и 300 тысяч в батчах, изображения на входе, минус двадцать процентов по ставкам и минус шестьдесят на чтении кэша. Расплачиваться за это придётся тремя вещами: рассуждения больше не отключаются, часть запросов по чувствительным темам молча уходит на старые модели, а разговорчивость увеличивает расход выходных токенов. Всё это лечится настройкой effort и логированием того, какая модель вам реально ответила.
Если хочется пощупать модель без биллинга Anthropic и зарубежных карт — она лежит в агрегаторе STIVA.ai, 400 токенов за генерацию, есть бесплатный тариф на тест.
👉 Claude Opus 5.5 на STIVA.ai: https://stiva.ai/models/claude-opus-5-5
Другие статьи