Claude Opus 5.5: обзор новой нейросети Anthropic, цены, тесты и как пользоваться Opus 5.5 в России

—

от автора

Claude Opus 5.5 — новая модель Anthropic, которая вышла 22 сентября 2026 года и открыла семейство Claude 5.5. Новость разошлась за пару часов, и почти везде ее подают одинаково: быстрее, дешевле, умнее. Все это правда, но за тремя красивыми словами прячутся детали, от которых зависит, сэкономите вы на переходе на новинку или поймаете пачку ошибок 400 в продакшене.

Мы разобрали анонс, документацию для разработчиков и отзывы компаний из раннего доступа и собрали в одном обзоре все, что полезно знать о Claude Opus 5.5: сколько стоит модель, что показали тесты, где она сильна в коде и аналитике, какие у нее ограничения и как ею пользоваться, в том числе из России.

Claude Opus 5.5 коротко: главное за минуту

  1. Цена. В API миллион входных токенов стоит $4, выходных $20, чтение из кэша $0,20. По оценке Anthropic, типичная задача на новой модели обходится на 40% дешевле, чем на Opus 5.

  2. Скорость. Ответы генерируются более чем на 30% быстрее, а быстрый режим в Claude Code и API разгоняет выдачу до 2,5 раза.

  3. Код и агенты. По данным компании, модель лидирует в Terminal-Bench 4.0, CursorBench 4.0 и FrontierCode. Особенно сильна в длинных задачах вроде миграций и аудита кодовой базы.

  4. Стиль ответов. Главное теперь идет первым, жаргона и воды меньше, заданные правила оформления модель соблюдает аккуратнее.

  5. Ограничения. Режим размышлений нельзя отключить, фильтры по кибербезопасности и биологии стали строже, часть запросов прозрачно уходит на другие модели.

  6. Доступ. Приложения Claude, Claude Code, API под идентификатором claude-opus-5-5, а также Amazon Web Services, Google Cloud и Microsoft Azure.

Что такое Claude Opus 5.5

Claude Opus 5.5 — это большая языковая модель компании Anthropic для агентного программирования, аналитики и сложной офисной работы. На большинстве задач она выдает результат уровня старшей модели Claude Fable 5.1, но стоит заметно дешевле и работает быстрее, чем предыдущая Claude Opus 5.

В поиске модель называют по-разному: Клод Опус 5.5, Клауд Опус 5.5, Claude 5.5 Opus, а иногда и Cloud Opus 5.5 с ошибкой в названии. Во всех случаях речь об одной нейросети от Anthropic.

Основные характеристики Claude Opus 5.5 такие. Идентификатор в API — claude-opus-5-5. Режим адаптивных рассуждений включен всегда, а их глубину задает параметр effort, по умолчанию он стоит на уровне medium. Модель умеет работать с изображениями, PDF и файлами, вызывать инструменты и управлять компьютером. Контекстное окно, по данным обзоров, составляет 1 млн токенов.

Следом, по словам Anthropic, в ближайшие недели выйдут Claude Sonnet 5.5 и Claude Haiku 5.5. Над Opus в линейке по-прежнему стоит уровень Mythos, куда входят Claude Mythos 5.1 и Claude Fable 5.1. Получается, что Opus 5.5 претендует на роль рабочей лошадки для задач, под которые еще недавно приходилось брать старшую модель.

Интересно и то, что это первый релиз Anthropic после того, как глава компании Дарио Амодеи призвал сдерживать темп развития передовых моделей, чтобы практики безопасности успевали за возможностями. Поэтому до запуска модель проверяли внешние оценщики, включая METR.

Сколько стоит Claude Opus 5.5 и откуда берется экономия 40%

Цифра «на 40% дешевле» звучит как скидка в прайсе, но прайс здесь только одна из трех составляющих. Чтобы понимать, сколько сэкономите именно вы, стоит разложить ее на части.

Рычаг первый: подешевели сами токены

Входные токены новой модели подешевели с $5 до $4 за миллион, выходные с $25 до $20. Это ровно минус 20%. Запись в пятиминутный кэш стоит $5 вместо $6,25, запись в часовой кэш $8. Пакетная обработка через Batch API идет за полцены: $2 за входные и $10 за выходные токены.

Рычаг второй: кэш стал почти бесплатным

Чтение из кэша упало с $0,50 до $0,20 за миллион токенов, то есть на 60%. Для чат-бота с короткими диалогами это мелочь. А вот в агентной разработке, где модель десятки раз перечитывает один и тот же проект, именно кэш съедает большую часть бюджета. Anthropic прямо пишет, что чтение из кэша составляет основную долю затрат в агентных и кодинговых сценариях.

Рычаг третий: меньше токенов на задачу

Самая недооцененная часть. Opus 5.5 решает те же задачи за меньшее число шагов и вызовов инструментов. Разработчики Kiro сообщают, что на наборе реальных задач в командной строке модель решила больше, чем Opus 5, сделав примерно на 40% меньше вызовов и потратив вдвое меньше токенов. В Box заметили, что ответы стали на 40% короче без потери точности.

Считаем на пальцах

Возьмем условную агентную сессию в Claude Code: 2 млн токенов чтения из кэша, 200 тысяч входных и 100 тысяч выходных токенов. На Opus 5 такая сессия стоит $4,5, на Claude Opus 5.5 при тех же объемах $3,2, то есть минус 29% только за счет новых цен. А если модель потратит на задачу хотя бы на 20% меньше токенов, счет опустится до $2,56, и вот уже те самые минус 40% с запасом.

Цифры условные, но логика показательна: основной выигрыш дает не прайс, а поведение модели. Поэтому экономия у каждого будет своя, и замерять ее лучше на собственных задачах.

Отдельно есть быстрый режим с ускорением до 2,5 раза. Он стоит $8 за миллион входных и $40 за миллион выходных токенов и пока доступен только в Claude API, без Bedrock, Google Cloud и Microsoft Foundry.

Claude Opus 5.5: бенчмарки и сравнение с GPT-6 Astra и Fable 5.1

Anthropic опубликовала сравнение новой модели с Fable 5.1, Opus 5, GPT-6 Astra и GPT-5.6 Sol. Все результаты мы свели в одну таблицу.

В агентном программировании на Terminal-Bench 4.0 Opus 5.5 набрала 66,4% против 55,8% у Fable 5.1, 52,3% у Opus 5 и 57,9% у GPT-6 Astra. На CursorBench 4.0, где задачи взяты из реальных сессий в Cursor, результат 57,8%. На FrontierCode, который проверяет, приняли бы изменения агента в основную ветку, модель показала 54,4% против 53,3% у Astra. В работе по 44 профессиям на GDPval-AA v2.1 у нее 1846 пунктов Elo, в управлении компьютером на OSWorld 2.0 81,8%.

Если сравнивать Claude Opus 5.5 и GPT-6 Astra, главное различие не в процентах, а в цене. По данным Anthropic, на уровне effort по умолчанию Opus 5.5 обходит лучший результат Astra на FrontierCode примерно за пятую часть стоимости задачи, а на Terminal-Bench 4.0 догоняет ее примерно за 40% стоимости. Но есть и тесты, где модель уступила: на AutomationBench от Zapier у Opus 5.5 40% против 41,4% у GPT-6 Astra, а на Terminal-Bench-Science для научных исследований 58,7% против 64,6%.

Теперь про осторожность. Почти все цифры опубликовала сама Anthropic, и многие результаты получены на максимальном уровне рассуждений. Компания сама признает, что на таком уровне возможностей разрыв в бенчмарках все хуже отражает реальную разницу, и что на практике Opus 5.5 ближе к Fable 5.1, чем выглядит по таблицам. Честная позиция, и ее стоит держать в голове, когда видите громкие заголовки про «разгром конкурентов».

Claude Opus 5.5 для кода и не только: где модель действительно хороша

Длинные задачи по программированию

Сильнее всего Claude Opus 5.5 проявляет себя на больших и затяжных работах с кодом. Один из ранних тестировщиков провел аудит и исправление кодовой базы на 200 тысяч строк меньше чем за три часа. Opus 5 на ту же работу потратила больше 20 часов и в 2,5 раза больше токенов. Другой завершил миграцию проекта на 680 тысяч строк меньше чем за сутки.

Во внутреннем эксперименте Anthropic Opus 5.5 и Fable 5.1 переписывали балансировщик HAProxy с C на Rust. Обе версии прошли почти все штатные регрессионные тесты, но Opus 5.5 справилась за 9,5 часа вместо 12 и обошлась на 51% дешевле. А в задаче ускорить загрузку всех страниц веб-приложения модель добилась успеха в 39 случаях из 40, тогда как Opus 5 давала скромный прирост и заодно ломала поведение приложения.

Важно понимать, что это примеры от компании и участников раннего доступа, а не независимые воспроизводимые исследования.

Аналитика без выдуманных цифр

Для аналитиков и тех, кто пишет отчеты, самый интересный пример такой. Anthropic попросила три модели подготовить отчет о квартальных результатах компании по копии интернета, где пресс-релиз с цифрами было трудно найти. Автоматический проверяющий сверял каждую цифру и цитату с источниками, и любая выдумка означала провал. Opus 5.5 прошла порог качества в 16 отчетах из 18, а Fable 5.1 и Opus 5 не прошли ни разу.

В другом тесте модели строили финансовую модель слияния двух вымышленных компаний в Excel и превращали ее в презентацию для руководства. Выводы совпали, но Opus 5.5 сделала модель тщательнее, презентацию понятнее, уложилась в 63 минуты вместо 93 и обошлась вдвое дешевле.

Тексты, которые не надо переводить с «клодского»

Пользователи давно жаловались, что Opus 5 пишет многословно, любит странные обороты и прячет главный вывод в середину длинного ответа. В сообществе эту манеру даже прозвали Claudish. В новой версии Anthropic отдельно поработала над стилем: главное идет первым, жаргона меньше, правила оформления, которые вы задаете, модель соблюдает лучше. Ранние тестировщики говорят, что ее проще читать в долгих рабочих сессиях, а в Ramp признались, что модель переписала их промпт лучше, чем они сами.

Насколько это заметно на ваших задачах, лучше проверить самим. Но если вы используете Claude для документации, писем или резюме переписки, разница должна чувствоваться сразу.

Ограничения и безопасность Claude Opus 5.5: где модель может отказать

Opus 5.5 стала первой моделью линейки Opus с защитой того же класса, что у Fable 5.1. На практике это значит следующее.

Обычный поиск и исправление уязвимостей в своем коде работает. Но большинство специализированных задач по кибербезопасности при срабатывании классификатора перенаправляются на Opus 4.8. Для специалистов по защите Anthropic расширит программу верифицированного доступа Cyber Verification Program.

С биологией похожая история. Модель очень сильна в этой области, поэтому получила те же защитные механизмы, что и Fable 5.1. Лабораториям, стартапам и фармкомпаниям предлагают подать заявку в программу Life Sciences Verification Program.

Для защиты от дистилляции, когда через тысячи подставных аккаунтов пытаются выкачать возможности модели, работает механизм preserved thinking. Он не дает клиенту API редактировать прошлый контекст, чтобы вытащить рассуждения Claude. Для аккаунтов, созданных с 31 августа 2026 года, проверка включена по умолчанию.

Хорошая новость: по внутреннему аудиту поведения, который проверяет модель почти на 2000 сценариев, Opus 5.5 показала лучшие результаты среди всех моделей Claude. Попыток выйти за заданные границы стало примерно на 85% меньше, чем у Opus 5, а устойчивость к prompt injection выросла. При этом Anthropic честно предупреждает: модель нередко догадывается, что ее тестируют, и лабораторные оценки могут не полностью описывать ее поведение в реальных системах.

Claude Opus 5.5 API: четыре грабли при переходе с Opus 5

Этот раздел для разработчиков. Просто поменять claude-opus-5 на claude-opus-5-5 в конфиге может не получиться: в документации описаны четыре несовместимых изменения и два тихих.

Первое: размышления нельзя отключить. Запрос с thinking: {«type»: «disabled»} или с ручным бюджетом budget_tokens вернет ошибку 400. Глубину рассуждений теперь регулируют параметром effort. Там, где раньше вы отключали thinking ради скорости, просто понизьте effort.

Второе: принудительный вызов инструмента не поддерживается. tool_choice со значениями any или tool тоже дает ошибку 400. Оставьте auto, включите strict tool use, а в промпте прямо напишите, когда нужно вызывать инструмент.

Третье: блоки рассуждений привязаны к модели и диалогу. Если вы редактируете системный промпт, список инструментов или прошлые сообщения задним числом, повтор такого блока вернет ошибку. Держите диалог «только на дописывание» и меняйте инструкции через системные сообщения посреди диалога.

Четвертое: старый инструмент computer use не принимается. В Claude API и Google Cloud модель работает только с computer_toolset_20260801, а computer_20251124 отклоняется. В Bedrock старый вариант пока работает.

Есть и тихие изменения, которые не ломают запрос, но меняют поведение. Уровень effort по умолчанию теперь medium, хотя у Opus 5 был high. При одинаковом effort новая модель думает больше, чем Opus 5, поэтому оставляйте запас в max_tokens. А короткие комментарии между вызовами инструментов теперь приходят в блоках thinking, и интерфейс, который показывал их пользователю как прогресс, может внезапно замолчать без всяких ошибок.

Минимальный запрос к Claude Opus 5.5 через API выглядит так:

python

response = client.messages.create(

    model=»claude-opus-5-5″,

    max_tokens=16000,

    thinking={«type»: «adaptive»},

    output_config={«effort»: «medium»},

    messages=[{«role»: «user», «content»: «Проверь этот модуль на ошибки»}],

)

Как выбрать уровень effort в Claude Opus 5.5, чтобы не переплачивать

Effort стал главным рычагом управления ценой и качеством, поэтому переносить старые настройки вслепую не стоит.

Low подходит для рутины: классификация, извлечение данных, короткие ответы, код-ревью небольших правок. По данным Deloitte, даже на минимальном уровне Opus 5.5 нашла 72% известных багов в ревью кода, тогда как Opus 5 на высоком уровне находила 56%.

Medium стоит по умолчанию и закрывает большинство рабочих задач. В Factory говорят, что это первая модель, которую они готовы использовать на среднем уровне: она догнала Opus 5 на высоком и тратит на 20–25% меньше выходных токенов.

High, xhigh и max оставьте для длинных агентных задач, сложных миграций и исследований, где цена ошибки выше цены токенов. Именно на этих уровнях Anthropic получала рекордные цифры в бенчмарках.

Самый надежный способ: прогнать 20–30 типичных задач на двух соседних уровнях и сравнить результат и счет. Часто оказывается, что уровень ниже справляется не хуже.

Как пользоваться Claude Opus 5.5, в том числе в России

Claude Opus 5.5 уже доступна в приложениях Claude и в Claude Code. Для подписчиков Pro, Max, Team и Enterprise с оплатой за места Anthropic увеличила пятичасовые лимиты использования, а еще дала возможность сохранить сброс лимита и воспользоваться им, когда он действительно понадобится.

Разработчикам модель доступна через Claude API под идентификатором claude-opus-5-5, а также в Amazon Bedrock, Google Cloud и Microsoft Foundry.

С Россией сложнее: официально Anthropic не работает с российскими пользователями, а регистрация и оплата напрямую недоступны. Подробнее о том, как устроен доступ к Claude и какие модели есть в линейке, мы писали в подробном гиде по нейросети Claude. Самый простой путь сейчас — агрегаторы нейросетей.

Промпты, чтобы проверить Claude Opus 5.5 на своих задачах

Лучший способ понять, стоит ли переходить, — дать модели ваши реальные задачи. Вот несколько шаблонов, которые хорошо показывают сильные стороны новой версии.

Для аудита кода:

text

Проверь этот модуль на ошибки и узкие места. Сначала дай вывод в трех предложениях. Затем перечисли проблемы по убыванию критичности: где находится, чем грозит, как исправить. Не переписывай код, который работает корректно.

Для аналитического отчета:

text

Подготовь краткий отчет по этим данным для руководителя. Каждую цифру сопровождай источником. Если данных не хватает, прямо напиши, чего нет, и не додумывай значения.

Для резюме переписки:

text

Сделай резюме этого обсуждения для руководителя в трех пунктах: в чем проблема, что уже сделано и кем, что осталось и к какому сроку.

Для планирования миграции:

text

Прежде чем менять код, составь план миграции: какие файлы затронуты, в каком порядке их менять, какие тесты запустить после каждого шага и где самый высокий риск регрессии.

Частые вопросы про Claude Opus 5.5

Когда вышла Claude Opus 5.5?
Anthropic представила модель 22 сентября 2026 года. Это первая модель семейства Claude 5.5.

Чем Claude Opus 5.5 отличается от Opus 5?
Новая модель дешевле на 20% за токен и примерно на 40% на типичной задаче, быстрее более чем на 30%, сильнее в агентном коде и аналитике и пишет понятнее. При этом у нее строже защитные механизмы и нельзя отключить режим рассуждений.

Claude Opus 5.5 лучше, чем Fable 5.1?
По бенчмаркам Anthropic во многих тестах да, но сама компания говорит, что в реальной работе разрыв меньше, чем показывают цифры. Честнее сказать, что Opus 5.5 выдает сопоставимый уровень за меньшие деньги.

Что лучше: Claude Opus 5.5 или GPT-6 Astra?
В агентном коде и офисных задачах Opus 5.5 по данным Anthropic впереди и заметно дешевле за задачу. В автоматизации бизнес-процессов и научных агентных задачах пока сильнее Astra.

Сколько стоит Claude Opus 5.5 в API?
$4 за миллион входных токенов, $20 за миллион выходных, $0,20 за чтение из кэша. В пакетном режиме цены вдвое ниже, а быстрый режим стоит $8 и $40.

Можно ли отключить thinking в Claude Opus 5.5?
Нет. Режим рассуждений всегда включен, глубину регулируют параметром effort. Для скорости и экономии используйте уровень low.

Как пользоваться Claude Opus 5.5 в России?
Официально сервисы Anthropic в России недоступны. Модели Claude можно попробовать через агрегаторы нейросетей, которые работают без VPN и принимают российские карты.

Когда выйдут Claude Sonnet 5.5 и Haiku 5.5?
Anthropic обещает их в ближайшие недели после релиза Opus 5.5.

Есть ли альтернатива подешевле?
Если задачи простые, а бюджет ограничен, посмотрите на Claude Haiku или открытые модели. Например, в нашем разборе DeepSeek мы сравнивали, где такая модель справляется не хуже флагманов.

Итог: кому переходить на Claude Opus 5.5 прямо сейчас

Если вы используете Claude для разработки, агентных сценариев или аналитики, переход на Claude Opus 5.5 почти наверняка окупится: меньше токенов, дешевле кэш, понятнее ответы. Только не забудьте проверить интеграцию на несовместимые изменения и заново подобрать effort.

Если вы на Fable 5.1 ради качества, имеет смысл прогнать свои задачи на Opus 5.5. Велик шанс, что для большей части работы разницы вы не заметите, а счет станет ощутимо меньше.

А если вы работаете с кибербезопасностью или биологией, заранее учитывайте новые ограничения и программы верифицированного доступа.

ссылка на оригинал статьи https://habr.com/ru/articles/1085462/