Anthropic выпустили Claude Opus 5. Компания позиционирует её как новую основную модель для программирования, длительной работы AI-агентов и профессиональных задач. По заявлению Anthropic, Opus 5 приблизилась по качеству к Fable 5 при вдвое более низкой цене API.

Основные заявленные улучшения касаются агентной работы: модель тщательнее проверяет собственный результат, лучше ищет первопричины ошибок и продолжает исправления после первого рабочего решения.
На SWE-bench Pro модель практически сравнялась с Fable 5: 79,2% против 80%. На FrontierBench v0.1 результат вырос с 18,7% у Opus 4.8 до 44,4%. На ARC-AGI-3 Opus 5 набрала 30,16% против 7,78% у GPT-5.6 Sol.
При этом на DeepSWE модель всё ещё уступает GPT-5.6 Sol: 68,8% против 72,7%.
Результаты опубликованы в system card модели. Большинство тестов проводила сама Anthropic с adaptive thinking на максимальном уровне effort и усреднением по пяти запускам.
Цена осталась на уровне Opus 4.8: $5 за миллион входных и $25 за миллион выходных токенов. Fast mode работает примерно в 2,5 раза быстрее и стоит вдвое дороже.
Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI-агентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!
ссылка на оригинал статьи https://habr.com/ru/articles/1062814/