Claude Opus 5: обзор модели и что меняется в API

Anthropic выпустила Opus 5: цена осталась прежней, а качество подтянулось почти к Fable 5. Разбираю, что меняется для API и Claude Code, включая ломающее изменение с thinking.

Claude Opus 5: обзор модели и что меняется в API
TL;DR: Anthropic выпустила Claude Opus 5. Цена осталась прежней ($5 за миллион входных токенов и $25 за выходные, как у Opus 4.8), но модель подтянулась почти вплотную к Fable 5, который стоит вдвое дороже.

Что такое Claude Opus 5 и чем он отличается от Opus 4.8

Opus 5 доступен с 24 июля 2026 года на всех платформах: Claude API (claude-opus-5), Amazon Bedrock, Google Cloud, Microsoft Foundry. В подписках он стал моделью по умолчанию на Claude Max и самой сильной доступной моделью на Pro.

Модель находится близко к интеллекту Fable 5 за половину цены. По бенчмаркам Anthropic на CursorBench 3.2 при максимальном effort Opus 5 отстаёт от пикового результата Fable 5 на 0,5%, стоя вдвое дешевле за задачу. На Frontier-Bench v0.1 он больше чем удвоил результат Opus 4.8. На ARC-AGI 3, где нужно решать незнакомые задачи, результат втрое выше ближайшего конкурента.

Технические характеристики: контекст в 1 млн токенов (это и дефолт, и максимум, вариантов с меньшим окном нет), 128k выходных токенов, надёжный knowledge cutoff май 2026. Через Message Batches API с бета-хедером output-300k-2026-03-24 можно получить до 300k выходных токенов.

Цифры, понятно, от самой Anthropic, независимых замеров пока нет. Но из бенчмарков мне интереснее всего Zapier AutomationBench, где меряют доведение бизнес-задач от начала до конца. Zapier пишет, что предыдущие модели их сценарий с оттоком клиентов не проходили вообще, а Opus 5 дал 100%.

Что изменилось в поведении модели

Модель стала многословнее. Ответы пользователю и письменные артефакты по умолчанию длиннее, чем у Opus 4.8. В агентных сессиях она чаще комментирует, что делает прямо сейчас. В мультиагентных схемах охотнее делегирует субагентам.

Opus 5 проверяет свою работу сам, без напоминаний. Инструкции вроде «добавь финальный шаг верификации» или «используй субагента для проверки», которые кочевали из промптов для прошлых моделей, теперь вызывают избыточную перепроверку. Anthropic советует их вычистить.

💡
Проверь свой системный промпт и CLAUDE.md на фразы вроде «в конце обязательно проверь результат». На Opus 5 они дают перепроверку там, где модель и так проверяет себя сама.

Насчёт агентности есть красивый пример из анонса. На одной из задач Frontier-Bench модели дали чертёж детали и попросили собрать по нему 3D-модель во FreeCAD, при этом намеренно лишив возможности посмотреть на чертёж. Opus 5 написал собственный пайплайн компьютерного зрения, вытащил геометрию из пикселей и собрал деталь. Ни одна конкурирующая модель в том же окружении не справилась за пять попыток.

Effort в Opus 5 стал важнее, чем раньше

Полная лестница уровней сохранилась: low, medium, high, xhigh, max. По умолчанию на Claude API и в Claude Code стоит high.

Разница с прошлыми моделями в том, что Opus 5 конвертирует дополнительный effort в качество надёжнее любого предыдущего Opus. Раньше выкручивание уровня часто давало прирост токенов и латентности без внятного выигрыша. Теперь Anthropic советует стартовать с high и двигаться в обе стороны по результатам своих замеров: понижать там, где качество держится, повышать на самом сложном.

Отдельно отмечу нижние уровни. Anthropic заявляет сильное качество на low и medium при доле токенов от высоких настроек, и это подтверждают клиенты. Trading-компания в отзывах пишет про седьмую часть reasoning-токенов и меньше половины латентности по сравнению с Opus 4.8. Юридический сервис получил близкое качество при 26% меньшем расходе токенов. Если интересно, как effort устроен внутри Claude Code, я разбирал это в отдельном гайде.

Что нового в API: кэш, тулы и фолбэки

Первое и самое приятное для агентов: теперь можно менять список инструментов посреди диалога, не убивая prompt cache. Раньше набор тулов фиксировался на всю сессию, и любая правка обнуляла кэш. Нужен бета-хедер mid-conversation-tool-changes-2026-07-01.

Порог кэширования упал вдвое. Минимальная длина промпта для кэша на Opus 5 составляет 512 токенов против 1024 у Opus 4.8. Короткие системные промпты, которые раньше просто не попадали в кэш, теперь кэшируются.

И автоматические фолбэки. Параметр fallbacks получил режим "default": вместо списка моделей, который ты поддерживаешь руками, применяются рекомендации Anthropic по категории отказа. Бета-хедер server-side-fallback-2026-07-01. Смысл в том, что запрос, зарубленный классификатором безопасности, не падает с ошибкой, а уезжает на другую модель.

Ещё есть Fast mode: примерно в 2,5 раза быстрее обычного, стоит вдвое дороже ($10 и $50 за миллион токенов). Пока это research preview и только на Claude API, на Bedrock, Google Cloud и Microsoft Foundry его нет. В Claude Code Fast mode оплачивается из кредитов и переключается командой /fast.

✈️
Разбираю новые модели и настройки агентов по мере выхода, без пересказа пресс-релизов: подписывайся в телеге.

Безопасность: где Opus 5 стал свободнее

Автоматический аудит поведения показал, что Opus 5 самая согласованная модель Anthropic на сегодня: 2.3 балла по общему уровню рассогласованного поведения, ниже, чем у Opus 4.8, Sonnet 5 и Fable 5. Заодно самый низкий уровень обмана и наименьшая податливость на попытки обхода.

Классификаторы Opus 5 менее строгие, чем у Fable 5, и по оценке Anthropic будут срабатывать примерно на 85% реже. Модели разрешён поиск уязвимостей в исходном коде, но заблокированы бинарный анализ, пентест и генерация эксплойтов. Запросы, которые всё же зацепит классификатор, в Claude.ai, Claude Code и Claude Cowork по умолчанию уедут на Opus 4.8.

По биологии Opus 5 стал самой мощной общедоступной моделью для научной работы, потому что набор ограничений у него примерно как у Opus 4.8, а способности выше. Запросы по биологии, которые блокирует Fable 5, теперь маршрутизируются на Opus 5.

Сколько стоит Opus 5 по сравнению с остальной линейкой

Модель Вход, $/1M Выход, $/1M Контекст
Claude Fable 5 10 50 1M
Claude Opus 5 5 25 1M
Claude Sonnet 5 3 (сейчас 2) 15 (сейчас 10) 1M
Claude Haiku 4.5 1 5 200k

У Sonnet 5 до 31 августа 2026 действует вводная цена $2 и $10. Fast mode для Opus 5 удваивает базовый тариф.

Opus 5 не подорожал относительно Opus 4.8 ни на цент, а качество выросло заметно. Плюс модель тратит меньше токенов на ту же работу, так что реальный счёт за задачу скорее упадёт. Один из клиентов в отзывах приводит цифру: на 9 процентных пунктов выше точность при трети меньше ходов и вызовов инструментов и на 60% меньше времени.

Про Sonnet 5 я писал отдельно: он всё ещё отличный вариант, когда нужен объём и скорость, а задачи не самые заковыристые.

Вердикт: стоит ли переходить

Мне кажется, это редкий случай, когда переход обходится почти даром. Цена та же, качество выше, токенов тратится меньше. Если ты сидел на Opus 4.8, странно не обновиться.

Нюансы всё же есть. Модель стала болтливее, и там, где важна краткость, придётся поджимать её промптом. Старые инструкции про верификацию теперь мешают, а вылавливать их в разросшемся системном промпте занятие небыстрое.

Claude Opus 5
Модель по умолчанию на Claude Max и самая сильная на Pro. В API доступна как claude-opus-5 по $5 за миллион входных токенов.

Что ещё почитать