Claude Opus 5 представляет собой качественный скачок по сравнению с Claude Opus 4.8, с наибольшими улучшениями в глубоком рассуждении, агентных и долгосрочных задачах, а также в масштабировании вычислений во время выполнения. На этой странице кратко описано всё новое в Claude Opus 5, включая мышление, включённое по умолчанию, изменение инструментов в середине разговора и критическое изменение в том, когда мышление может быть отключено.
| Модель | Идентификатор модели в API | Описание |
|---|---|---|
| Claude Opus 5 | claude-opus-5 | Для сложного агентного программирования и корпоративных задач |
Claude Opus 5 имеет контекстное окно в 1 млн токенов (1 млн токенов — это и значение по умолчанию, и максимум; варианта с меньшим контекстом нет), максимум 128 тыс. выходных токенов и мышление, включённое по умолчанию.
Полные цены и характеристики см. в обзоре моделей.
Вы можете добавлять или удалять инструменты между ходами разговора, сохраняя кэш подсказок, вместо того чтобы повторно отправлять фиксированный список инструментов на протяжении всей сессии. Изменение инструментов в середине разговора находится в бета-версии: включайте бета-заголовок mid-conversation-tool-changes-2026-07-01 в свои запросы. Подробности использования см. в разделе Изменение инструментов в середине разговора.
Параметр fallbacks поддерживает новый режим "default", который применяет рекомендуемые Anthropic резервные модели по категориям отказов вместо списка моделей, который вы поддерживаете самостоятельно. Весь параметр fallbacks находится в бета-версии. Используйте бета-заголовок server-side-fallback-2026-07-01, который поддерживает как режим "default", так и явные списки моделей (более ранний заголовок server-side-fallback-2026-06-01 принимает только явные списки). См. Отказы и резервные модели.
Минимальная длина кэшируемой подсказки в Claude Opus 5 составляет 512 токенов, по сравнению с 1 024 токенами в Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования в Claude Opus 4.8, теперь могут создавать записи кэша без изменений в коде. Минимумы для каждой модели см. в разделе Кэширование подсказок.
Быстрый режим (исследовательская предварительная версия) доступен для Claude Opus 5 только через Claude API; в настоящее время он недоступен на Amazon Bedrock, Google Cloud или Microsoft Foundry. Быстрый режим для Claude Opus 5 стоит 10 долларов США за миллион входных токенов и 50 долларов США за миллион выходных токенов. Информацию о доступе, поддерживаемых моделях и ценах см. в разделе Быстрый режим.
В Claude Opus 4.8 запросы выполняются без мышления, если вы не установите thinking: {"type": "adaptive"}. В Claude Opus 5 те же запросы выполняются с включённым мышлением: модель сама решает, когда и сколько думать на каждом ходе, а параметр effort управляет глубиной мышления. Значение в протоколе не изменилось; thinking: {"type": "adaptive"} остаётся допустимым и эквивалентным значению по умолчанию.
Поскольку max_tokens — это жёсткое ограничение на общий вывод (мышление плюс текст ответа), пересмотрите его для рабочих нагрузок, которые выполнялись без мышления в Claude Opus 4.8.
API сохраняет возможность отключить мышление с учётом ограничения по effort, описанного ниже.
Claude Opus 5 преобразует дополнительный effort (усилие) в лучшие результаты надёжнее, чем любая предыдущая модель Opus, поэтому выбранный вами уровень effort имеет больший вес. Доступна полная шкала: low, medium, high, xhigh и max, где max — верхний уровень для максимально глубокого рассуждения. Начните со значения по умолчанию, high, и корректируйте в любую сторону на основе ваших оценок: понижайте там, где качество сохраняется, чтобы сэкономить токены и снизить задержку, или повышайте для самых требовательных задач. При работе с effort на уровне xhigh или max установите большое значение max_tokens, чтобы у модели было пространство для мышления и действий через субагентов и вызовы инструментов.
Этот запрос поднимает effort до максимального уровня max:
client = anthropic.Anthropic()
with client.messages.stream(
model="claude-opus-5",
max_tokens=64000,
output_config={"effort": "max"},
messages=[
{
"role": "user",
"content": "Explain why the sum of two even numbers is always even.",
}
],
) as stream:
response = stream.get_final_message()
print(response)Мышление включено по умолчанию в Claude Opus 5, поэтому поле thinking не требуется.
high или нижеВ Claude Opus 5 thinking: {"type": "disabled"} принимается только при уровне effort high или ниже. Установка thinking: {"type": "disabled"} с effort xhigh или max возвращает ошибку 400. Это общедоступное поведение начиная с Claude Opus 5, применяемое к каждому запросу, и это критическое изменение по сравнению с Claude Opus 4.8, где отключение мышления не зависело от уровня effort. Если сегодня вы отключаете мышление при высоких уровнях effort, либо оставьте мышление отключённым и установите effort на high или ниже, либо сохраните уровень effort и удалите поле thinking.
При отключённом мышлении Claude Opus 5 может иногда записывать вызов инструмента в свой текстовый вывод вместо создания блока tool_use или включать внутренние XML-теги в свой видимый ответ. По возможности оставляйте мышление включённым и контролируйте стоимость токенов с помощью более низких уровней effort; для интеграций, которые должны сохранять мышление отключённым, см. Работа с отключённым мышлением для способов смягчения через подсказки.
Помимо описанных выше изменений API, Claude Opus 5 ведёт себя иначе, чем Claude Opus 4.8, и вы можете заметить это без каких-либо изменений в коде. Ответы пользователю по умолчанию и письменные результаты стали длиннее. В агентных сессиях модель чаще сообщает пользователю о своём прогрессе. В мультиагентных фреймворках она охотнее делегирует задачи субагентам. Она также проверяет собственную работу без указаний, поэтому удалите инструкции по проверке, перенесённые из более ранних моделей («включи финальный шаг проверки», «используй субагента для проверки»); они вызывают избыточную проверку в Claude Opus 5. Шаблоны подсказок для настройки каждого из этих поведений см. в разделе Подсказки для Claude Opus 5.
По сравнению с Claude Opus 4.8, Claude Opus 5 представляет собой качественный скачок, а не постепенное улучшение, и обеспечивает передовой интеллект за половину стоимости Claude Fable 5. Наибольшие улучшения достигнуты в следующих областях:
max) в лучшие результаты.low и medium обеспечивают высокое качество при доле токенов и задержки по сравнению с более высокими настройками.Шаблоны подсказок, позволяющие максимально использовать эти возможности, см. в разделе Подсказки для Claude Opus 5.
Claude Opus 5 стоит 5 долларов США за миллион входных токенов и 25 долларов США за миллион выходных токенов — без изменений по сравнению с Claude Opus 4.8.
Полные цены, включая тарифы на пакетную обработку, кэширование подсказок и быстрый режим, см. в разделе Цены.
Claude Opus 5 доступен на следующих платформах:
claude-opus-5.anthropic.claude-opus-5. Claude Opus 5 также доступен через API InvokeModel на bedrock-runtime, обслуживаемый той же инфраструктурой; интеграция Claude на Amazon Bedrock (устаревшая) не включает его в свою таблицу идентификаторов моделей с версионированием по ARN.claude-opus-5.Claude Opus 4.8 остаётся доступным на всех этих платформах.
Для миграции с Claude Opus 4.8 обновите идентификатор модели:
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # AfterЗатем ознакомьтесь с двумя изменениями в поведении: мышление включено по умолчанию, а отключение мышления с effort xhigh или max возвращает ошибку 400. Пошаговые инструкции см. в руководстве по миграции.
Полные характеристики и цены для всех текущих моделей Claude.
Поведенческие различия и шаблоны подсказок, специфичные для Claude Opus 5.
Управляйте количеством токенов, которые Claude использует при ответе, от low до max.
Как работает мышление, когда оно включено по умолчанию, и когда его можно отключить.
Задайте Claude рекомендательный бюджет токенов для планирования своей работы.
Руководство по миграции на последние модели Claude с предыдущих версий Claude.
Получайте больше выходных токенов в секунду от моделей Claude Opus по премиальной цене.
Was this page helpful?