Claude Fable 5 — самая мощная широко выпущенная модель Anthropic, общедоступная в Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry. Claude Mythos 5 обладает теми же возможностями и предлагается в ограниченном доступе одобренным клиентам в рамках Project Glasswing.
Базовые настройки, общие для claude-fable-5 и claude-mythos-5:
thinking не требуется. Как thinking: {type: "disabled"}, так и ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) возвращают ошибку 400.invalid_request_error. Организациям с соглашением ZDR следует обратиться к своей команде по работе с клиентами Anthropic для обсуждения конфигурации хранения данных. В качестве альтернативы вы можете настроить хранение данных для каждого рабочего пространства. Подробности для каждой платформы см. в разделе Требования к хранению данных для конкретных моделей.Чем различаются две модели:
stop_reason: "refusal". Claude Mythos 5 не включает эти классификаторы. См. Отказы и резервный вариант.Claude Mythos 5 — это преемник с ограниченным доступом для Claude Mythos Preview, исследовательской предварительной версии, доступной только по приглашению. Claude Fable 5 — это общедоступная модель с теми же возможностями, и изменения в этом разделе в равной мере применимы к обеим целевым моделям.
Миграция в основном выполняется простой заменой. Claude Mythos 5 и Claude Fable 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Mythos Preview, а количество токенов практически не меняется, поскольку все три модели используют один и тот же токенизатор. Ключевые изменения, которые нужно проверить, — это функции, которые больше недоступны (перечислены в следующем разделе), и вывод мышления. Если вы мигрируете на Claude Fable 5, также учитывайте отказы классификаторов безопасности, которых нет в Claude Mythos Preview и Claude Mythos 5; см. Отказы и резервный вариант.
График вывода Claude Mythos Preview из эксплуатации см. в разделе Устаревание моделей.
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After
# Или для общедоступной модели с теми же возможностями:
model = "claude-fable-5" # AfterРасширенное мышление и бюджеты токенов мышления: Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается в claude-mythos-5 и claude-fable-5 и возвращает ошибку 400. Адаптивное мышление всегда включено: модель сама определяет, когда и сколько думать при каждом запросе, и конфигурация thinking не требуется. thinking: {type: "disabled"} возвращает ошибку. У budget_tokens нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.
До (Claude Mythos Preview):
client.messages.create(
model="claude-mythos-preview",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)После (Claude Mythos 5):
client.messages.create(
model="claude-mythos-5",
max_tokens=16000,
messages=[{"role": "user", "content": "..."}],
)Изменение для Claude Fable 5 идентично, с claude-fable-5 в качестве имени модели.
Предзаполнение ассистента: Предзаполнение сообщения ассистента не поддерживается в claude-mythos-5 и claude-fable-5 и возвращает ошибку 400, так же как и в Claude Mythos Preview. Вместо этого используйте инструкции в системной подсказке.
Вывод мышления: В claude-mythos-5 и claude-fable-5 исходная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый обобщённый текст, когда thinking.display установлен в summarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления в Claude Fable 5 и Claude Mythos 5.
claude-mythos-5 и claude-fable-5 используют тот же токенизатор, что и claude-mythos-preview (токенизатор, представленный с Claude Opus 4.7). Количество токенов практически не меняется при миграции с claude-mythos-preview. По сравнению с моделями до Claude Opus 4.7 тот же контент может токенизироваться примерно в 30% больше токенов, в зависимости от содержимого и характера рабочей нагрузки.
/v1/messages/count_tokens возвращает практически неизменные значения для claude-mythos-5 и claude-fable-5 по сравнению с claude-mythos-preview. Заново определите базовые показатели стоимости и задержки на ваших собственных рабочих нагрузках.
claude-mythos-preview на claude-mythos-5 или на claude-fable-5 для общедоступной модели.thinking: {type: "enabled", budget_tokens: N}). Адаптивное мышление всегда включено, и поле thinking не требуется.thinking: {type: "disabled"}. Отключение мышления возвращает ошибку в claude-mythos-5 и claude-fable-5.budget_tokens. У него нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.thinking, обрабатывает его только как отображаемый текст и передаёт блоки мышления обратно без изменений при продолжении на той же модели. thinking.display по умолчанию равен "omitted" в claude-mythos-5 и claude-fable-5, так же как и в Claude Mythos Preview; установите display: "summarized", чтобы получать читаемые сводки. См. Вывод мышления в Claude Fable 5 и Claude Mythos 5.thinking и redacted_thinking из предыдущих ходов ассистента. Блоки мышления из claude-mythos-5 и claude-fable-5 привязаны к модели, которая их создала, и модели, отличные от Claude Fable 5 и Claude Mythos 5, молча игнорируют их. Удаление делает межмодельные запросы минимальными и единообразными.stop_reason: "refusal" и читайте поле stop_details.category. Claude Fable 5 запускает классификаторы безопасности, которых нет в Claude Mythos Preview и Claude Mythos 5. См. Отказы и резервный вариант.claude-mythos-preview.Claude Fable 5 и Claude Mythos 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Opus 5, с тем же контекстным окном в 1 млн токенов по умолчанию и тем же максимумом в 128 тыс. выходных токенов. Ограничения на предзаполнение и параметры сэмплирования, а также поведение отображения мышления переносятся из Claude Opus 5 без изменений. Изменения, которые нужно проверить, — это всегда включённое мышление, цены, Priority Tier и хранение данных.
model = "claude-opus-5" # Before
model = "claude-fable-5" # After
# Or, for the Project Glasswing model with the same capabilities:
model = "claude-mythos-5" # AfterМышление больше нельзя отключить: В Claude Opus 5 мышление включено по умолчанию и может быть отключено с помощью thinking: {type: "disabled"} при уровне effort high или ниже. В claude-fable-5 и claude-mythos-5 адаптивное мышление всегда включено, и thinking: {type: "disabled"} возвращает ошибку 400 при любом уровне effort. Удалите конфигурацию thinking: {type: "disabled"} и вместо этого используйте более низкие уровни effort для контроля расхода токенов.
Цены: Claude Fable 5 и Claude Mythos 5 стоят 10 долларов США за миллион входных токенов и 50 долларов США за миллион выходных токенов, по сравнению с 5 долларами США и 25 долларами США для Claude Opus 5. См. Цены на Claude.
Priority Tier: Priority Tier не поддерживается в Claude Opus 5, поэтому существующий трафик не затрагивается. Если у вашей организации есть обязательство по Priority Tier, Claude Fable 5 его поддерживает; Claude Mythos 5 — нет.
Хранение данных: Claude Fable 5 и Claude Mythos 5 требуют 30-дневного хранения данных и недоступны в рамках соглашений о нулевом хранении данных (ZDR); обе обозначены как Covered Models. См. Требования к хранению данных для конкретных моделей.
claude-opus-5 на claude-fable-5 (или claude-mythos-5).thinking: {type: "disabled"}; она возвращает ошибку 400 в claude-fable-5 и claude-mythos-5. Вместо этого используйте более низкие уровни effort для контроля расхода токенов и пересмотрите max_tokens для рабочих нагрузок, которые выполнялись с отключённым мышлением в Claude Opus 5.Миграция в основном выполняется простой заменой. Claude Fable 5 и Claude Mythos 5 используют тот же Messages API и те же паттерны использования инструментов, что и Claude Opus 4.8, с тем же контекстным окном в 1 млн токенов по умолчанию и тем же максимумом в 128 тыс. выходных токенов. Количество токенов практически не меняется, поскольку модели используют один и тот же токенизатор. Ключевые изменения, которые нужно проверить, — это всегда включённое адаптивное мышление, вывод мышления, отказы классификаторов безопасности (только Claude Fable 5) и цены.
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After
# Или для модели Project Glasswing с теми же возможностями:
model = "claude-mythos-5" # AfterПункты в этом разделе описывают различия в API и поведении, которые стоит проверить после замены идентификатора модели. Если не указано иное, они в равной мере применимы к claude-fable-5 и claude-mythos-5.
Адаптивное мышление всегда включено: Адаптивное мышление — единственный режим мышления в claude-fable-5 и claude-mythos-5. Модель сама определяет, когда и сколько думать при каждом запросе, и конфигурация thinking не требуется. thinking: {type: "disabled"} возвращает ошибку. Используйте параметр effort для управления глубиной мышления.
Изменение поведения, которое нужно проверить: в Claude Opus 4.8 запросы без поля thinking выполняются без мышления; в claude-fable-5 и claude-mythos-5 те же запросы выполняются с адаптивным мышлением. max_tokens остаётся жёстким ограничением на общий вывод — мышление плюс текст ответа, — поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления в Claude Opus 4.8. См. Контроль затрат.
До (Claude Opus 4.8):
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)После (Claude Fable 5):
client.messages.create(
model="claude-fable-5",
max_tokens=16000,
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)Изменение для Claude Mythos 5 идентично, с claude-mythos-5 в качестве имени модели.
Расширенное мышление и бюджеты мышления (без изменений): Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается в claude-fable-5 и claude-mythos-5 и возвращает ошибку 400, так же как и в Claude Opus 4.8. У budget_tokens нет прямой замены: мышление адаптивно, а параметр effort — это отдельный элемент управления на уровне вывода, а не бюджет мышления.
Предзаполнение ассистента (без изменений): Предзаполнение сообщения ассистента не поддерживается в claude-fable-5 и claude-mythos-5 и возвращает ошибку 400, так же как и в Claude Opus 4.8. Вместо этого используйте инструкции в системной подсказке.
Вывод мышления: В claude-fable-5 и claude-mythos-5 исходная цепочка рассуждений никогда не возвращается, но блоки мышления по-прежнему содержат читаемый обобщённый текст, когда thinking.display установлен в summarized. Передавайте блоки мышления обратно без изменений при продолжении разговора на той же модели. См. Вывод мышления в Claude Fable 5 и Claude Mythos 5.
Классификаторы безопасности и причина остановки refusal (только Claude Fable 5): claude-fable-5 запускает классификаторы безопасности для запросов и во время генерации ответа. Claude Mythos 5 не включает эти классификаторы. Когда классификатор отклоняет запрос, Messages API возвращает stop_reason: "refusal" как успешный ответ HTTP 200, а не ошибку. Поле stop_details.category сообщает, какой классификатор сработал, с категориями вроде "cyber", "bio" и "reasoning_extraction", или null, когда отказ не соответствует ни одной именованной категории. Полный набор см. в таблице категорий отказов.
Вам не выставляется счёт за входные токены запроса, отклонённого до генерации какого-либо вывода. Когда классификатор срабатывает в середине потока, входные и уже переданные выходные токены тарифицируются; отбросьте частичный вывод.
Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, передайте опциональный параметр fallbacks, который находится в бета-версии в Claude API. Параметр недоступен в Message Batches API, а также в Amazon Bedrock, Google Cloud и Microsoft Foundry; на этих трёх платформах выполняйте повтор на стороне клиента или используйте промежуточное ПО SDK для резервного варианта при отказе. См. Отказы и резервный вариант.
Начинайте с уровня effort high: Значение по умолчанию для параметра effort остаётся high. В Claude Opus 4.8 для программирования и работы с высокой автономностью рекомендуется явно устанавливать xhigh. В claude-fable-5 и claude-mythos-5 используйте high по умолчанию для большинства задач и резервируйте xhigh для наиболее чувствительных к возможностям рабочих нагрузок. Более низкие настройки effort по-прежнему работают хорошо и часто превосходят производительность xhigh на предыдущих моделях. Снижайте effort, если задача выполняется, но занимает больше времени, чем необходимо. См. Написание подсказок для Claude Fable 5.
Более низкий минимум для кэширования подсказок: Минимальная длина кэшируемой подсказки в claude-fable-5 и claude-mythos-5 составляет 512 токенов, что ниже 1 024 токенов в Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования в Claude Opus 4.8, теперь могут создавать записи кэша без каких-либо изменений кода. Минимумы для каждой модели см. в разделе Кэширование подсказок.
claude-fable-5 и claude-mythos-5 требуют 30-дневного хранения данных; в Claude API запросы к claude-fable-5, не соответствующие этому требованию, возвращают ошибку 400 invalid_request_error. Claude Opus 4.8 остаётся доступной в рамках ZDR. См. Требования к хранению данных для конкретных моделей.claude-opus-4-8 на claude-fable-5 (или claude-mythos-5).thinking: {type: "disabled"}. Отключение мышления возвращает ошибку в claude-fable-5 и claude-mythos-5, а запросы без поля thinking выполняются с адаптивным мышлением.claude-fable-5 и claude-mythos-5.thinking, обрабатывает его только как отображаемый текст и передаёт блоки мышления обратно без изменений при продолжении на той же модели. thinking.display по умолчанию равен "omitted" в claude-fable-5 и claude-mythos-5, так же как и в Claude Opus 4.8; установите display: "summarized", чтобы получать читаемые сводки. См. Вывод мышления в Claude Fable 5 и Claude Mythos 5.thinking и redacted_thinking из предыдущих ходов ассистента. Блоки мышления из claude-fable-5 и claude-mythos-5 привязаны к модели, которая их создала, и модели, отличные от Claude Fable 5 и Claude Mythos 5, молча игнорируют их. Удаление делает межмодельные запросы минимальными и единообразными. Исключение — использование резервного кредита, которое требует тела запроса, повторённого в точном соответствии с правилами этой функции.stop_reason: "refusal" и читайте поле stop_details.category. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, рассмотрите опциональный параметр fallbacks (бета). См. Отказы и резервный вариант.effort. Начинайте с high для большинства задач, включая рабочие нагрузки, которые выполнялись с xhigh в Claude Opus 4.8.claude-opus-4-8; цена за токен отличается.Claude Opus 5 — это качественный скачок по сравнению с Claude Opus 4.8, сильный в глубоких рассуждениях, агентных и долгосрочных задачах, а также в масштабировании вычислений во время тестирования. Поведенческие различия и специфичные для модели паттерны подсказок см. в разделе Написание подсказок для Claude Opus 5.
Claude Opus 5 — это обновление с простой заменой для Claude Opus 4.8 по той же цене: 5 долларов за миллион входных токенов и 25 долларов за миллион выходных токенов; см. Цены на Claude. Есть два изменения с нарушением совместимости для кода, уже работающего на Claude Opus 4.8, описанные ниже в разделе «Изменения с нарушением совместимости». Claude Opus 5 поддерживает тот же набор функций, что и Claude Opus 4.8, включая контекстное окно в 1 млн токенов (по умолчанию, без бета-заголовка), максимум в 128 тыс. выходных токенов, адаптивное мышление, кэширование подсказок, пакетную обработку, Files API, поддержку PDF, зрение, а также серверные и клиентские инструменты, с двумя исключениями: web fetch недоступен в Claude Opus 5, и Priority Tier не поддерживается в Claude Opus 5. Доступность для каждой модели см. на странице соответствующего инструмента.
# Миграция на Opus
model = "claude-opus-4-8" # Before
model = "claude-opus-5" # Afterclaude-opus-5 — это фиксированный идентификатор модели без суффикса даты, по той же схеме, что и claude-opus-4-8 и claude-sonnet-5.
Мышление включено по умолчанию: В Claude Opus 4.8 запросы без поля thinking выполняются без мышления; в Claude Opus 5 те же запросы выполняются с адаптивным мышлением. max_tokens остаётся жёстким ограничением на общий вывод — мышление плюс текст ответа, — поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления в Claude Opus 4.8. Чтобы сохранить прежнее поведение, передайте thinking: {type: "disabled"} с учётом ограничения на effort из следующего пункта; обратите внимание, что при отключённом мышлении модель может иногда выдавать вызовы инструментов как обычный текст или включать внутренние XML-теги в видимый вывод, поэтому по возможности предпочитайте более низкие уровни effort с включённым мышлением, а там, где это невозможно, см. способы смягчения в разделе Работа с отключённым мышлением.
Отключение мышления ограничено уровнем effort high: Вы по-прежнему можете отключить мышление с помощью thinking: {type: "disabled"}, но только при уровне effort high или ниже. Запрос, сочетающий thinking: {type: "disabled"} с effort xhigh или max, возвращает ошибку 400. Claude Opus 4.8 принимает эту комбинацию, поэтому проверьте запросы, отключающие мышление, перед миграцией.
Проверка выполняется для каждого запроса: конфигурация effort и мышления каждого запроса проверяется независимо, поэтому запрос, повышающий effort до xhigh или max при отключённом мышлении, отклоняется, даже если более ранние запросы в разговоре были приняты.
До (принимается в Claude Opus 4.8, отклоняется в Claude Opus 5):
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "disabled"},
output_config={"effort": "xhigh"},
messages=[{"role": "user", "content": "..."}],
)После (Claude Opus 5) — либо удалите поле thinking, чтобы снова включить мышление:
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
output_config={"effort": "xhigh"}, # thinking is on by default
messages=[{"role": "user", "content": "..."}],
)либо оставьте мышление отключённым и снизьте effort:
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
thinking={"type": "disabled"},
output_config={"effort": "high"}, # or "medium", "low"
messages=[{"role": "user", "content": "..."}],
)Они не обязательны, но улучшат ваш опыт работы:
Протестируйте effort max для критически важной по возможностям работы: Claude Opus 5 поддерживает полный набор уровней effort (low, medium, high, xhigh, max). Там, где максимальные возможности важнее расхода токенов, протестируйте effort max. Он может дать прирост на самых сложных задачах, но может демонстрировать убывающую отдачу от увеличенного использования токенов и склонен к избыточному обдумыванию на более простых задачах. Если вы работаете с effort xhigh или max, установите большое значение max_tokens, чтобы у модели было пространство для размышлений и действий; начните с 64 тыс. токенов и настраивайте дальше.
Рассмотрите автоматические резервные варианты: Claude Opus 5 поставляется с классификаторами безопасности в области кибербезопасности, отказы которых в категории cyber могут переключаться на Claude Opus 4.8. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, рассмотрите параметр fallbacks с режимом "default" (fallbacks: "default"), который выбирает рекомендуемую резервную модель на основе категории отказа вместо вручную поддерживаемого списка моделей. Серверный резервный вариант находится в бета-версии; режим "default" требует бета-заголовка server-side-fallback-2026-07-01. См. Отказы и резервный вариант.
Кэшируйте более короткие подсказки: Минимальная длина кэшируемой подсказки в Claude Opus 5 составляет 512 токенов, по сравнению с 1 024 токенами в Claude Opus 4.8. Подсказки, которые были слишком короткими для кэширования в Claude Opus 4.8, теперь могут создавать записи кэша без каких-либо изменений кода. Минимумы для каждой модели см. в разделе Кэширование подсказок.
Изменение инструментов в середине разговора (бета): Вы можете добавлять или удалять инструменты между ходами разговора без инвалидации попаданий в кэш подсказок для более ранних ходов. Отправьте бета-заголовок mid-conversation-tool-changes-2026-07-01. Это полезно для агентных рабочих нагрузок, которые постепенно открывают инструменты или убирают их по мере продвижения задачи; без этого изменённый список инструментов инвалидирует кэшированный префикс.
Перенастройте подсказки для длины и многословности: Видимые ответы по умолчанию и письменные результаты в Claude Opus 5 длиннее, чем в Claude Opus 4.8, а снижение effort уменьшает объём мышления, но не гарантирует сокращения видимого ответа. Вместо этого явно указывайте в подсказке требование краткости или целевую длину. См. Длина и многословность ответа и Длина письменных результатов.
Удалите перенесённые инструкции по проверке и ограничьте область задачи: Claude Opus 5 проверяет свою работу без указаний, поэтому удалите явные инструкции по проверке или самопроверке, перенесённые из подсказок, настроенных для более ранних моделей; их сохранение приводит к избыточной проверке. Для узких задач явно ограничивайте область задачи. В мультиагентных фреймворках давайте явные указания о том, какие сценарии требуют делегирования, или ограничивайте количество субагентов, поскольку Claude Opus 5 делегирует охотнее, чем более ранние модели. См. Область задачи и избыточная проверка и Управление порождением субагентов.
claude-opus-4-8 на claude-opus-5.thinking: в Claude Opus 5 они выполняются с мышлением. Пересмотрите max_tokens, который остаётся жёстким ограничением на общий вывод (мышление плюс текст ответа), или передайте thinking: {type: "disabled"} при effort high или ниже, чтобы сохранить прежнее поведение. Если вы отключаете мышление, ознакомьтесь с разделом Работа с отключённым мышлением, чтобы узнать о возможных артефактах вывода и способах их смягчения через подсказки.thinking: {type: "disabled"} с effort xhigh или max возвращает ошибку 400, проверка выполняется для каждого запроса. Снова включите мышление или снизьте effort до high или ниже.effort: проведите свежий перебор уровней effort на ваших собственных оценках вместо переноса настройки, подобранной для более ранней модели. Effort low и medium стоит протестировать как средства контроля стоимости и задержки, а effort max протестируйте там, где максимальные возможности важнее расхода токенов. Если вы работаете с effort xhigh или max, увеличьте max_tokens как минимум до 64 тыс. в качестве отправной точки.stop_reason: "refusal" и рассмотрите fallbacks: "default" (бета) для автоматического повторного выполнения отклонённых запросов на рекомендуемой резервной модели.Claude Opus 5 должен демонстрировать высокую производительность «из коробки» на существующих подсказках и оценках Claude Opus 4.7 по той же цене — $5 за миллион входных токенов и $25 за миллион выходных токенов. Он поддерживает тот же набор функций, что и Claude Opus 4.7, включая контекстное окно в 1 млн токенов, максимум 128k выходных токенов, адаптивное мышление, кэширование подсказок, пакетную обработку, Files API, поддержку PDF, компьютерное зрение, а также серверные и клиентские инструменты, с двумя исключениями: web fetch недоступен в Claude Opus 5, а Priority Tier не поддерживается в Claude Opus 5. Также добавлены системные сообщения в середине разговора и публично задокументированы детали остановки при отказе.
# Миграция на Opus
model = "claude-opus-4-7" # Before
model = "claude-opus-5" # AfterМышление включено по умолчанию: В Claude Opus 4.7 запросы без поля thinking выполняются без мышления; в Claude Opus 5 те же запросы выполняются с адаптивным мышлением. max_tokens остаётся жёстким ограничением на общий вывод — мышление плюс текст ответа, — поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления в Claude Opus 4.7. Чтобы сохранить прежнее поведение, передайте thinking: {type: "disabled"} с учётом ограничения на уровень усилий, описанного в следующем пункте; обратите внимание, что при отключённом мышлении модель может иногда выдавать вызовы инструментов в виде обычного текста или включать внутренние XML-теги в видимый вывод, поэтому по возможности предпочитайте более низкие уровни усилий с включённым мышлением, а если это невозможно — см. способы смягчения в разделе Работа с отключённым мышлением.
Отключение мышления ограничено уровнем усилий high: Вы можете отключить мышление с помощью thinking: {type: "disabled"}, но только при уровне усилий high или ниже. Запрос, сочетающий thinking: {type: "disabled"} с уровнем усилий xhigh или max, возвращает ошибку 400. Claude Opus 4.7 принимает такую комбинацию, поэтому проверьте запросы, отключающие мышление, перед миграцией.
Проверка выполняется для каждого запроса: конфигурация усилий и мышления каждого запроса проверяется независимо, поэтому запрос, повышающий уровень усилий до xhigh или max при отключённом мышлении, отклоняется, даже если более ранние запросы в разговоре были приняты.
До (принимается в Claude Opus 4.7, отклоняется в Claude Opus 5):
client.messages.create(
model="claude-opus-4-7",
max_tokens=16000,
thinking={"type": "disabled"},
output_config={"effort": "xhigh"},
messages=[{"role": "user", "content": "..."}],
)После (Claude Opus 5) — либо удалите поле thinking, чтобы выполнять запрос с мышлением:
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
output_config={"effort": "xhigh"}, # thinking is on by default
messages=[{"role": "user", "content": "..."}],
)либо оставьте мышление отключённым и снизьте уровень усилий:
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
thinking={"type": "disabled"},
output_config={"effort": "high"}, # or "medium", "low"
messages=[{"role": "user", "content": "..."}],
)Следующие пункты не являются критическими изменениями; они описывают различия в поведении, которые стоит проверить после смены идентификатора модели.
Параметры сэмплирования (без изменений): Установка temperature, top_p или top_k в значение, отличное от значения по умолчанию, возвращает ошибку 400 в Claude Opus 5 — так же, как и в Claude Opus 4.7. Типы запросов SDK по-прежнему определяют эти поля для совместимости с более ранними моделями, поэтому код, устанавливающий их, проходит проверку типов, но API отклоняет запрос на стороне сервера. Если вы удалили эти параметры при миграции на Opus 4.7, дополнительных изменений не требуется.
Уровень усилий по умолчанию — high: Значение по умолчанию для параметра effort в Claude Opus 5 — high в Claude API и Claude Code. Если вы уже задаёте уровень усилий явно, ваша настройка не изменится.
Уровни усилий перекалиброваны: Распределение токенов за каждым уровнем усилий в Claude Opus 5 отличается от Claude Opus 4.7, и Claude Opus 5 поддерживает полный набор уровней усилий (low, medium, high, xhigh, max). Проведите новый перебор уровней усилий на собственных оценках вместо переноса настройки, подобранной для Claude Opus 4.7. Уровни low и medium стоит протестировать как средства контроля стоимости и задержки, а уровень max — там, где максимальные возможности важнее расхода токенов. Если вы работаете на уровне усилий xhigh или max, установите большое значение max_tokens, чтобы у модели было пространство для мышления и действий; начните с 64k токенов и настраивайте дальше. См. Effort.
Контекстное окно в 1 млн токенов — по умолчанию: Claude Opus 5 предоставляет полное контекстное окно в 1 млн токенов по умолчанию без бета-заголовка и без надбавки за длинный контекст. Если ваш клиент передаёт бета-заголовок контекстного окна для совместимости со старыми моделями, вы можете удалить его для Claude Opus 5.
Системные сообщения в середине разговора: Claude Opus 5 принимает сообщения с role: "system" сразу после хода пользователя в массиве messages (с учётом правил размещения). Используйте поле верхнего уровня system для инструкций, применяемых с самого начала. Claude Opus 4.7 отклоняет role: "system" в messages с ошибкой 400. Если вы поддерживаете пути кода, которые перестраивают полную историю сообщений для обновления инструкций, вы можете упростить их и сохранить попадания в кэш подсказок для более ранних ходов.
Детали остановки при отказе: Объект stop_details в ответах с отказом (доступен начиная с Claude Opus 4.7) теперь публично задокументирован. Когда модель отклоняет запрос, она указывает категорию отказа в дополнение к существующей причине остановки refusal. Бета-заголовок не требуется, и отказаться от этого нельзя. См. Обработка причин остановки.
Снижен минимум для кэширования подсказок: Минимальная длина кэшируемой подсказки в Claude Opus 5 составляет 512 токенов — меньше, чем в Claude Opus 4.7. Подсказки, которые были слишком короткими для кэширования в Claude Opus 4.7, теперь могут создавать записи кэша без изменений в коде. См. Кэширование подсказок для минимумов по моделям.
Быстрый режим: Claude Opus 5 поддерживает быстрый режим (исследовательская предварительная версия); быстрый режим недоступен в Claude Opus 4.7, где запросы с speed: "fast" возвращают ошибку. Параметр speed: "fast" и бета-заголовок fast-mode-2026-02-01 работают без изменений в Claude Opus 5.
Эти изменения не обязательны, но улучшат ваш опыт работы:
Рассмотрите автоматические резервные варианты: Claude Opus 5 поставляется с классификаторами безопасности в области кибербезопасности, чьи отказы по киберкатегориям могут переключаться на Claude Opus 4.8. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, рассмотрите параметр fallbacks с режимом "default" (fallbacks: "default"), который выбирает рекомендуемую резервную модель на основе категории отказа вместо вручную поддерживаемого списка моделей. Серверный резервный вариант находится в бета-версии; режим "default" требует бета-заголовка server-side-fallback-2026-07-01. См. Отказы и резервные варианты.
Изменение инструментов в середине разговора (бета): Вы можете добавлять или удалять инструменты между ходами разговора без инвалидации попаданий в кэш подсказок для более ранних ходов. Отправьте бета-заголовок mid-conversation-tool-changes-2026-07-01. Это полезно для агентных рабочих нагрузок, которые предоставляют инструменты постепенно или убирают их по мере выполнения задачи; без этого изменённый список инструментов инвалидирует кэшированный префикс.
Перенастройте подсказки для длины и многословности: Видимые ответы по умолчанию и письменные результаты в Claude Opus 5 длиннее, чем в более ранних моделях Opus, а снижение уровня усилий уменьшает объём мышления, но не обязательно сокращает видимый ответ. Вместо этого явно указывайте в подсказке требование краткости или целевую длину. См. Длина и многословность ответа и Длина письменных результатов.
Удалите перенесённые инструкции по проверке и ограничьте область задачи: Claude Opus 5 проверяет собственную работу без указаний, поэтому удалите явные инструкции по проверке или самопроверке, перенесённые из подсказок, настроенных для более ранних моделей; их сохранение приводит к избыточной проверке. Для узких задач явно ограничивайте область задачи. В мультиагентных фреймворках давайте явные указания о том, какие сценарии требуют делегирования, или ограничивайте количество субагентов, поскольку Claude Opus 5 делегирует охотнее, чем более ранние модели. См. Область задачи и избыточная проверка и Контроль порождения субагентов.
claude-opus-4-7 на claude-opus-5 (или обновите псевдонимы).thinking: в Claude Opus 5 они выполняются с мышлением. Пересмотрите max_tokens, который остаётся жёстким ограничением на общий вывод (мышление плюс текст ответа), или передайте thinking: {type: "disabled"} при уровне усилий high или ниже, чтобы сохранить прежнее поведение. Если вы отключаете мышление, ознакомьтесь с разделом Работа с отключённым мышлением, чтобы узнать об артефактах вывода, которые могут появиться, и способах их смягчения через подсказки.thinking: {type: "disabled"} с уровнем усилий xhigh или max возвращает ошибку 400, проверка выполняется для каждого запроса. Включите мышление снова или снизьте уровень усилий до high или ниже.effort: проведите новый перебор уровней усилий на собственных оценках вместо переноса настройки, подобранной для Claude Opus 4.7. Протестируйте уровни low и medium как средства контроля стоимости и задержки, а уровень max — там, где максимальные возможности важнее расхода токенов. Если вы работаете на уровне усилий xhigh или max, увеличьте max_tokens как минимум до 64k в качестве отправной точки.stop_details при отказах (доступно начиная с Claude Opus 4.7; теперь публично задокументировано), и рассмотрите fallbacks: "default" (бета) для автоматического повторного выполнения отклонённых запросов на рекомендуемой резервной модели.speed: "fast" и бета-заголовок fast-mode-2026-02-01 работают без изменений в Claude Opus 5.Claude Opus 5 должен демонстрировать высокую производительность «из коробки» на существующих подсказках и оценках Claude Opus 4.6 при той же цене, однако есть несколько изменений в поведении и API, о которых стоит знать при миграции. Большинство этих изменений вступили в силу в Claude Opus 4.7; ещё два — мышление, включённое по умолчанию, и ограничение уровня усилий при отключении мышления — вступают в силу в Claude Opus 5. Все они описаны ниже, так что этот раздел является полным для кода, переходящего напрямую с Claude Opus 4.6. Claude Opus 5 поддерживает тот же набор функций, что и Claude Opus 4.6, включая:
Два исключения: web fetch недоступен в Claude Opus 5, а Priority Tier не поддерживается в Claude Opus 5.
# Миграция на Opus
model = "claude-opus-4-6" # Before
model = "claude-opus-5" # AfterРасширенное мышление удалено: thinking: {type: "enabled", budget_tokens: N} больше не поддерживается в Claude Opus 4.7 и более поздних моделях и возвращает ошибку 400. Переключитесь на адаптивное мышление (thinking: {type: "adaptive"}) и используйте параметр effort для управления глубиной мышления. В Claude Opus 5 адаптивное мышление включено по умолчанию: thinking: {type: "adaptive"} является допустимым и эквивалентно полному отсутствию поля thinking (см. следующий пункт).
До (Claude Opus 4.6):
client.messages.create(
model="claude-opus-4-6",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)После (Claude Opus 5):
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"}, # or "max", "xhigh", "medium", "low"
messages=[{"role": "user", "content": "..."}],
)Адаптивным мышлением можно управлять через подсказки и параметр effort; см. Выбор уровня усилий.
Мышление включено по умолчанию: В Claude Opus 4.6 и Claude Opus 4.7 запросы без поля thinking выполняются без мышления; в Claude Opus 5 те же запросы выполняются с адаптивным мышлением. max_tokens остаётся жёстким ограничением на общий вывод — мышление плюс текст ответа, — поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления. Чтобы сохранить прежнее поведение, передайте thinking: {type: "disabled"} с учётом ограничения уровня усилий из следующего пункта; обратите внимание, что при отключённом мышлении модель иногда может выдавать вызовы инструментов в виде обычного текста или включать внутренние XML-теги в видимый вывод, поэтому по возможности предпочитайте более низкие уровни усилий с включённым мышлением, а если это невозможно, см. способы смягчения в разделе Работа с отключённым мышлением.
Отключение мышления ограничено уровнем усилий high: Вы можете отключить мышление с помощью thinking: {type: "disabled"}, но только при уровне effort high или ниже. Запрос, сочетающий thinking: {type: "disabled"} с уровнем усилий xhigh или max, возвращает ошибку 400 в Claude Opus 5; проверка выполняется для каждого запроса. Проверьте запросы, отключающие мышление, перед миграцией: включите мышление обратно или снизьте уровень усилий до high или ниже.
Параметры сэмплирования удалены: Установка temperature, top_p или top_k в любое значение, отличное от значения по умолчанию, в Claude Opus 4.7 и более поздних моделях, включая Claude Opus 5, возвращает ошибку 400. Самый безопасный путь миграции — полностью исключить эти параметры из тела запроса. Подсказки — рекомендуемый способ управления поведением модели в Claude Opus 5. Если вы использовали temperature = 0 для детерминизма, учтите, что это никогда не гарантировало идентичных выводов в предыдущих моделях.
Содержимое мышления по умолчанию опускается: Блоки мышления по-прежнему появляются в потоке ответа в Claude Opus 4.7 и более поздних моделях, но их поле thinking пустое, если вы явно не включили его отображение. Это неявное изменение по сравнению с Claude Opus 4.6, где по умолчанию возвращался суммаризированный текст мышления. Чтобы восстановить суммаризированное содержимое мышления, установите thinking.display в значение "summarized":
thinking = {
"type": "adaptive",
"display": "summarized",
}Значение по умолчанию — "omitted" в Claude Opus 4.7 и более поздних моделях. Если ваш продукт транслирует рассуждения пользователям, новое значение по умолчанию выглядит как длинная пауза перед началом вывода; установите display: "summarized", чтобы восстановить видимый прогресс во время мышления. Подробности см. в разделе Управление отображением мышления.
Обновлённый подсчёт токенов: В Claude Opus 4.7 появился новый токенизатор, который также используется в более поздних моделях Opus, включая Claude Opus 5. Он способствует улучшению производительности в широком спектре задач и может использовать примерно в 1–1,35 раза больше токенов при обработке текста по сравнению с моделями до Claude Opus 4.7 (до ~35% больше, в зависимости от содержимого).
/v1/messages/count_tokens возвращает другое количество токенов для Claude Opus 5, чем для Claude Opus 4.6. Эффективность токенов может варьироваться в зависимости от характера рабочей нагрузки.
Вмешательства через подсказки, task_budget и effort могут помочь контролировать затраты и обеспечить надлежащее использование токенов. Эти средства управления могут снижать интеллектуальность модели. Обновите параметры max_tokens, чтобы обеспечить дополнительный запас, включая триггеры компактизации. Claude Opus 5 предоставляет контекстное окно в 1 млн токенов по стандартной цене API без надбавки за длинный контекст.
Удаление предзаполнения (перенесено из Opus 4.6): Предзаполнение сообщений ассистента возвращает ошибку 400 в Claude Opus 4.7 и более поздних моделях, включая Claude Opus 5. Вместо этого используйте структурированные выводы, инструкции в системной подсказке или output_config.format.
Параметр effort позволяет настраивать баланс между интеллектуальностью Claude и расходом токенов, обменивая возможности на более высокую скорость и меньшие затраты. Claude Opus 5 поддерживает полный набор уровней усилий и по умолчанию использует high. Проведите свежий перебор уровней усилий на собственных оценках, а не переносите настройку, подобранную для более ранней модели:
max: Может давать прирост на самых сложных задачах, но может демонстрировать убывающую отдачу от увеличенного использования токенов и склонен к избыточному обдумыванию более простых задач. Тестируйте его там, где максимальные возможности важнее расхода токенов.xhigh: Расширенные возможности для длительной агентной работы и программирования, требующих большей глубины, чем значение по умолчанию.high: Значение по умолчанию. Балансирует использование токенов и интеллектуальность для большинства задач.medium: Экономичное понижение относительно значения по умолчанию, стоит протестировать как средство контроля затрат и задержки.low: Наиболее эффективный. Оставьте для коротких, ограниченных по объёму задач и рабочих нагрузок, чувствительных к задержке.Если вы работаете на уровне усилий xhigh или max, установите большое значение max_tokens, чтобы у модели было пространство для мышления и действий; начните с 64k токенов и настраивайте дальше. Уровень усилий важнее для этой модели, чем для любой предыдущей Opus. Активно экспериментируйте с ним при обновлении.
В Claude Opus 4.7 появилось несколько поведенческих отличий от Claude Opus 4.6, которые не являются критическими изменениями API, но могут потребовать обновления подсказок или удаления вспомогательной обвязки. Они переносятся в Claude Opus 5 с корректировками, указанными ниже.
Длина ответа зависит от сценария использования: Claude Opus 4.7 калибрует длину ответа в зависимости от того, насколько сложной он считает задачу, вместо использования фиксированной многословности по умолчанию. Обычно это означает более короткие ответы на простые запросы и значительно более длинные — на открытый анализ.
Если ваш продукт зависит от определённого стиля или многословности вывода, вам может потребоваться настроить подсказки. Например, чтобы уменьшить многословность, добавьте: «Давай краткие, сфокусированные ответы. Пропускай несущественный контекст и сводите примеры к минимуму». Если вы наблюдаете конкретные виды избыточных объяснений, добавьте целевые инструкции в подсказку, чтобы предотвратить их.
Положительные примеры, показывающие, как Claude может общаться с надлежащим уровнем краткости, как правило, более эффективны, чем отрицательные примеры или инструкции, указывающие модели, чего не делать. В Claude Opus 5 видимые ответы по умолчанию и письменные результаты длиннее, чем в более ранних моделях Opus, а снижение уровня усилий уменьшает объём мышления, но не гарантирует сокращения видимого ответа; явно запрашивайте краткость или целевую длину в подсказке. См. Длина ответа и многословность.
Более буквальное следование инструкциям: Claude Opus 4.7 интерпретирует подсказки более буквально и явно, чем Claude Opus 4.6, особенно на более низких уровнях усилий. Он не обобщает молча инструкцию с одного элемента на другой и не выводит запросы, которых вы не делали. Преимущество этой буквальности — точность и меньше метаний. Как правило, он работает лучше для сценариев использования API с тщательно настроенными подсказками, структурированным извлечением и конвейерами, где требуется предсказуемое поведение. Пересмотр подсказок и обвязки может быть особенно полезен при миграции на Claude Opus 5.
Более прямой тон: Как и с любой новой моделью, стиль прозы в длинных текстах может измениться. Claude Opus 4.7 более прямой и категоричный, с меньшим количеством одобрительных формулировок и эмодзи, чем более тёплый стиль Claude Opus 4.6. Если ваш продукт полагается на определённый голос, переоцените стилевые подсказки относительно новой базовой линии.
Встроенные обновления прогресса в агентных трассировках: Claude Opus 4.7 предоставляет более регулярные и качественные обновления пользователю на протяжении длинных агентных трассировок. Если вы добавили обвязку для принудительных промежуточных сообщений о статусе («После каждых 3 вызовов инструментов суммируй прогресс»), попробуйте её удалить. Если вы обнаружите, что длина или содержание пользовательских обновлений Claude Opus 4.7 плохо откалиброваны для вашего сценария использования, явно опишите в подсказке, как должны выглядеть эти обновления, и приведите примеры.
Изменено порождение субагентов: Claude Opus 4.7 по умолчанию склонен порождать меньше субагентов, чем Claude Opus 4.6, тогда как Claude Opus 5 делегирует субагентам охотнее, чем более ранние модели. Этим поведением можно управлять через подсказки в любом направлении; дайте явные указания о том, когда субагенты желательны, или ограничьте их количество. См. Управление порождением субагентов.
Более строгая калибровка усилий: Существенно отличаясь от Claude Opus 4.6, Claude Opus 4.7 строго соблюдает уровни усилий, особенно на нижнем конце. На уровнях low и medium модель ограничивает свою работу тем, что было запрошено, вместо того чтобы делать больше, чем требуется.
Это хорошо для задержки и стоимости, но на умеренно сложных задачах, выполняемых на уровне low, есть некоторый риск недостаточного обдумывания. Если вы наблюдаете поверхностные рассуждения на сложных проблемах, повысьте уровень усилий до high или xhigh, вместо того чтобы обходить это через подсказки.
Если вам нужно сохранить уровень усилий low ради задержки, добавьте целевое указание: «Эта задача включает многошаговые рассуждения. Тщательно обдумай проблему, прежде чем отвечать». См. Рекомендуемые уровни усилий для Claude Opus 4.7.
Меньше вызовов инструментов по умолчанию: Claude Opus 4.7 склонен использовать инструменты реже, чем Claude Opus 4.6, и больше полагаться на рассуждения. В большинстве случаев это даёт лучшие результаты.
Чтобы увеличить использование инструментов, повысьте настройку усилий. Настройки усилий high или xhigh демонстрируют существенно большее использование инструментов в агентном поиске и программировании. Вы также можете скорректировать подсказку, чтобы явно проинструктировать модель о том, когда и как правильно использовать её инструменты.
Защитные механизмы кибербезопасности в реальном времени: Впервые добавленные в Claude Opus 4.7, запросы, затрагивающие запрещённые или высокорисковые темы, могут приводить к отказам. Для легитимной работы в области безопасности, такой как тестирование на проникновение, исследование уязвимостей или red-teaming, подайте заявку в Cyber Verification Program, чтобы запросить снижение ограничений. См. Защитные механизмы, предупреждения и апелляции для справки.
Поддержка изображений высокого разрешения: Claude Opus 4.7 — первая модель Claude с поддержкой изображений высокого разрешения. Максимальное разрешение изображения составляет 2 576 пикселей по длинной стороне, по сравнению с 1 568 пикселями в предыдущих моделях. Это открывает преимущества для рабочих нагрузок, интенсивно использующих зрение, и особенно ценно для использования компьютера, понимания скриншотов и анализа документов.
Поддержка высокого разрешения автоматическая и не требует бета-заголовка или включения на стороне клиента. Два момента, которые стоит учесть:
max_tokens и ожидания по стоимости для рабочих нагрузок с большим количеством изображений или уменьшайте разрешение перед отправкой, если дополнительная детализация не нужна.Подробности см. в разделе Поддержка изображений высокого разрешения в Claude Opus 4.7.
Они не обязательны, но улучшат ваш опыт:
Пересмотрите max_tokens: Поскольку один и тот же текст даёт большее количество токенов в Claude Opus 4.7 и более поздних моделях, обновите параметры max_tokens, чтобы обеспечить дополнительный запас, включая триггеры компактизации. Вмешательства через подсказки, task_budget и effort могут помочь контролировать затраты и обеспечить надлежащее использование токенов.
Проверьте ожидания по количеству токенов: Любой путь кода, который оценивает токены на стороне клиента или предполагает фиксированное соотношение токенов к символам, следует повторно протестировать на Claude Opus 5. Используйте эндпоинт подсчёта токенов для проверки.
Внедрите бюджеты задач (бета): В Claude Opus 4.7 появились бюджеты задач. Эти бюджеты позволяют сообщить Claude, сколько токенов у него есть на полный агентный цикл, включая мышление, вызовы инструментов, результаты инструментов и финальный вывод. Модель видит текущий обратный отсчёт и использует его для приоритизации работы и корректного завершения задачи по мере расходования бюджета. Для использования установите бета-заголовок task-budgets-2026-03-13 и добавьте следующее в конфигурацию вывода:
output_config = {
"effort": "high",
"task_budget": {"type": "tokens", "total": 128000},
}Возможно, вам потребуется поэкспериментировать с разными бюджетами задач для вашего сценария использования. Если модели задан слишком ограничительный бюджет задачи, она может выполнить задачу менее тщательно, ссылаясь на свой бюджет как на ограничение.
Для открытых агентных задач, где качество важнее скорости, не устанавливайте бюджет задачи. Оставьте бюджеты задач для рабочих нагрузок, где нужно, чтобы модель ограничивала свою работу выделенным количеством токенов. Минимальное значение бюджета задачи — 20k токенов.
Бюджет задачи — это не жёсткое ограничение; это рекомендация, о которой модель осведомлена. Он отличается от max_tokens:
task_budget: рекомендательное ограничение на весь агентный цикл. Модель видит его и использует для регулирования темпа.max_tokens: жёсткий потолок на количество сгенерированных токенов в рамках одного запроса. Он не передаётся модели, поэтому модель о нём не знает.Используйте task_budget, когда хотите, чтобы модель саморегулировалась, и max_tokens как жёсткий потолок для ограничения использования.
Установите большое значение max_tokens при уровне усилий max или xhigh: Если вы запускаете Claude Opus 4.7 или более позднюю модель на уровне усилий max или xhigh, установите большой бюджет максимальных выходных токенов, чтобы у модели было пространство для мышления и действий через её субагентов и вызовы инструментов. Начните с 64k токенов и настраивайте дальше.
Уменьшайте разрешение изображений, если высокое разрешение не нужно: Claude Opus 4.7 и более поздние модели поддерживают изображения до 2576 пикселей / 3,75 МП. Изображения высокого разрешения используют больше токенов. Если дополнительная детализация изображения не нужна, уменьшайте разрешение изображений перед отправкой в Claude, чтобы избежать увеличения использования токенов. См. Изображения и зрение.
Рассмотрите автоматические резервные варианты: Claude Opus 5 поставляется с классификаторами безопасности в области кибербезопасности, чьи отказы по кибер-категории могут переключаться на Claude Opus 4.8. Чтобы автоматически повторно выполнять отклонённые запросы на другой модели, рассмотрите параметр fallbacks с режимом "default" (fallbacks: "default"), который выбирает рекомендуемую резервную модель на основе категории отказа вместо вручную поддерживаемого списка моделей. Серверный резервный вариант находится в бета-версии; режим "default" требует бета-заголовка server-side-fallback-2026-07-01. См. Отказы и резервные варианты.
Кэшируйте более короткие подсказки: Минимальная длина кэшируемой подсказки в Claude Opus 5 составляет 512 токенов, что ниже, чем в более ранних моделях Opus. Подсказки, которые были слишком короткими для кэширования, теперь могут создавать записи кэша без изменений в коде. См. Кэширование подсказок для минимумов по моделям.
Изменяйте инструменты в середине разговора (бета): Вы можете добавлять или удалять инструменты между ходами разговора без инвалидации попаданий в кэш подсказок на более ранних ходах. Отправьте бета-заголовок mid-conversation-tool-changes-2026-07-01. Это полезно для агентных рабочих нагрузок, которые раскрывают инструменты постепенно или убирают их по мере продвижения задачи; без этого изменённый список инструментов инвалидирует кэшированный префикс.
Удалите перенесённые инструкции по проверке и ограничьте область задачи: Claude Opus 5 проверяет собственную работу без указаний, поэтому удалите явные инструкции по проверке или самопроверке, перенесённые из подсказок, настроенных для более ранних моделей; их сохранение приводит к избыточной проверке. Для узких задач явно ограничьте область задачи. См. Область задачи и избыточная проверка.
claude-opus-4-6 на claude-opus-5 (или обновите псевдонимы).temperature, top_p и top_k из тела запросов.thinking: {type: "enabled", budget_tokens: N} на thinking: {type: "adaptive"} плюс параметр effort или полностью удалите поле thinking; адаптивное мышление включено по умолчанию в Claude Opus 5.thinking: в Claude Opus 5 они выполняются с мышлением. Пересмотрите max_tokens, который остаётся жёстким ограничением на общий вывод (мышление плюс текст ответа), или передайте thinking: {type: "disabled"} при уровне усилий high или ниже, чтобы сохранить прежнее поведение.thinking: {type: "disabled"} с уровнем усилий xhigh или max возвращает ошибку 400; проверка выполняется для каждого запроса. Включите мышление обратно или снизьте уровень усилий до high или ниже.max_tokens с учётом обновлённой токенизации.xhigh или max повысьте max_tokens как минимум до 64k в качестве отправной точки.stop_reason: "refusal" и рассмотрите fallbacks: "default" (бета) для автоматического повторного выполнения отклонённых запросов на рекомендуемой резервной модели.Если вы мигрируете с Claude Opus 4.5, Opus 4.1 или более ранней модели напрямую на Claude Opus 5, примените все изменения, описанные ранее в этом разделе, плюс следующие накопительные изменения, которые вступили в силу между Opus 4.5 и Opus 4.7. Если вы мигрируете с Opus 4.6, изменений, описанных ранее в этом разделе, достаточно.
# Миграция на Opus
model = "claude-opus-4-5" # Before
model = "claude-opus-5" # AfterУдаление предзаполнения описано в критических изменениях для миграции с Claude Opus 4.6.
Экранирование параметров инструментов: Claude Opus 4.6 и более поздние модели могут производить несколько иное экранирование строк JSON в аргументах вызовов инструментов (например, иная обработка Unicode-экранирования или экранирования прямой косой черты). Если вы разбираете input вызова инструмента как необработанную строку, а не с помощью JSON-парсера, проверьте логику разбора. Стандартные JSON-парсеры (такие как json.loads() или JSON.parse()) обрабатывают эти различия автоматически.
Эти изменения улучшают ваш опыт работы с Claude Opus 4.7 и более поздними моделями. Пункты, помеченные (обязательно в Opus 4.7), были необязательными рекомендациями при запуске Opus 4.6, но теперь являются обязательными; остальные остаются рекомендуемыми.
Перейдите на адаптивное мышление (обязательно в Opus 4.7): thinking: {type: "enabled", budget_tokens: N} возвращает ошибку 400 в Claude Opus 4.7 и более поздних моделях. Переключитесь на thinking: {type: "adaptive"} и используйте параметр effort для управления глубиной мышления; в Claude Opus 5 thinking: {type: "adaptive"} эквивалентно отсутствию поля thinking, которое по умолчанию запускается с адаптивным мышлением. См. Мышление.
response = client.beta.messages.create(
model="claude-opus-4-5",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 32000},
betas=["interleaved-thinking-2025-05-14"],
messages=[{"role": "user", "content": "Your prompt here"}],
)Обратите внимание, что миграция также переходит с client.beta.messages.create на client.messages.create. Адаптивное мышление и effort являются общедоступными (GA) функциями и не требуют бета-пространства имён SDK или каких-либо бета-заголовков.
Удалите бета-заголовок effort: Параметр effort теперь общедоступен (GA). Удалите betas=["effort-2025-11-24"] из ваших запросов.
Удалите бета-заголовок детальной потоковой передачи инструментов: Детальная потоковая передача инструментов теперь общедоступна (GA). Удалите betas=["fine-grained-tool-streaming-2025-05-14"] из ваших запросов.
Удалите бета-заголовок чередующегося мышления: Адаптивное мышление автоматически включает чередующееся мышление в Claude Opus 4.7, Opus 4.6 и Sonnet 4.6. Удалите betas=["interleaved-thinking-2025-05-14"] из ваших запросов. Заголовок по-прежнему функционален в Sonnet 4.6 с ручным расширенным мышлением, но ручной режим устарел.
Перейдите на output_config.format: Если вы используете структурированные выводы, обновите output_format={...} на output_config={"format": {...}}. Старый параметр остаётся функциональным, но устарел и будет удалён в будущем выпуске модели.
Если вы мигрируете с Opus 4.1 или более ранних моделей напрямую на Claude Opus 5, примените все изменения, описанные ранее в этом разделе, плюс дополнительные изменения в этом подразделе.
# Из Opus 4.1
model = "claude-opus-4-1-20250805" # Before
model = "claude-opus-5" # After
# Из Sonnet 3.7
model = "claude-3-7-sonnet-20250219" # Before
model = "claude-opus-5" # AfterУдалите параметры сэмплирования
Начиная с Claude Opus 4.7, установка temperature, top_p или top_k в любое значение, отличное от значения по умолчанию, возвращает ошибку 400. Самый безопасный путь миграции — полностью исключить эти параметры из запросов и использовать подсказки для управления поведением модели. Если вы использовали temperature = 0 для детерминизма, учтите, что это никогда не гарантировало идентичных выводов.
# До — это вызовет ошибку в моделях Claude 4+
response = client.messages.create(
model="claude-3-7-sonnet-20250219",
temperature=0.7,
top_p=0.9, # Non-default sampling params return 400 on Opus 4.7
# ...
)
# После
response = client.messages.create(
model="claude-opus-5",
# ...
)Обновите версии инструментов
Обновитесь до последних версий инструментов. Удалите любой код, использующий команду undo_edit.
# До
tools = [{"type": "text_editor_20250124", "name": "str_replace_editor"}]
# После
tools = [{"type": "text_editor_20250728", "name": "str_replace_based_edit_tool"}]text_editor_20250728 и str_replace_based_edit_tool. Подробности см. в документации Инструмент текстового редактора.code_execution_20260521. Инструкции по миграции см. в документации Инструмент выполнения кода.Обрабатывайте причину остановки refusal
Обновите ваше приложение для обработки причин остановки refusal:
response = client.messages.create(...)
if response.stop_reason == "refusal":
# Обработайте отказ соответствующим образом
passОбрабатывайте причину остановки model_context_window_exceeded
Модели Claude 4.5+ возвращают причину остановки model_context_window_exceeded, когда генерация останавливается из-за достижения лимита контекстного окна, а не запрошенного лимита max_tokens. Обновите ваше приложение для обработки этой новой причины остановки:
response = client.messages.create(...)
if response.stop_reason == "model_context_window_exceeded":
# Обработайте ограничение контекстного окна соответствующим образом
passПроверьте обработку параметров инструментов (завершающие переводы строк)
Модели Claude 4.5+ сохраняют завершающие переводы строк в строковых параметрах вызовов инструментов, которые ранее удалялись. Если ваши инструменты полагаются на точное сопоставление строк с параметрами вызовов инструментов, убедитесь, что ваша логика корректно обрабатывает завершающие переводы строк.
Обновите подсказки с учётом изменений в поведении
Модели Claude 4+ имеют более краткий, прямой стиль общения и требуют явных указаний. Ознакомьтесь с лучшими практиками составления подсказок для рекомендаций по оптимизации.
token-efficient-tools-2025-02-19 и output-128k-2025-02-19. Все модели Claude 4+ имеют встроенное токен-эффективное использование инструментов, и эти заголовки не имеют эффекта.claude-opus-5output_config.formatthinking: {type: "enabled", budget_tokens: N} на thinking: {type: "adaptive"} плюс параметр effort (возвращает 400 в Opus 4.7)effort-2025-11-24 (effort теперь общедоступен)fine-grained-tool-streaming-2025-05-14interleaved-thinking-2025-05-14 (адаптивное мышление включает чередующееся мышление автоматически)output_format на output_config.format (если применимо)temperature, top_p и top_k (значения, отличные от значений по умолчанию, возвращают 400 в Opus 4.7)text_editor_20250728, code_execution_20260521)refusalmodel_context_window_exceededtoken-efficient-tools-2025-02-19, output-128k-2025-02-19)Claude Opus 5 и Claude Sonnet 5 имеют одинаковую поверхность API: обе модели работают с адаптивным мышлением, включённым по умолчанию, обе по умолчанию устанавливают параметр effort в значение high в Claude API и Claude Code, обе по умолчанию предоставляют контекстное окно в 1 млн токенов с максимумом в 128 тыс. выходных токенов, и ни одна из них не поддерживает Priority Tier. Ручное расширенное мышление и параметры сэмплирования с нестандартными значениями возвращают ошибку 400 на обеих моделях, как и предзаполнение ответа ассистента.
model = "claude-sonnet-5" # Before
model = "claude-opus-5" # AfterЦены: Claude Opus 5 стоит $5 за миллион входных токенов и $25 за миллион выходных токенов. Claude Sonnet 5 стоит $2/$10 за миллион входных/выходных токенов. Полную информацию о ценах см. в разделе Цены Claude.
Отключение мышления ограничено уровнем effort high: На Claude Sonnet 5 thinking: {type: "disabled"} принимается на любом уровне effort. На Claude Opus 5 это принимается только при уровне effort high или ниже; запрос, сочетающий thinking: {type: "disabled"} с effort xhigh или max, возвращает ошибку 400, что проверяется для каждого запроса. Проверьте запросы, отключающие мышление, перед миграцией.
Системные сообщения в середине разговора: Claude Opus 5 принимает сообщения с role: "system" сразу после хода пользователя в массиве messages (с учётом правил размещения); Claude Sonnet 5 — нет. Если вы поддерживаете пути кода, которые перестраивают полную историю сообщений для обновления инструкций, вы можете упростить их и сохранить попадания в кэш подсказок для более ранних ходов.
Web fetch недоступен: Инструмент web fetch доступен на Claude Sonnet 5, но не на Claude Opus 5.
claude-sonnet-5 на claude-opus-5.thinking: {type: "disabled"} с effort xhigh или max возвращает ошибку 400 на Claude Opus 5. Включите мышление снова или понизьте effort до high или ниже.Claude Sonnet 5 предлагает лучшее сочетание скорости и интеллекта в семействе моделей Claude. Она построена на основе Claude Sonnet 4.6.
Claude Sonnet 5 — это прямая замена для Claude Sonnet 4.6 по цене $2/$10 USD за миллион входных/выходных токенов; подробности см. в разделе Цены. Есть два критических изменения API для кода, уже работающего на Claude Sonnet 4.6: ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) и параметры сэмплирования (temperature, top_p, top_k), установленные в нестандартные значения, больше не принимаются и возвращают ошибку 400. Вместо этого используйте адаптивное мышление с параметром effort. Claude Sonnet 5 поддерживает тот же набор функций, что и Claude Sonnet 4.6, включая контекстное окно в 1 млн токенов, адаптивное мышление, кэширование подсказок, пакетную обработку, Files API, поддержку PDF, компьютерное зрение и полный набор серверных и клиентских инструментов. Priority Tier недоступен на Claude Sonnet 5. Claude Sonnet 5 также использует новый токенизатор.
# Миграция на Sonnet
model = "claude-sonnet-4-6" # Before
model = "claude-sonnet-5" # AfterПункты 4 и 5 в следующем списке являются критическими изменениями. max_tokens остаётся жёстким ограничением на общий вывод (мышление плюс текст ответа), поэтому пересмотрите его для рабочих нагрузок, которые выполнялись без мышления на Claude Sonnet 4.6.
Новый токенизатор: Claude Sonnet 5 использует новый токенизатор. Один и тот же входной текст производит примерно на 30% больше токенов, чем на Claude Sonnet 4.6. Точное увеличение зависит от содержимого. Запросы, ответы и события потоковой передачи сохраняют ту же структуру, и изменения кода не требуются, но всё, что вы измеряете или бюджетируете в токенах, смещается: поля usage и результаты подсчёта токенов для того же текста выше, контекстное окно в 1 млн токенов вмещает меньше текста, а лимит max_tokens, настроенный для Claude Sonnet 4.6, может обрезать эквивалентный вывод. Цена за токен ниже ($2/$10 против $3/$15 за миллион входных/выходных токенов у Claude Sonnet 4.6), но стоимость эквивалентного запроса не снижается в прямой пропорции. Повторно выполните подсчёт токенов для Claude Sonnet 5 вместо повторного использования значений, измеренных для более ранних моделей.
Максимум 128 тыс. выходных токенов (без изменений): Claude Sonnet 5 поддерживает до 128 тыс. выходных токенов, как и Claude Sonnet 4.6. Существующие значения max_tokens остаются действительными. Учитывайте новый токенизатор при их определении.
Предзаполнение сообщений ассистента (без изменений): Предзаполнение сообщения ассистента возвращает ошибку 400 на Claude Sonnet 5, как и на Claude Sonnet 4.6. Если вы удалили предзаполнение при миграции на Claude Sonnet 4.6, дальнейшие изменения не требуются. Вместо этого используйте структурированные выводы, инструкции в системной подсказке или output_config.format.
Адаптивное мышление включено по умолчанию: На Claude Sonnet 4.6 запросы без поля thinking выполняются без мышления; на Claude Sonnet 5 те же запросы выполняются с адаптивным мышлением. Чтобы отключить мышление, передайте thinking: {type: "disabled"}. Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) не поддерживается и возвращает ошибку 400. Используйте параметр effort (по умолчанию high) для управления глубиной мышления.
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=16000,
thinking={"type": "adaptive", "display": "summarized"},
output_config={"effort": "high"},
messages=[
{
"role": "user",
"content": "Are there an infinite number of prime numbers such that n mod 4 == 3?",
}
],
)
# Ответ содержит блоки с кратким изложением мышления и текстовые блоки
for block in response.content:
match block.type:
case "thinking":
print(f"\nThinking summary: {block.thinking}")
case "text":
print(f"\nResponse: {block.text}")Параметры сэмплирования удалены: Параметры сэмплирования (temperature, top_p, top_k), установленные в нестандартное значение, не принимаются и возвращают ошибку 400.
Защитные меры кибербезопасности: Claude Sonnet 5 — первая модель уровня Sonnet с защитными мерами кибербезопасности в реальном времени. Запросы, затрагивающие запрещённые или высокорисковые темы кибербезопасности, могут быть отклонены. Отказы возвращаются как успешный ответ HTTP 200 с stop_reason: "refusal", а не как ошибка. Подробнее см. в разделе Защитные меры, предупреждения и апелляции.
claude-sonnet-4-6 на claude-sonnet-5.max_tokens, установленные близко к ожидаемой длине вывода, и при необходимости увеличьте их до максимума в 128 тыс. (без изменений по сравнению с Claude Sonnet 4.6).thinking: {type: "enabled", budget_tokens: N} (возвращает ошибку 400). Адаптивное мышление включено по умолчанию; передайте {type: "disabled"}, чтобы отключить его, или используйте параметр effort для управления глубиной.temperature, top_p и top_k, установленные в нестандартные значения (они возвращают ошибку 400 на Claude Sonnet 5).stop_reason: "refusal", если ваша рабочая нагрузка может затрагивать темы кибербезопасности.max_tokens для рабочих нагрузок, которые ранее выполнялись без мышления.Если вы мигрируете с Claude Sonnet 4.5 или более ранней модели Sonnet напрямую на Claude Sonnet 5, примените изменения из раздела Миграция на Claude Sonnet 5 с Claude Sonnet 4.6, а также изменения из этого раздела.
Предзаполнение сообщений ассистента больше не поддерживается
Предзаполнение сообщений ассистента возвращает ошибку 400 на Claude Sonnet 4.6 и более поздних моделях, включая Claude Sonnet 5. Вместо этого используйте структурированные выводы, инструкции в системной подсказке или output_config.format.
Распространённые сценарии использования предзаполнения и способы миграции:
Управление форматированием вывода (принудительный вывод JSON/YAML): используйте структурированные выводы или инструменты с полями enum для задач классификации.
Устранение преамбул (удаление фраз вроде «Вот...»): добавьте прямые инструкции в системную подсказку: «Отвечай напрямую без преамбулы. Не начинай с фраз вроде "Вот...", "На основе..." и т. п.»
Избежание некорректных отказов: Claude теперь гораздо лучше справляется с уместными отказами. Чёткой формулировки в сообщении пользователя без предзаполнения должно быть достаточно.
Продолжения (возобновление прерванных ответов): перенесите продолжение в сообщение пользователя: «Твой предыдущий ответ был прерван и закончился на [previous_response]. Продолжи с того места, где остановился.»
Гидратация контекста / согласованность роли (обновление контекста в длинных разговорах): вставляйте то, что ранее было предзаполненными напоминаниями ассистента, в ход пользователя.
Экранирование JSON в параметрах инструментов может отличаться
Экранирование строк JSON в параметрах инструментов может отличаться от предыдущих моделей. Стандартные парсеры JSON обрабатывают это автоматически, но пользовательский строковый парсинг может потребовать обновлений.
Изменения расширенного мышления: конфигурации budget_tokens из Claude Sonnet 4.5 (thinking: {type: "enabled", budget_tokens: N}) не поддерживаются на Claude Sonnet 5 и возвращают ошибку 400. Адаптивное мышление включено по умолчанию, поэтому большинству рабочих нагрузок конфигурация thinking вообще не нужна; используйте параметр effort для управления глубиной мышления. Если вы запускали Claude Sonnet 4.5 без расширенного мышления, передайте thinking: {type: "disabled"}, чтобы сохранить это поведение.
Удалите параметры сэмплирования
Параметры сэмплирования (temperature, top_p, top_k), установленные в нестандартное значение, возвращают ошибку 400 на Claude Sonnet 5. Удалите их из запросов и используйте подсказки для управления поведением модели.
Обновите версии инструментов
Обновитесь до последних версий инструментов (text_editor_20250728, code_execution_20260521). Удалите любой код, использующий команду undo_edit.
Обрабатывайте причину остановки refusal
Обновите ваше приложение для обработки причин остановки refusal.
Обновите ваши подсказки с учётом изменений поведения
Модели Claude 4 имеют более лаконичный, прямой стиль общения. Ознакомьтесь с лучшими практиками составления подсказок для рекомендаций по оптимизации.
Claude Haiku 4.5 и Claude Sonnet 5 различаются на уровне API сильнее, чем соседние модели внутри одного класса: Claude Haiku 4.5 использует ручное расширенное мышление (выключено по умолчанию), контекстное окно в 200 тыс. токенов и до 64 тыс. выходных токенов, тогда как Claude Sonnet 5 работает с адаптивным мышлением, включённым по умолчанию, по умолчанию предоставляет контекстное окно в 1 млн токенов и поддерживает до 128 тыс. выходных токенов.
model = "claude-haiku-4-5-20251001" # Before
model = "claude-sonnet-5" # AfterКонфигурация мышления: Claude Haiku 4.5 поддерживает ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) и отклоняет thinking: {type: "adaptive"}. На Claude Sonnet 5 поддержка обратная: адаптивное мышление включено по умолчанию, а ручное расширенное мышление возвращает ошибку 400. Удалите конфигурации thinking: {type: "enabled", budget_tokens: N} и полагайтесь на значение по умолчанию, либо передайте thinking: {type: "disabled"}, чтобы отключить мышление. У budget_tokens нет прямой замены; используйте параметр effort для управления глубиной мышления. Effort недоступен на Claude Haiku 4.5 и по умолчанию равен high на Claude Sonnet 5.
Параметры сэмплирования удалены: temperature и top_p работают на Claude Haiku 4.5 (по одному, не оба одновременно). На Claude Sonnet 5 установка temperature, top_p или top_k в нестандартное значение возвращает ошибку 400. Удалите эти параметры и используйте подсказки для управления поведением модели.
Предзаполнение ассистента удалено: Предзаполнение сообщения ассистента работает на Claude Haiku 4.5, но возвращает ошибку 400 на Claude Sonnet 5. Вместо этого используйте структурированные выводы, инструкции в системной подсказке или output_config.format.
Большее контекстное окно и вывод: Claude Sonnet 5 по умолчанию предоставляет контекстное окно в 1 млн токенов, по сравнению с 200 тыс. токенов на Claude Haiku 4.5, и поддерживает до 128 тыс. выходных токенов, по сравнению с 64 тыс. Claude Sonnet 5 также использует другой токенизатор, поэтому повторно выполните подсчёт токенов вместо повторного использования значений, измеренных для Claude Haiku 4.5.
Цены: Claude Haiku 4.5 стоит $1/$5 за миллион входных/выходных токенов. Claude Sonnet 5 стоит $2/$10 за миллион входных/выходных токенов. См. Цены Claude.
Защитные меры кибербезопасности: Claude Sonnet 5 имеет защитные меры кибербезопасности в реальном времени. Запросы, затрагивающие запрещённые или высокорисковые темы кибербезопасности, могут быть отклонены и возвращены как успешный ответ HTTP 200 с stop_reason: "refusal". Подробнее см. в разделе Защитные меры, предупреждения и апелляции.
claude-haiku-4-5-20251001 (или псевдонима claude-haiku-4-5) на claude-sonnet-5.thinking: {type: "enabled", budget_tokens: N} (возвращает ошибку 400). Адаптивное мышление включено по умолчанию; передайте thinking: {type: "disabled"}, чтобы сохранить поведение без мышления, и пересмотрите max_tokens для рабочих нагрузок, которые выполнялись без мышления.high) для управления глубиной мышления и расходом токенов; он недоступен на Claude Haiku 4.5, поэтому никакая существующая настройка не переносится.temperature и top_p (нестандартные значения возвращают ошибку 400 на Claude Sonnet 5).max_tokens, которые можно увеличить до максимума в 128 тыс.stop_reason: "refusal", если ваша рабочая нагрузка может затрагивать темы кибербезопасности.Claude Haiku 4.5 — самая быстрая и интеллектуальная модель Haiku с производительностью, близкой к передовой, обеспечивающая качество премиальной модели для интерактивных приложений и высоконагруженной обработки.
Полный обзор возможностей см. в обзоре моделей.
Обновите имя модели:
# Из Haiku 3.5
model = "claude-3-5-haiku-20241022" # Before
model = "claude-haiku-4-5-20251001" # AfterОзнакомьтесь с новыми ограничениями скорости: Haiku 4.5 имеет отдельные ограничения скорости от Haiku 3.5. Подробности см. в документации по ограничениям скорости.
Изучите новые возможности: см. обзор моделей для получения подробной информации об осведомлённости о контексте, увеличенной ёмкости вывода (64 тыс. токенов), более высоком интеллекте и улучшенной скорости.
Эти критические изменения применяются при миграции с моделей Claude 3.x Haiku.
Обновите параметры сэмплирования
Используйте только temperature ИЛИ top_p, но не оба. Установка обоих возвращает ошибку 400 на Claude Haiku 4.5.
Обновите версии инструментов
Обновитесь до последних версий инструментов (text_editor_20250728, code_execution_20250825). Удалите любой код, использующий команду undo_edit.
Обрабатывайте причину остановки refusal
Обновите ваше приложение для обработки причин остановки refusal.
Обновите ваши подсказки с учётом изменений поведения
Модели Claude 4 имеют более лаконичный, прямой стиль общения. Ознакомьтесь с лучшими практиками составления подсказок для рекомендаций по оптимизации.
claude-haiku-4-5-20251001text_editor_20250728, code_execution_20250825); устаревшие версии не поддерживаютсяundo_edit (если применимо)temperature ИЛИ top_p, но не оба (установка обоих возвращает ошибку 400)refusal в вашем приложенииWas this page helpful?