Параметр «effort» (усилие) позволяет контролировать, сколько токенов Claude тратит при ответе на запросы. Вы можете балансировать между полнотой ответа и эффективностью использования токенов в рамках одной модели. Параметр effort доступен для всех поддерживаемых моделей без необходимости указывать бета-заголовок.
По умолчанию Claude использует высокий уровень усилия, расходуя столько токенов, сколько необходимо для получения отличных результатов. Вы можете повысить уровень усилия до max для достижения абсолютно максимальных возможностей или понизить его, чтобы более экономно расходовать токены, оптимизируя скорость и стоимость при некотором снижении возможностей.
Параметр effort влияет на все токены в ответе, включая:
У этого подхода есть два основных преимущества:
| Уровень | Описание | Типичный сценарий использования |
|---|---|---|
max | Абсолютно максимальные возможности без ограничений на расход токенов. Доступен для Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8, Claude Mythos Preview, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5 и Claude Sonnet 4.6. | Задачи, требующие максимально глубокого рассуждения и наиболее тщательного анализа |
xhigh | Расширенные возможности для длительной работы. Доступен для Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7 и Claude Sonnet 5. | Длительные агентные задачи и задачи программирования (более 30 минут) с бюджетами токенов в миллионы |
high | Высокие возможности. Эквивалентно отсутствию параметра. | Сложные рассуждения, трудные задачи программирования, агентные задачи |
medium | Сбалансированный подход с умеренной экономией токенов. | Агентные задачи, требующие баланса скорости, стоимости и производительности |
low | Наиболее эффективный. Значительная экономия токенов при некотором снижении возможностей. | Более простые задачи, требующие наилучшей скорости и минимальных затрат, например субагенты |
xhigh — более новый уровень; некоторые модели, поддерживающие max, не поддерживают xhigh.
Claude Sonnet 5 по умолчанию использует уровень усилия high в Claude API и Claude Code.
Sonnet 4.6 по умолчанию использует уровень усилия high. Явно задавайте effort при использовании Sonnet 4.6, чтобы избежать неожиданных задержек:
Начинайте с xhigh для задач программирования и агентных сценариев и используйте high как минимум для большинства рабочих нагрузок, чувствительных к интеллектуальным возможностям. Переходите на medium для рабочих нагрузок, чувствительных к стоимости, или повышайте до max только тогда, когда ваши оценки показывают измеримый запас на уровне xhigh.
Значение по умолчанию в API — high. Чтобы использовать xhigh, задайте effort явно; переданное вами значение переопределяет значение по умолчанию.
| Effort | Рекомендации для Claude Opus 4.7 |
|---|---|
low | Эффективен, но лучше всего подходит для коротких, ограниченных по объёму задач. Сочетайте low с явными контрольными списками, если ваша задача состоит из нескольких разделов. |
medium | Готовое решение для типичного рабочего процесса, когда вам нужны хорошие результаты при снижении затрат. |
high | Продвинутые сценарии использования, которым всё ещё нужен баланс интеллектуальных возможностей и расхода токенов. Часто это наилучший баланс качества и эффективности использования токенов. |
xhigh | Рекомендуемая отправная точка для программирования и агентной работы, а также для исследовательских задач, таких как многократные вызовы инструментов, детальный веб-поиск и поиск по базе знаний. Ожидайте заметно более высокого расхода токенов, чем при high. |
max | Зарезервируйте для действительно передовых задач. Для большинства рабочих нагрузок max добавляет значительные затраты при относительно небольшом приросте качества, а в некоторых задачах со структурированным выводом или менее чувствительных к интеллектуальным возможностям может приводить к избыточному размышлению. |
Claude Opus 4.7 также строже соблюдает уровни усилия, чем Claude Opus 4.6, особенно на уровнях low и medium. При более низких уровнях усилия модель ограничивает свою работу тем, что было запрошено, а не делает больше, чем требуется. Если вы наблюдаете поверхностные рассуждения по сложным задачам с Claude Opus 4.7, повысьте уровень усилия, а не пытайтесь обойти это с помощью подсказок. Если вам необходимо сохранить низкий уровень усилия ради задержки, добавьте целевые указания вроде «Эта задача включает многошаговое рассуждение. Тщательно подумайте перед ответом».
При запуске Claude Opus 4.7 с уровнем усилия xhigh или max задайте большое значение max_tokens, чтобы у модели было пространство для размышления и действий через субагентов и вызовы инструментов. Начать с 64k токенов и настраивать дальше — разумное значение по умолчанию.
Рекомендации для Claude Opus 4.7 также применимы к Claude Opus 4.8. Начинайте с xhigh для задач программирования и агентных сценариев, используйте high для большинства других рабочих нагрузок, чувствительных к интеллектуальным возможностям, и переходите на medium или low только тогда, когда вы измерили, что более низкий уровень сохраняет качество на ваших оценках.
Значение по умолчанию в API — high. Задайте effort явно, чтобы использовать другой уровень; переданное вами значение переопределяет значение по умолчанию.
При запуске Claude Opus 4.8 с уровнем усилия xhigh или max задайте большое значение max_tokens, чтобы у модели было пространство для размышления и действий через субагентов и вызовы инструментов. Начать с 64k токенов и настраивать дальше — разумное значение по умолчанию.
Claude Opus 5 поддерживает все пять уровней усилия. Начинайте с high, значения по умолчанию, и корректируйте на основе ваших оценок: повышайте до xhigh для требовательных задач программирования и агентной работы или до max, когда задача оправдывает неограниченный расход токенов, и свободно используйте low и medium как основной инструмент управления стоимостью токенов и временем отклика везде, где ваши оценки показывают сохранение качества. Если вы перенесли настройки effort с более ранней модели, проведите свежий перебор уровней усилия на ваших оценках, а не используйте их повторно.
Effort управляет объёмом мышления, а не видимой длиной ответа: в Claude Opus 5 изменение effort не приводит к надёжному сокращению ответов, поэтому вместо этого задавайте длину через подсказку.
Значение по умолчанию в API — high. Задайте effort явно, чтобы использовать другой уровень; переданное вами значение переопределяет значение по умолчанию.
В Claude Opus 5 мышление нельзя отключить на уровнях усилия xhigh или max: запросы, устанавливающие thinking: {"type": "disabled"} на этих уровнях, возвращают ошибку 400. См. Effort с мышлением.
При запуске Claude Opus 5 с уровнем усилия xhigh или max задайте большое значение max_tokens, чтобы у модели было пространство для размышления и действий через субагентов и вызовы инструментов. Начать с 64k токенов и настраивать дальше — разумное значение по умолчанию.
Effort — это основной инструмент для балансировки интеллектуальных возможностей, задержки и стоимости в Claude Fable 5. Начинайте с high, значения по умолчанию, для большинства задач, используйте xhigh для рабочих нагрузок, наиболее чувствительных к возможностям, и переходите на medium или low для рутинной работы. Более низкие настройки effort в Claude Fable 5 по-прежнему работают хорошо и часто превосходят производительность xhigh на предыдущих моделях. На уровнях high и xhigh задавайте большое значение max_tokens: это жёсткое ограничение на общий вывод — мышление плюс текст ответа. См. Контроль затрат.
Снижайте effort, если задача выполняется, но занимает больше времени, чем необходимо, или если вам нужен более быстрый, более интерактивный стиль работы. Те же рекомендации применимы к Claude Mythos 5. Более полные рекомендации см. в разделе Создание подсказок для Claude Fable 5.
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5",
max_tokens=4096,
messages=[
{
"role": "user",
"content": "Analyze the trade-offs between microservices and monolithic architectures",
}
],
output_config={"effort": "medium"},
)
for block in response.content:
if block.type == "text":
print(block.text)При использовании инструментов параметр effort влияет как на пояснения вокруг вызовов инструментов, так и на сами вызовы инструментов. Более низкие уровни усилия, как правило:
Более высокие уровни усилия могут:
Параметр thinking управляет тем, думает ли Claude в блоках мышления перед ответом; параметр effort управляет тем, сколько работы Claude вкладывает во весь ответ, что в адаптивном режиме включает то, как часто и насколько глубоко он думает. Не передавайте adaptive в качестве значения effort: adaptive — это режим мышления, а не уровень усилий.
При более высоких уровнях усилия Claude размышляет над большинством запросов и более подробно; при более низких уровнях он может полностью пропустить мышление для более простых задач. См. Мышление и effort для полного руководства о том, как эти два элемента управления работают вместе.
В Claude Opus 4.5 — единственной модели только с расширенным мышлением, поддерживающей effort, — он работает совместно с budget_tokens: задайте уровень усилия для вашей задачи, затем установите бюджет токенов мышления в зависимости от того, какая глубина рассуждения требуется задаче.
О доступности мышления для каждой модели см. в таблице конфигурации по моделям. Effort работает как с мышлением, так и без него; см. Как работает effort.
output_config.effort — это настройка уровня запроса: каждый запрос несёт собственное значение, поэтому, чтобы выполнить последующую часть разговора с другим уровнем усилия, задайте новое значение в следующем запросе. Уровень усилия применяется ко всему запросу. Поскольку effort формирует отображаемую подсказку, его изменение между запросами не сохраняет кэшированные префиксы из предыдущих ходов; если вы полагаетесь на кэширование подсказок в течение длительной сессии, выберите уровень усилия в начале и сохраняйте его постоянным.
high, но правильная отправная точка зависит от вашей модели и рабочей нагрузки.Задайте Claude рекомендательный бюджет токенов для полного агентного цикла, чтобы помочь модели саморегулироваться при выполнении длительных агентных задач.
Разберитесь в адаптивном мышлении, при котором Claude решает, когда и сколько размышлять, и управляйте им с помощью effort и подсказок.
Разберитесь, как работает мышление, когда Claude размышляет по умолчанию и как мышление взаимодействует с effort.
| Supported models |
|
|---|---|
| Supported platforms |
|
Was this page helpful?