Claude Sonnet 5 — это следующее поколение семейства моделей Sonnet от Anthropic. Это прямая замена для Claude Sonnet 4.6 с тремя изменениями в поведении: адаптивное мышление включено по умолчанию, ручное расширенное мышление теперь возвращает ошибку 400 (оно было объявлено устаревшим в Claude Sonnet 4.6), а установка параметров сэмплирования (temperature, top_p, top_k) в значения, отличные от значений по умолчанию, возвращает ошибку 400. На этой странице кратко описано всё новое на момент запуска, включая новый токенизатор.
| Модель | Идентификатор модели в API | Описание |
|---|---|---|
| Claude Sonnet 5 | claude-sonnet-5 | Лучшее сочетание скорости и интеллекта |
Claude Sonnet 5 поддерживает контекстное окно в 1 млн токенов по умолчанию (1 млн токенов — это и значение по умолчанию, и максимум; варианта с меньшим контекстом нет), максимум 128 тыс. выходных токенов, адаптивное мышление и тот же набор инструментов и функций платформы, что и Claude Sonnet 4.6, за исключением Priority Tier, который недоступен в Claude Sonnet 5.
Полные цены и характеристики см. в обзоре моделей.
В Claude Sonnet 4.6 запросы без поля thinking выполняются без мышления. В Claude Sonnet 5 те же запросы выполняются с адаптивным мышлением. Чтобы отключить мышление, передайте thinking: {type: "disabled"}. Поскольку max_tokens — это жёсткое ограничение на общий вывод (мышление плюс текст ответа), пересмотрите его для рабочих нагрузок, которые выполнялись без мышления в Claude Sonnet 4.6.
Установка temperature, top_p или top_k в значение, отличное от значения по умолчанию, возвращает ошибку 400. Удалите эти параметры при миграции; значение по умолчанию (или отсутствие параметра) принимается. Используйте инструкции в системной подсказке для управления поведением модели. Это новое ограничение для моделей класса Sonnet; то же ограничение ранее было введено в Claude Opus 4.7.
Ручное расширенное мышление (thinking: {type: "enabled", budget_tokens: N}) было объявлено устаревшим в Claude Sonnet 4.6; в Claude Sonnet 5 оно удалено и возвращает ошибку 400, как и в Claude Opus 4.8 и Claude Opus 4.7. Вместо этого используйте адаптивное мышление с параметром effort.
# Не поддерживается в Claude Sonnet 5 (возвращает 400)
thinking = {"type": "enabled", "budget_tokens": 32000}
# Используйте это вместо
thinking = {"type": "adaptive"}Claude Sonnet 5 использует новый токенизатор. Один и тот же входной текст производит примерно на 30% больше токенов, чем в Claude Sonnet 4.6. Точное увеличение зависит от содержимого. Это не изменение API: запросы, ответы и события потоковой передачи сохраняют ту же структуру, и никаких изменений в коде не требуется.
Изменение затрагивает всё, что вы измеряете или бюджетируете в токенах:
usage и результаты подсчёта токенов для одного и того же текста выше, чем в Claude Sonnet 4.6. Не используйте повторно подсчёты, измеренные для более ранних моделей; пересчитайте для Claude Sonnet 5.max_tokens: лимит вывода, настроенный для Claude Sonnet 4.6, может обрезать эквивалентный вывод в Claude Sonnet 5. Пересмотрите лимиты, установленные близко к ожидаемой длине вывода.Предзаполнение сообщения ассистента возвращает ошибку 400, как и в Claude Sonnet 4.6. Вместо этого используйте структурированные выводы, инструкции в системной подсказке или output_config.format.
Claude Sonnet 5 — это улучшение возможностей по сравнению с Claude Sonnet 4.6 по более низкой цене. Это также вариант для рабочих нагрузок, которым требуется больше возможностей, чем предоставляет Claude Sonnet 4.6, без перехода на модель класса Opus.
Наибольший прирост по сравнению с Claude Sonnet 4.6 наблюдается в задачах программирования и агентных задачах. Результаты бенчмарков см. в Центре прозрачности Anthropic.
Claude Sonnet 5 — первая модель уровня Sonnet с защитными мерами в области кибербезопасности в реальном времени. Запросы, затрагивающие запрещённые или высокорисковые темы кибербезопасности, могут быть отклонены. Отказы возвращаются как успешный ответ HTTP 200 с stop_reason: "refusal", а не как ошибка. Подробнее см. в статье Защитные меры, предупреждения и апелляции.
Цена Claude Sonnet 5 составляет 2 $ за миллион входных токенов и 10 $ за миллион выходных токенов — это более низкая цена за токен, чем 3 $/15 $ у Claude Sonnet 4.6. Поскольку новый токенизатор производит примерно на 30% больше токенов для того же текста, стоимость эквивалентного запроса не снижается прямо пропорционально ценам за токен при сравнении с Claude Sonnet 4.6. Точная разница зависит от содержимого и характера рабочей нагрузки.
Полные цены, включая тарифы на пакетную обработку и кэширование подсказок, см. в разделе Цены.
На момент запуска Claude Sonnet 5 доступен на следующих платформах:
InvokeModel, обслуживаемый той же инфраструктурой, что и Claude в Amazon Bedrock. Устаревшая интеграция Claude на Amazon Bedrock (Opus 4.6 и более ранние) не включает Claude Sonnet 5.Claude Sonnet 5 поддерживает нулевое хранение данных для организаций с соглашениями ZDR.
Claude Sonnet 5 — это прямая замена для Claude Sonnet 4.6. Обновите идентификатор модели:
model = "claude-sonnet-4-6" # Before
model = "claude-sonnet-5" # AfterЗатем проверьте следующее:
max_tokens, установленные близко к ожидаемой длине вывода.budget_tokens, перейдите на адаптивное мышление. Ручное расширенное мышление (thinking: {type: "enabled"}) не поддерживается и возвращает ошибку 400.temperature, top_p, top_k) в значение, отличное от значения по умолчанию, возвращают ошибку 400; удалите их при миграции. Определения инструментов и структуры ответов не изменились, а предзаполнение сообщения ассистента уже не поддерживалось в Claude Sonnet 4.6.Подробности см. в разделе о Claude Sonnet 5 в руководстве по миграции.
Полные характеристики и цены для всех текущих моделей Claude.
Измерьте ваши подсказки с новым токенизатором перед миграцией.
Рекомендуемый режим с включённым мышлением в Claude Sonnet 5.
Как работает контекстное окно в 1 млн токенов.
Полные цены, включая тарифы на пакетную обработку и кэширование подсказок.
Was this page helpful?