Claude Sonnet 5.5 стала доступна в Amazon Bedrock

AWS открыла доступ к Claude Sonnet 5.5 через Amazon Bedrock и Claude Platform on AWS. Новая модель рассчитана на программирование, генерацию SQL, тестирование интерфейсов и другие задачи с чёткими критериями выполнения.

Выбор Claude Sonnet 5.5 в консоли Amazon Bedrock
Выбор Claude Sonnet 5.5 в консоли Amazon Bedrock
Изображение из исходного материала

AWS 28 сентября 2026 года объявила о доступности Claude Sonnet 5.5 в Amazon Bedrock и Claude Platform on AWS. По описанию компании, модель ориентирована на программирование и интеллектуальную работу с чётко заданным результатом: исправление ошибок, реализацию отдельных функций, генерацию SQL, проверку интерфейсов и подготовку документов.

AWS называет Sonnet 5.5 более быстрой и эффективной версией Sonnet, которая снижает стоимость выполнения большинства задач. Однако в анонсе AWS нет сравнительной таблицы с задержкой, расходом токенов или итоговой стоимостью типовых сценариев. Заявление о снижении затрат пока следует воспринимать как оценку поставщика, а не результат независимого тестирования.

Модель рассчитана на задачи с проверяемым результатом

Основной сценарий Sonnet 5.5 — работа, которую можно заранее ограничить требованиями и проверить после выполнения. В программировании это может быть отдельная функция, исправление бага, создание тестов или небольшое изменение интерфейса. AWS утверждает, что модель сверяет результат с условиями задачи, а не ограничивается первоначальной генерацией ответа.

Среди рекомендованных инженерных сценариев компания перечисляет:

— первичную обработку уведомлений о сбоях и инцидентах;

— постоянный мониторинг AI-агентов;

— генерацию SQL-запросов;

— UI- и UX-тестирование;

— работу coding agents в среде разработки при заданном лимите расходов.

За пределами разработки модель предлагается использовать для ограниченного анализа данных, небольших изменений в электронных таблицах и повторяющихся операций с корпоративными документами. AWS также заявляет об улучшении одностраничных материалов, архитектурных диаграмм и кратких презентаций по сравнению с Sonnet 5.

Эти формулировки не означают, что модель одинаково хорошо справится с любым проектом. Чем сложнее критерии приёмки и чем больше зависимостей между файлами, сервисами или источниками данных, тем важнее проверка на собственном наборе задач.

Sonnet и Opus получили разные роли

AWS связывает выпуск Sonnet 5.5 с ранее объявленной Opus 5.5. Предлагаемое разделение строится не по отрасли, а по характеру работы: Opus предназначена для решений, требующих более осторожной оценки и сложного многошагового анализа, а Sonnet — для ограниченных и повторяемых операций.

Для команды разработки это может означать маршрутизацию запросов между моделями. Например, анализ архитектурных рисков можно направлять в Opus, тогда как генерацию тестов, исправление локальной ошибки или подготовку SQL — в Sonnet. Такая схема имеет смысл лишь в том случае, если выигрыш в стоимости не перекрывается дополнительными проверками, повторными запросами и исправлением ошибок.

AWS не опубликовала в анонсе прямого сравнения Sonnet 5.5 с моделями OpenAI, Google или других поставщиков. Нет там и результатов на независимых бенчмарках. Поэтому делать вывод о превосходстве модели над GPT или Gemini по этому сообщению нельзя.

Как подключить Claude Sonnet 5.5 в AWS

Для ручного теста AWS предлагает открыть Amazon Bedrock, перейти в раздел Test, затем в Playground и выбрать Sonnet 5.5. Приложения могут обращаться к модели через Anthropic Messages API с использованием `bedrock-runtime`, а также через интерфейсы Invoke и Converse в AWS SDK или AWS CLI.

В опубликованном примере для Python используется клиент Boto3 и идентификатор:

`global.anthropic.claude-sonnet-5-5`

Модель подключается через глобальный профиль межрегионального инференса CRIS. Доступность конкретного варианта и география обработки зависят от конфигурации аккаунта и поддерживаемых регионов. Перед развёртыванием разработчикам стоит свериться с документацией Amazon Bedrock, особенно если проект должен соблюдать требования к месту хранения или обработки данных.

Есть и техническая деталь, способная повлиять на существующий код: ответ Sonnet 5.5 может содержать блок `thinking` перед текстовым блоком. AWS рекомендует искать в массиве `content` элемент с типом `text`, а не извлекать результат по фиксированному индексу. Клиенты, предполагающие, что текст всегда находится в первом элементе ответа, следует проверить до замены модели в рабочем приложении.

Claude Sonnet 5.5 также заявлена в Claude Platform on AWS для Северной Америки. Анонс не уточняет условия её появления в других географических зонах и не описывает доступ через отдельный API Anthropic вне упомянутых каналов AWS.

Что дают стандартные инструменты Bedrock

При использовании через Bedrock модель встраивается в уже существующие механизмы AWS. Доступ можно контролировать через Identity and Access Management, события вызовов — учитывать с помощью CloudTrail, а показатели приложений — отправлять в CloudWatch. Для настройки ограничений предусмотрены Amazon Bedrock Guardrails.

Использование модели попадает в общий счёт AWS. Это упрощает централизованный учёт расходов, но само по себе не гарантирует более низкую стоимость приложения. На итог влияют длина контекста и ответа, число повторных вызовов, доля принятых результатов, маршрутизация между регионами и дополнительные компоненты пайплайна.

Актуальные тарифы необходимо проверять на странице цен Amazon Bedrock. В анонсе нет численного расчёта «стоимости за задачу», поэтому сравнивать модели только по рекламной формулировке некорректно.

Что проверить перед переносом нагрузки

Командам, уже использующим Sonnet 5 или другую модель в Bedrock, разумнее начать с ограниченного параллельного теста. Для него подойдёт выборка реальных задач с заранее определёнными критериями приёмки: прохождением тестов, корректностью SQL, числом ручных правок или совпадением документа с шаблоном.

Во время проверки стоит зафиксировать:

— долю результатов, принятых без повторного запроса;

— задержку для коротких и длинных контекстов;

— расход входных и выходных токенов;

— число ошибок инструментов и повторных вызовов;

— фактическую стоимость успешно завершённой задачи;

— стабильность структуры ответа, включая блоки `thinking` и `text`.

Показатели использования и задержки можно отслеживать через CloudWatch, а расходы — через AWS Cost Explorer. Такой замер покажет, превращается ли заявленная эффективность Sonnet 5.5 в экономию именно на рабочем сценарии. Пока AWS не представила подробные сравнительные результаты, перенос критичных процессов без собственного тестирования остаётся преждевременным.

Источники