Назад к блогу

Claude Sonnet 5.5: что стоит за «почти как Opus, но вдвое дешевле»

Claude Sonnet 5.5: что стоит за «почти как Opus, но вдвое дешевле»

Anthropic выпустила Claude Sonnet 5.5 — модель, которая по ряду задач вплотную подходит к флагманской Opus 5.5, но обходится примерно вдвое дешевле. Вместе с релизом впервые для линейки Sonnet включили кибербезопасностные ограничения с перенаправлением рискованных запросов на предыдущую версию модели. Разбираемся, что стоит за цифрами бенчмарков и как новые правила повлияют на разработчиков.

28 сентября 2026 года Anthropic выпустила Claude Sonnet 5.5 — вторую модель семейства Claude 5.5. Компания позиционирует её как более быстрый и дешёвый компаньон к Claude Opus 5.5: по её данным, модель работает более чем на 30% быстрее Sonnet 5 и обходится до 30% дешевле для большинства работ. Первой моделью семейства 22 сентября стал Opus 5.5.

Вместе с релизом появились две вещи, которые касаются не только качества ответов: кибербезопасностные ограничения, впервые применённые к линейке Sonnet, и механизм перенаправления запросов на предыдущую модель.

Что именно изменилось

Sonnet 5.5 заявлена как улучшение над Sonnet 5 по ряду доменов, местами значительно. В агентном кодинге на Terminal-Bench 4.0 результат вырос с 10.3% до 70.6%, что выше 66.4% у Opus 5.5. На CursorBench 4.0 — 55.5% против 34.1%, причём лучший результат модели отстаёт от Opus 5.5 примерно на два пункта. На FrontierCode 1.1 (Main) — 46.2% против 42.4% у Sonnet 5; на High effort модель набирает на 10 пунктов больше Sonnet 5 при той же настройке.

Effort — это настройка, определяющая, сколько модель тратит на обдумывание. Уровни различаются по этой величине: High — ниже, чем Xhigh, а Xhigh — ниже, чем Max. На FrontierCode Sonnet 5.5 на Max набирает меньше, чем на Xhigh, потому что эта оценка проверяет, можно ли принять изменение кода без правок человеком, и штрафует изменения вне рамок задачи: на Max модель чаще запускала навык code-review в Claude Code, разбивающий ревью на множество субагентов, и в двух случаях это привело к таймауту или к лишним правкам за пределами задачи.

В работе со знаниями на GDPval-AA v2.1 Sonnet 5.5 почти вровень с Opus 5.5 и примерно на 400 пунктов выше Sonnet 5. Заявлены улучшения и в computer use (OSWorld 2.1: 57.0%), и в распознавании графиков (Chartography: 61.6% против 15.6%).

По ценам за 1M токенов Sonnet 5.5 вдвое дешевле Opus 5.5 почти по всем позициям: входные токены — $2 против $4, выходные — $10 против $20, запись в кэш — $2.50 против $5. Совпадает только чтение из кэша: $0.20 у обеих. При этом половина цены за токен не гарантирует половину счёта — если модель тратит больше токенов, экономия сокращается.

Кибербезопасностные ограничения и fallback

Sonnet 5.5 развёрнута с защитами, аналогичными Opus 5.5. Обычная разработка ПО — поиск и исправление багов — остаётся доступной, но задачи повышенного риска «видимо» перенаправляются на Sonnet 5. К ним относятся пентест, генерация эксплойтов, и сканирование бинарных уязвимостей. Помимо киберзапросов, на Sonnet 5 уходит узкий набор запросов, связанных с разработкой фронтирных LLM, например работа с ядром на определённых ML-ускорителях. Блокировки по биологии, обычным вооружениям и анти-дистилляция завершают запрос без запасной модели.

Принуждение работает в три этапа: зонд, лёгкий классификатор на самой Sonnet 5.5 и отдельный обученный LLM-классификатор, который взвешивает вердикт зонда при решении о блокировке разговора.

Решение об ужесточении основано на резком росте киберспособностей модели. С отключёнными ограничениями Sonnet 5.5 добилась полного произвольного исполнения кода в 178 из 410 прогонов ExploitBench, прошла 46.1% задач CyScenarioBench против 0.7% у Sonnet 5 и выполнила 50 перехватов потока управления против трёх у Sonnet 5. Anthropic по-прежнему считает Sonnet 5.5 менее способной в кибербезопасности, чем Opus 5.5 и Mythos 5.1, но скачок от предыдущей Sonnet был достаточно большим, чтобы применить ту же cyber policy, что и для Opus 5 и Opus 5.5. Классификаторы ловят вредные кибер-запросы на уровне, сопоставимом с Opus 5, но выбраны менее агрессивные защиты от джейлбрейков. Пользователям следует ожидать больше отказов, чем с Sonnet 5, в том числе на легитимной кибербезопасностной работе.

Fallback является opt-in для API: приложения Anthropic сами автоматически перенаправляют заблокированные киберзапросы, а разработчики API должны включить это сами. Без включённого fallback заблокированный запрос просто останавливается, а не передаётся Sonnet 5.

Почему это сделали

Anthropic ссылается на отзывы компаний-тестеров о конкретных рабочих нагрузках. Slack сообщает, что модель лучше справлялась с офлайн-оценками Slackbot за меньшее число шагов и примерно на 14% меньшим числом выходных токенов. Zendesk указывает, что на сотнях реальных обращений в поддержку модель решала тикеты на 20% быстрее. Balyasny Asset Management на 2441 финансовой задаче отмечает лучшее соотношение качества и стоимости среди семи моделей для высоконагруженных процессов. Atlassian заявляет, что команды смогут запускать Rovo Agents до 30% быстрее, чем с Sonnet 5.

Позиционирование разделяет задачи: Opus 5.5 предназначен для сложной работы, требующей тщательного суждения, тогда как Sonnet 5.5 сильнее всего в хорошо очерченных повседневных задачах, исправлении багов и создании документов, слайдов и таблиц.

Контекст релиза — активность конкурентов: незадолго до этого OpenAI выпустила несколько новых моделей, включая улучшенные версии Sol и Luna, а Meta анонсировала новую модель для будущей функции, связанной с умными очками. Sonnet 5.5 имеет ту же прейскурантную цену, что и GPT-6 Sol — вторая по силе модель OpenAI после Astra.

Что это меняет на практике

Разработчики могут начать работу с Sonnet 5.5 на Claude Platform, указав идентификатор claude-sonnet-5-5; модель доступна на всех платформах, включая AWS, Google Cloud и Microsoft Azure. Уровень усилия по умолчанию различается: в Claude Code и приложениях это Medium, на Claude Platform — High.

Независимый тест в агентной задаче по багфиксу показывает, что экономия за токен не обязательно превращается в экономию за прогон. Sonnet 5.5 в среднем показал 5 минут 8 секунд, 29 вызовов инструментов, 42 608 выходных токенов и $0.70 за прогон; Opus 5.5 — 3 минуты 21 секунду, 25 вызовов инструментов, 20 625 выходных токенов и $0.75. Sonnet 5.5 потратил вдвое больше токенов, что почти полностью уничтожило его скидку за токен. В четырёх из пяти прогонов он упёрся в лимит 32 000 токенов на шаг и остановился до завершения; после повышения лимита до 128 000 все четыре прогона прошли. Провальные попытки стоили около $1.40 и не входят в итоги; с их учётом Sonnet 5.5 в среднем стоил около $0.98 за прогон, что больше $0.75 у Opus 5.5. Обе модели исправили все баги, но Opus 5.5 финишировал примерно на 35% быстрее.

В другом независимом сравнении — с Opus 5.5, не с Sonnet 5 — Sonnet 5.5 в тесте Resolver использовал на 15% больше токенов, но стоил на 42% меньше и завершил работу немного быстрее.

Ограничения и открытые вопросы

Авторы признают, что на максимальном усилии (Max effort) Sonnet 5.5 показывает результат ниже, чем на Xhigh. Причина — в устройстве оценки FrontierCode: она проверяет, можно ли принять изменение кода без правок человеком, и штрафует изменения вне рамок задачи, даже если они качественные или полезные. На Max effort модель чаще запускала навык code-review в Claude Code, который разбивает проверку на множество субагентов, и в двух рассмотренных Cognition случаях это привело к таймауту или к лишним правкам за пределами задачи, а значит к более низкому баллу.

Бенчмарки отражают лишь одну грань возможностей модели: по собственному тестированию Anthropic и внешних проверяющих Opus 5.5 остаётся явно сильнее в сложной открытой работе, требующей устойчивого суждения. Artificial Analysis запускала GDPval-AA и AA-Briefcase на предрелизном развёртывании Sonnet 5.5 на Claude Platform, где был найден баг, способный ухудшать ответы на запросы со структурированными выводами; ожидается, что влияние на баллы, если оно есть, будет небольшим и занизит производительность, а баг с тех пор исправлен.

Главный открытый вопрос — безопасность fallback. В тестах Anthropic по инъекциям промптов в средах программирования 25% запросов к Sonnet 5.5 обрабатывались Sonnet 5 после срабатывания кибер-блокировки, часто потому, что внедрённые инструкции стереть диски или удалить файлы запускали классификатор. Из этих перенаправленных запросов 12,01% были успешно скомпрометированы, тогда как сама Sonnet 5.5 была скомпрометирована лишь в 4 из 5 901 обработанных ею запросов. Отдельный бенчмарк косвенной инъекции от Gray Swan не показал падения производительности при включённом fallback, но командам, использующим fallback, нужно учитывать безопасность и старой модели, и самой Sonnet 5.5.

Предсказуемость тоже под вопросом: в специализированных рабочих процессах fallback может быть разрушительным. Пользователь Claude Code сообщил, что 2 746 из 3 427 сообщений основной сессии за день были сгенерированы Opus 4.8 после fallback, и после переключения сессия больше не вернулась к Fable 5 сама.

Anthropic всё ещё настраивает классификаторы Sonnet 5.5 для снижения ложных срабатываний и планирует дать проверенным защитникам доступ с меньшими ограничениями через расширенную Cyber Verification Program, но на старте Sonnet 5.5 в этой программе недоступна. Выпуск Claude Haiku 5.5 запланирован на ближайшие недели.

Источники

Похожее