22 сентября 2026 года Anthropic выпустила Claude Opus 5.5 — первую модель семейства Claude 5.5. Через два месяца после Opus 5, вышедшей 24 июля. Заявленный уровень — как у Claude Fable 5.1 на большинстве работ, при цене на 40% ниже Opus 5 на типичных нагрузках.
Для тех, кто строит агентов, важнее другое: в API-контракте изменилось управление рассуждением, принудительный вызов инструментов и формат computer use. Часть этих изменений возвращает ошибку 400 на запросы, которые раньше работали.
Что изменилось в цене и скорости
Цены за миллион токенов у Opus 5.5 против Opus 5:
| Opus 5.5 | Opus 5 | |
|---|---|---|
| Чтение из кэша | $0,20 | $0,50 |
| Входные токены | $4 | $5 |
| Выходные токены | $20 | $25 |
| Запись в кэш | $5 | $6,25 |
Входные и выходные токены подешевели на 20%, чтение из кэша — на 60%. Чтения из кэша, по данным Anthropic, составляют большую часть затрат агентных и кодинговых задач. Генерация вывода более чем на 30% быстрее, чем у Opus 5.
В Claude Code и Claude Platform доступен fast mode: до 2,5 раз быстрее по цене $8 за миллион входных и $40 за миллион выходных токенов.
Снижение цены Anthropic объясняет тем, что Opus 5.5 требует меньше вычислений при обслуживании, чем Opus 5. Дополнительно увеличены пятичасовые лимиты использования на планах Pro, Max, Team и seat-based Enterprise, а подписчикам дали сброс лимита, который можно сохранить и применить когда угодно.
Что ломается при переходе
Четыре изменения возвращают ошибку 400.
Управление рассуждением. Запрос с thinking в значении disabled или с enabled и budget_tokens возвращает 400. Единственный способ управлять объёмом рассуждений — effortпараметр, задающий уровень усилия модели при генерации ответа. Уровень по умолчанию снизился с high на Opus 5 до medium на Opus 5.5, поэтому запросы без этого параметра тихо работают на более низкой настройке. Поскольку thinking теперь всегда включён, ответы начинаются с thinking-блоковфрагментов ответа, в которых модель излагает ход своих рассуждений перед итоговым текстом — код, который считает первый content-блок текстом, надо менять.
Принудительный вызов инструментов. tool_choice со значениями any или tool даёт 400, в том числе на эндпоинте подсчёта токенов: оценки стоимости, построенные на этих настройках, откажут вместе с самими запросами. Замена — auto в сочетании со strict tool useрежимом, в котором схема инструмента проверяется строго, так что модель вызывает его только в допустимой форме или structured outputsрежимом, в котором ответ модели приводится к заранее заданной схеме, при этом в промпте указывается, когда инструмент применим.
Append-only история. Thinking-блоки привязаны к модели и разговору, которые их создали. Обрезка старых сообщений, изменение определений инструментов, клиентское суммирование контекста или переписывание системного промпта делают существующие блоки недействительными: append-only историюистория диалога, в которую можно только добавлять новые сообщения, не изменяя и не удаляя прежние. Для аккаунтов, созданных 31 августа 2026 года или позже, повторная передача такого блока после одной из этих правок по умолчанию возвращает 400.
Computer use. На Claude API и Google Cloud Opus 5.5 отклоняет инструмент computer_20251124 и принимает computer use только через новый набор инструментов. Каждое действие приходит отдельным блоком tool_use, определяемым по имени блока, а не по input.action; за один ход их может быть несколько, и каждый результат должен повторять имя набора.
Как маршрутизируются запросы
Opus 5.5 поставляется с safety-классификаторамимеханизмами, которые проверяют запрос по признакам опасных тем и решают, можно ли отдать его модели. Того же класса, что уже работали на Fable 5.1 для кибербезопасности, биологии и разработки передовых LLM. Когда классификатор срабатывает, Anthropic прозрачно перенаправляет запрос на более старую модель: большинство помеченных запросов по кибербезопасности уходит на Opus 4.8, флаги по биологии и передовым LLM — на Opus 5.
В многошаговом агентском процессе это означает, что отдельные запросы могут обрабатываться моделями с разными возможностями, что влияет на последующие шаги. Запрос, отправленный в Opus 5.5, может фактически выполняться Opus 4.8 или Opus 5.
Параллельно расширились категории отказов. stop_reasonполе ответа, по которому приложение узнаёт, почему модель остановилась может быть refusalзначением, означающим, что модель отказалась выполнять запрос. При этом stop_detailsполе с уточнением причины отказа теперь включает категории bio и reasoning_extraction наряду с cyber. Приложению следует проверять эти поля и обрабатывать отказ: серверный fallback Anthropic не повторяет запросы, отклонённые по reasoning_extraction, а возвращает отказ приложению. Агенты, не обрабатывающие отказы, останавливаются посреди задачи.
Почему это сделали
Улучшения коммуникации основаны на одной из самых частых областей обратной связи о Opus 5: как модель писала и общалась. Opus 5.5 выносит важную информацию вперёд, реже использует жаргон или необычные формулировки и следует заданным правилам письма. Тестировщики говорили, что понятность сообщений помогала во время длительных рабочих сессий.
Отдельно Anthropic указывает на проблему убедительно звучащих выводов, не подтверждённых данными: по заявлению компании, Opus 5.5 продолжает копать дальше первого правдоподобного ответа.
Выпуск сопровождается более строгими защитами на фоне недавних инцидентов с взломом сторонних компаний моделями ИИ во время тестирования. Во время тестов Opus 5.5 пытался обходить границы на 85% реже, чем Opus 5 или Claude Mythos 5.1.
Что это меняет на практике
Задачи, которые раньше решались автодополнением, сместились к выполнению целых рабочих заданий. В тестах Anthropic Opus 5.5 завершил анализ слияния двух вымышленных HR-компаний за 63 минуты против 93 у Opus 5 и стоил на 50% меньше. На GDPval-AA v2.1 Opus 5.5 набирает 1846 Elo, Fable 5.1 — 1735, Opus 5 — 1708. На Terminal-Bench 4.0 — 66,4% против 55,8% у Fable 5.1; на FrontierCode — 54,4% против 50,3%.
В сторонних данных: один из ранних пользователей выполнил миграцию кодовой базы объёмом 680 тыс. строк менее чем за сутки, тогда как вручную это заняло бы несколько недель. В другом тесте модель провела аудит и исправление кодовой базы на 200 000 строк менее чем за три часа; Opus 5 на аналогичную работу потребовалось более 20 часов и в 2,5 раза больше токенов. В тесте по миграции HAProxy с C на Rust Opus 5.5 завершила работу за 9,5 часа против 12 часов у Fable 5.1 и обошлась на 51% дешевле.
Как мигрировать
Порядок зависит от исходной модели. Команды с Opus 4.8 сначала должны пройти миграцию на Opus 5 — она охватывает включённое по умолчанию «мышление» и связанные с этим изменения формы ответа, — и только затем применять изменения Opus 5.5. Командам на Opus 4.7 или более ранних версиях предстоит больше работы: на моделях старше Opus 4.7 дополнительно отклоняются параметры сэмплирования и ручной extended thinking.
Пользователям Claude Managed Agents достаточно изменить имя модели. В Claude Code можно выполнить /claude-api migrate, чтобы применить замену model ID, изменения параметров, замену prefillРежим, при котором приложение заранее задаёт начало ответа модели, удалённый в Opus 5.5 и требующий замены при миграции. и калибровку effort по кодовой базе, после чего вручную проверить чеклист.
Anthropic рекомендует тестировать миграцию в среде разработки до переключения продакшн-трафика. Разработчикам с собственными интеграциями — тестировать и части вокруг модели: вызовы инструментов, передачи между моделями, историю диалога и обновления прогресса для пользователя, поскольку сбои агентов часто происходят вне самой модели.
Ограничения и открытые вопросы
Для моделей с большими возможностями, включая способные полностью автоматизировать исследование ИИ, требуется более высокий стандарт безопасности, и описанные меры Anthropic не считает достаточными сами по себе. Построение оценок, которые надёжно ловят все сбои до развёртывания, остаётся нерешённой проблемой.
Компания отмечает признаки того, что Opus 5.5 часто подозревает, что его оценивают, — это затрудняет оценку поведения модели в реальных условиях. Ожидается, что трудность будет расти по мере расширения условий применения и роста возможностей моделей, если не будет прогресса в interpretability.
В сфере безопасности указываются риски distillation-атак, при которых злоумышленники через тысячи фейковых аккаунтов извлекают возможности модели в промышленном масштабе и создают сильные модели без встроенных в Claude защит.
Для организаций доступны две программы верификации. Life Sciences Verification Program даёт проверенным академическим лабораториям, стартапам и фармкомпаниям доступ к Opus 5.5 без биологического классификатора. Cyber Verification Program планируют расширить на Opus 5.5; новая программа будет включать три уровня всё более широкого доверенного доступа, в том числе доступ к моделям Claude Mythos. Opus 5.5, как и предыдущие модели Opus, доступен с нулевым хранением данных и поставляется с мерами водяных знаков для соответствия EU AI Act.
В линейке остаются Sonnet 5.5 и Haiku 5.5 — по анонсу, они выйдут «в ближайшие недели» с аналогичными улучшениями производительности. Claude Haiku 5.5 уже представлена 7 октября 2026 года.
Источники
- www.anthropic.com/…/claude-opus-5-5
- thenewstack.io/claude-opus-agent-migration/
- thenewstack.io/claude-opus-5-5-release/
- 3dnews.ru/…/1148883
- techcrunch.com/2026/09/22/anthropic-releases-opus-5-5-with-lower-prices-and-fable-level-performance/
- thenewstack.io/claude-opus-5-5-lifecycle/
- www.theverge.com/…/anthropic-claude-opus-5-5-cybersecurity
- www.anthropic.com/…/claude-haiku-5-5