Anthropic выпустила Opus 5.5 с более низкими ценами на токены, более быстрым выводом и заявленными результатами уровня Fable, подняв планку для эффективного корпоративного ИИ.

Anthropic выпустила Claude Opus 5.5 — новую флагманскую модель, которая, по словам компании, на многих задачах соответствует или превосходит более мощную систему Fable 5.1, при этом обходится дешевле в эксплуатации. Запуск даёт разработчикам доступ к более быстрой и дешёвой модели топ-уровня в момент, когда покупатели ИИ взвешивают возможности и затраты на инференс.
Opus 5.5 уже доступен через сервисы Anthropic и крупные облачные платформы. Компания также утверждает, что улучшила стиль написания модели, уменьшив количество жаргона и размещая важную информацию в ответах раньше. Эти изменения нацелены на повторяющуюся претензию к ранним моделям Claude — слишком шаблонный или чрезмерно витиеватый вывод.
Anthropic оценивает Opus 5.5 в 4 доллара за миллион входных токенов и 20 долларов за миллион выходных токенов, что ниже 5 и 25 долларов у Opus 5. Компания также сообщает, что стоимость чтения из кэша снизилась на 60 процентов. TechCrunch сообщил о снижении цены на выход с 25 до 20 долларов за миллион токенов и отметил, что новой модели требуется меньше вычислений для обслуживания.
Anthropic оценивает, что общие эксплуатационные расходы должны быть примерно на 40 процентов ниже, чем у Opus 5, если учитывать использование токенов. Эта более широкая оценка отражает заявленную способность модели использовать меньше токенов, а также более чем на 30 процентов более быстрый вывод. Разница важна для производственных команд: более низкие прайс-листы не гарантируют автоматически более низкие счета, если модель использует значительно больше токенов на сложных задачах.
По данным The Decoder, ссылающегося на объявление Anthropic, пятичасовые лимиты использования для подписчиков вырастут на 20 процентов. Anthropic говорит, что сочетание более высоких лимитов и более низких затрат на использование должно увеличить практическую ёмкость примерно на 25 процентов.
Модель доступна на Claude Platform под идентификатором claude-opus-5-5, а также через Amazon Web Services, Google Cloud и Microsoft Azure. Такая доступность даёт корпоративным командам больше вариантов для интеграции модели в существующие облачные, комплаенс- и закупочные системы.
Anthropic описывает Opus 5.5 как свою наиболее производительную модель на сегодняшний день и говорит, что она соответствует Claude Fable 5.1 на большинстве задач. В сравнениях также новый модельный релиз ставится выше GPT-6 Astra от OpenAI по нескольким оценкам, несмотря на более низкую указанную цену. Это заявления самого вендора, и их не следует воспринимать как независимое подтверждение общего превосходства.
The Decoder более подробно сообщил о сравнении Anthropic в программировании. На FrontierCode компания утверждает, что Opus 5.5 превосходит GPT-6 Astra примерно при 20 процентах стоимости на задачу. На Terminal-Bench 4.0 Anthropic заявляет о сопоставимой производительности при 40 процентах стоимости Astra, а на CursorBench сообщает о преимуществе в 11 пунктов над GPT-5.6 Sol при одной трети стоимости.
Есть и внешняя поддержка позиции модели в бенчмарках. Artificial Analysis, независимая платформа, на которую ссылался The Decoder, присвоила Opus 5.5 результат 58 в своём Intelligence Index при максимальном усилии — это был самый высокий показатель на этом индексе на момент отчёта. Также сообщалось о лидирующих результатах в шести из десяти оценок, включая Humanity’s Last Exam и SciCode.
Однако тот же анализ выявил компромисс по эффективности. При максимальном усилии Opus 5.5, по сообщениям, генерировал около 119 000 выходных токенов на задачу, по сравнению с 73 000 у Opus 5, 78 000 у Fable 5.1 и 27 000 у GPT-6 Astra. Более низкие цены за токен могут компенсировать такое потребление в некоторых сценариях, но модель не обязательно дешевле в каждой отдельной задаче.
Anthropic утверждает, что Opus 5.5 реже использует жаргон, чаще начинает с самой важной информации и лучше следует инструкциям по письму. Ранние тестировщики, описанные The Decoder, сочли вывод более ясным, но эти впечатления остаются ограниченными и не заменяют контролируемую оценку на реальных рабочих процессах.
Релиз также расширяет меры безопасности, применяемые к самым мощным моделям Anthropic. Opus 5.5 получает защитные меры, сопоставимые с Fable 5.1, в области кибербезопасности, биологии и разработки передового ИИ. Anthropic говорит, что запросы, вызывающие эти меры, могут быть перенаправлены на другую модель. По сообщениям, большая часть помеченной работы по кибербезопасности направляется на Opus 4.8, тогда как некоторые запросы по биологии и разработке передового ИИ идут на Opus 5.
Проверенные организации могут подать заявку на доступ к биологическим исследованиям через Life Sciences Verification Program Anthropic. Компания планирует расширить свой Cyber Verification Program на Opus 5.5. Модель также включает “Preserved Thinking”, которое ограничивает возможность пользователей API редактировать предыдущий контекст для извлечения рассуждений, а также меры водяных знаков, которые, как описано, поддерживают соответствие EU AI Act.
Anthropic сообщает, что Opus 5.5 прошёл предварительную оценку у METR и Frontier Design до выпуска. Компания также готовит более строгую проверку сред reinforcement learning, более сильный мониторинг и автоматизированные сценарии обучения безопасности. Эти планы важны, но они описывают текущую работу, а не доказательство того, что все риски выравнивания или злоупотребления решены.
Для команд разработчиков ключевая возможность заключается не просто в доступе к более высокому бенчмарк-результату. Модель, сочетающая сильную производительность в кодинге и знаниях с более низкими опубликованными ценами, может сделать более практичными долгоживущие ИИ-агенты, особенно для ревью кода, отладки, документации, исследований и внутреннего анализа.
Картину затрат будут сильно определять настройки усилий, дизайн промптов, повторное использование контекста и длина вывода. Показатели Artificial Analysis говорят о том, что Opus 5.5 при максимальном усилии может потреблять гораздо больше токенов, чем конкурирующие системы. Поэтому командам следует тестировать стоимость на завершённый рабочий процесс, а не сравнивать только цены токенов.
Для корпоративных покупателей доступность на Claude Platform, Amazon Web Services, Google Cloud и Microsoft Azure может снизить трение при внедрении. Но покупателям всё равно придётся проверять задержку, варианты хранения данных, поведение маршрутизации при срабатывании защитных мер и надёжность модели на их собственных документах и инструментах. Заявления Anthropic о более ясном письме могут иметь значение в длинных сессиях, но их следует измерять относительно существующих моделей, а не принимать как данность.
Релиз Anthropic также усиливает конкуренцию между премиальными моделями. Компания позиционирует Opus 5.5 против Fable 5.1 и GPT-6 Astra, одновременно отвечая на более дешёвые альтернативы, включая китайские модели, которые The Decoder описал как более слабые по производительности при гораздо более низких ценах. Следующий этап конкуренции может определяться не только лидирующими местами в бенчмарках, но и стоимостью успешной задачи и средствами контроля развёртывания.
Первым сигналом станет то, смогут ли независимые оценки воспроизвести заявленные Anthropic улучшения в кодинге, агентной работе и бизнес-задачах. Реальные расходы клиентов будут ещё одной важной проверкой, особенно для максимальных по усилию сценариев, создающих большие объёмы вывода.
Anthropic говорит, что Sonnet 5.5 и Haiku 5.5 появятся в ближайшие недели с аналогичными улучшениями производительности, эффективности и безопасности. Их цены и возможности покажут, представляют ли изменения Opus более широкую переработку семейства или главным образом обновление флагмана.
Разработчикам также стоит следить за развёртыванием Cyber Verification Program, изменениями маршрутизации модели под действием защитных мер и дополнительными деталями о мерах мониторинга и антидистилляции Anthropic. Эти политики могут повлиять на то, какие исследовательские и безопасностные рабочие процессы смогут напрямую выполняться на Opus 5.5.
Opus 5.5 важен потому, что Anthropic продаёт эффективность как часть возможностей, а не как компромисс против них. Заявленные компанией результаты указывают на то, что премиальные продукты ИИ движутся к более практичному показателю: стоимости и надёжности завершения всего рабочего процесса.
Доказательства выглядят многообещающими, но всё ещё сильно зависят от собственных бенчмарков и выбора тестов Anthropic. Для разработчиков и покупателей разумный подход — целевая оценка: измерять успешное завершение задач, потребление токенов, задержку, маршрутизацию безопасности и необходимость ручного редактирования на репрезентативных рабочих процессах, прежде чем считать заявленное снижение эксплуатационных расходов на 40 процентов фактом продакшена.