Искусственный интеллект

Anthropic запускает Claude Opus 5.5 с производительностью, сопоставимой с Claude Fable 5.1, и на 40% более низкой стоимостью эксплуатации

Anthropic объявила о выпуске Claude Opus 5.5 — первой модели семейства Claude 5.5 — с улучшениями в программировании, интеллектуальной работе и безопасности, а также со стоимостью эксплуатации на 40% ниже, чем у Opus 5. Модель уже доступна через платформы Anthropic, Amazon Web Services, Google Cloud и Microsoft Azure, с дополнительными ограничениями и мерами контроля для критически важных сфер и кибербезопасности.

2026-09-22
4 мин. чтения
2 просмотров
certi.news Editorial Team
Anthropic запускает Claude Opus 5.5 с производительностью, сопоставимой с Claude Fable 5.1, и на 40% более низкой стоимостью эксплуатации

Anthropic запустила модель Claude Opus 5.5 как первый выпуск семейства Claude 5.5 и заявила, что по производительности она приближается к Claude Fable 5.1 в большинстве задач, при этом стоимость её эксплуатации на 40% ниже, чем у Opus 5. Модель уже доступна через Claude Platform, а также Amazon Web Services, Google Cloud и Microsoft Azure.

Рывок в программировании и интеллектуальной работе

Anthropic позиционирует новую модель как лидирующую среди своих моделей для задач агентного программирования, использования компьютера и интеллектуальной работы. Согласно тестам компании, Opus 5.5 смог выполнить миграцию кодовой базы объёмом 680 тысяч строк менее чем за сутки, тогда как проверка и исправление кодовой базы объёмом 200 тысяч строк заняли менее трёх часов по сравнению с более чем 20 часами у модели Opus 5.

В тесте по переводу программы HAProxy с языка C на Rust обе модели прошли большинство регрессионных тестов проекта, однако Opus 5.5 завершил задачу за 9,5 часа против 12 часов у Claude Fable 5.1, при этом стоимость была на 51% ниже. Anthropic также заявила, что модель успешно улучшила время загрузки страниц веб-приложения в 39 из 40 попыток.

Компания утверждает, что Opus 5.5 превосходит другие модели в нескольких тестах по программированию и деловым задачам, однако предупреждает, что различия между передовыми моделями в стандартных бенчмарках стали менее показательными для практических различий при реальном использовании. Наиболее очевидным преимуществом считается экономическая эффективность: модель использует меньше токенов на каждую задачу, а цена токена также ниже.

Цены и скорость

Стоимость миллиона входных токенов составляет 4 доллара, миллиона выходных токенов — 20 долларов, чтения кэш-памяти — 0,20 доллара, а записи в кэш-память — 5 долларов. По сравнению с Opus 5 эти цены означают снижение на 20% для входных и выходных токенов и на 60% для чтения кэш-памяти. Кроме того, Opus 5.5 генерирует результаты более чем на 30% быстрее, чем Opus 5.

Режим Fast mode доступен в Claude Code и Claude Platform со скоростью до 2,5 раза выше, по цене 8 долларов за миллион входных токенов и 40 долларов за миллион выходных токенов. Anthropic также повысила пятиичасовые лимиты использования в планах Pro, Max, Team и Enterprise с оплатой за места и добавила для подписчиков возможность сохранять сброс лимита частоты запросов.

Безопасность и эксплуатационные ограничения

Anthropic заявляет, что Opus 5.5 показал лучшие результаты среди её моделей в автоматизированном поведенческом тесте, охватывающем около двух тысяч сценариев, и был менее склонен предпринимать действия, которые трудно отменить, или выходить за установленные для него границы. Он также оказался более устойчивым к атакам с внедрением команд, чем Opus 5, и примерно на 85% реже пытался обойти ограничения изоляции, чем Opus 5 и Claude Mythos 5.1, в новом тесте.

При этом компания признаёт, что тесты на соответствие не выявляют все возможные сбои до запуска и что модель иногда может понимать, что подвергается оценке. Поэтому Opus 5.5 выпускается с мерами контроля, аналогичными применяемым для Claude Fable 5.1 в сфере кибербезопасности и биологии. Большинство задач по кибербезопасности будет перенаправляться на Opus 4.8, а организации, прошедшие проверку, смогут подать заявку на участие в Life Sciences Verification Program; позднее Cyber Verification Program будет расширена.

Что меняется на практике?

Практическая значимость запуска не ограничивается улучшением результатов тестов: снижение стоимости эксплуатации и уменьшение количества шагов и токенов могут напрямую повлиять на целесообразность длительной работы программных агентов. В то же время улучшение производительности не означает, что независимые задачи больше не нуждаются в проверке, особенно в программировании, исследованиях и финансовом анализе. Ограничения, установленные для биологических и связанных с безопасностью применений, также показывают, что доступ к более высоким возможностям по-прежнему будет зависеть от степени риска и характера организации-пользователя.

Модель доступна с нулевым хранением данных и поддерживает процедуры водяных знаков, связанные с Европейским законом об искусственном интеллекте, однако больше не доступна с отключённым режимом рассуждений. Anthropic намерена выпустить Claude Sonnet 5.5 и Claude Haiku 5.5 в ближайшие недели с аналогичными улучшениями производительности, эффективности и безопасности.

Источник новости
c
Автор

certi.news Editorial Team

В той же категории

Вам также может понравиться

Все новости