Anthropic представила Claude Opus 5.5 с упором на кодинг и безопасность
Anthropic анонсировала Claude Opus 5.5, ставшую первой моделью в новой серии Claude 5.5. Компания позиционирует её как флагманское обновление, оптимизированное для программирования, агентных сценариев, аналитики и безопасности. Модель работает на уровне Claude Fable 5.1, но потребляет на 40% меньше ресурсов.
Разработчики утверждают, что Opus 5.5 значительно улучшила производительность в сложных задачах, таких как миграция кодовых баз и аудит программного кода. В одном из тестов модель завершила перенос 680 000 строк кода менее чем за 24 часа — задача, которая обычно занимает недели у команды инженеров.
Anthropic также планирует выпустить модели Sonnet 5.5 и Haiku 5.5 с аналогичными улучшениями. Компания подчеркивает, что развитие ИИ должно сопровождаться мерами контроля, как отметил CEO Anthropic Дарио Амодеи.
Opus 5.5 предлагает экономию благодаря низкой стоимости и меньшему расходу токенов. По расчетам компании, экономия на нагрузках составляет около 40%. Модель также отвечает на запросы на 30% быстрее, чем Opus 5.
Anthropic увеличила лимиты использования для подписчиков Pro, Max и Team на пять часов и добавила возможность сохранения лимита сброса. Opus 5.5 особенно эффективна в задачах, требующих автономной работы и агентного кодинга.
Компания делает акцент на корпоративных сценариях, включая финансовый анализ и бизнес-отчетность. Opus 5.5 демонстрирует сильные результаты в бенчмарках на интеллектуальные задачи и агентный кодинг, хотя тесты не всегда отражают реальные различия между моделями.
С усилением возможностей компании усилились и ограничения. Opus 5.5 показала лучший результат в автоматизированном поведенческом аудите, демонстрируя улучшения в честности и следовании инструкциям. Однако идеальные методы оценки пока недостижимы.
Anthropic применяет к Opus 5.5 защитные меры, аналогичные самым мощным моделям. Большинство киберзапросов перенаправляются на другие модели, доступ к биологическим исследованиям открыт только проверенным организациям. В ближайшие недели расширится программа Cyber Verification Program для специалистов по кибербезопасности.
Кроме того, Opus 5.5 защищена от попыток извлечения внутренних рассуждений через API. Напомним, в сентябре Anthropic объявила о партнерстве с Accenture для независимой оценки ИИ-моделей.