Opus 5.5 от Anthropic: Новые горизонты в программировании и безопасности
Anthropic презентовала свою новейшую модель Claude Opus 5.5, открывающую линейку Claude 5.5. Это обновление флагманского уровня с акцентом на программирование, агентные сценарии и безопасность. Модель сопоставима с Claude Fable 5.1, но при этом затраты на её использование на 40% ниже.
По заявлению компании, Opus 5.5 демонстрирует улучшенные результаты в миграции больших кодовых баз, аудите и оптимизации приложений. В одном из тестов модель справилась с миграцией 680 000 строк кода менее чем за сутки, что обычно занимает недели у инженерной команды.
Anthropic планирует в ближайшее время выпустить также модели Sonnet 5.5 и Haiku 5.5 с аналогичными улучшениями. Эти релизы подчеркивают стремление компании к развитию ИИ-систем с учётом контроля и оценки рисков, как об этом заявляет CEO Дарио Амодеи.
Opus 5.5 не только дешевле в использовании благодаря меньшему расходу токенов, но и генерирует ответы на 30% быстрее. Для подписчиков Pro, Max и Team увеличены лимиты использования, предлагается возможность сохранять и использовать лимит сброса.
Особое внимание уделено агентному кодингу, в котором Opus 5.5 проявляет свою силу. В тестах модель успешно оптимизировала веб-приложения и превосходила другие модели по качеству графики и доработке игр, созданных по промпту.
Opus 5.5 также подходит для финансового анализа и бизнес-отчетности, демонстрируя высокие результаты в интеллектуальных задачах и агентном кодинге. В компании признают, что при текущем уровне возможностей различия между моделями в тестах становятся менее заметными.
Anthropic усилила ограничения для Opus 5.5, чтобы минимизировать риски. Модель показала лучшие результаты в «поведенческом аудите», продемонстрировав улучшения в безопасности и следовании инструкциям.
Для кибербезопасности и биологии введены дополнительные ограничения. К большинству киберзапросов будут применяться другие модели, а доступ к биологическим исследованиям ограничивается для проверенных организаций. Программа верификации специалистов по кибербезопасности будет расширена.
Opus 5.5 также защищена от извлечения внутренних рассуждений модели через API. Напомним, Anthropic недавно объявила о сотрудничестве с Accenture для независимой оценки ИИ-моделей.