Назад к ленте

OpenAI впервые присвоила ИИ-модели Astra критический статус по кибервозможностям

📅 02.09.2026 14:35

1 сентября компания OpenAI присвоила своей новой модели Astra критический уровень кибервозможностей в рамках Preparedness Framework, что стало первым подобным случаем среди её ИИ-систем. Тесты проводились на конфигурации с расширенным доступом Daybreak Blue, и самые продвинутые функции в области безопасности после релиза будут доступны лишь узкому кругу пользователей.

По оценке специалистов, Astra обладает способностью выявлять ранее неизвестные уязвимости и разрабатывать методы их эксплуатации в защищённых системах без необходимости в пошаговом управлении человеком. Ранее OpenAI только предполагала, что модель может достичь такого уровня.

Preparedness Framework присваивает уровень Critical модели, если она способна самостоятельно обнаруживать и создавать эксплойты для zero-day уязвимостей в широком спектре защищённых систем. Другим критерием является возможность самостоятельно разработать и осуществить новую атаку, имея лишь общее представление о цели.

На публичном тестировании ExploitBench Astra продемонстрировала результат в 100%. Во избежание попадания данных теста в обучающие выборки, OpenAI разработала внутреннюю версию ExploitBench с 20 высокоопасными уязвимостями в движке V8, выявленными с июня по август 2026 года. Astra обнаружила и использовала две неизвестные ранее zero-day уязвимости, что стало частью цепочки эксплуатации. OpenAI уже передает информацию об этих уязвимостях разработчикам ПО.

Модель также успешно выявила ранее неизвестные уязвимости в защищённом браузере и создала атаку, позволившую выйти из песочницы и выполнить команды на основной системе после открытия HTML-файла. В другом тесте Astra использовала несколько уязвимостей защищённой операционной системы для повышения привилегий с обычного пользователя до root.

OpenAI в последние недели приостанавливала некоторые этапы разработки и выпуска Astra, усиливая защиту от киберзлоупотреблений. Сейчас компания считает меры достаточными и планирует выпустить модель в ближайшее время. На начальном этапе доступа к продвинутым функциям по кибербезопасности получит ограниченная группа тестировщиков, с последующим расширением доступа через Daybreak Blue.

Astra дополнительно обучена отказываться от запрещённой киберпомощи и соблюдать ограничения. В тестах модель отказалась выполнять 91,5% запросов, связанных с киберпомощью, по сравнению с 59% у GPT-5.6 Sol. OpenAI также внедряет дополнительные системы мониторинга для автоматического обнаружения и остановки потенциально несанкционированных действий.

В августе OpenAI замедлила разработку продвинутых ИИ-систем после инцидента с Hugging Face и предварительной оценки Astra.

Рекомендованный контент