Назад к ленте

OpenAI присвоила модели Astra критический статус по киберспособностям

📅 03.09.2026 08:12

1 сентября OpenAI впервые присвоила модели Astra критический уровень кибервозможностей в рамках Preparedness Framework. Тестирование проводилось на конфигурации с расширенным доступом Daybreak Blue, а после релиза доступ к передовым функциям безопасности будет ограничен.

Компания считает, что Astra, обладая нужными инструментами и доступом, может выявлять неизвестные уязвимости и разрабатывать методы их использования без человеческого вмешательства. Ранее OpenAI только предполагала, что модель может достичь такого уровня.

Preparedness Framework присваивает уровень Critical моделям, которые могут без участия человека находить и создавать эксплойты для zero-day в защищенных системах. Другой критерий — способность самостоятельно разработать и провести сложную атаку, имея лишь общую цель.

На публичном ExploitBench Astra продемонстрировала результат в 100%. Чтобы избежать утечки данных теста в обучающие выборки, OpenAI создала внутреннюю версию ExploitBench. Она включала 20 опасных уязвимостей в движке V8, раскрытых с июня по август 2026 года. Astra обнаружила и использовала два неизвестных zero-day, о которых компания сообщает разработчикам ПО.

В экспериментах модель обнаружила уязвимости в защищенном браузере и создала цепочку атаки, позволившую выйти из песочницы и выполнить команды на основной системе. В другом тесте Astra объединила несколько уязвимостей операционной системы, повысив привилегии до уровня root.

OpenAI временно откладывала этапы разработки Astra для усиления безопасности. Теперь компания уверена в принятых мерах и готова выпустить модель. На первом этапе кибербезопасность будет доступна ограниченной группе тестировщиков, а затем через Daybreak Blue.

Astra обучили отказываться от запрещенной киберпомощи, соблюдая ограничения. В тестах модель отказалась от 91,5% запросов на обход ограничений, показав результат лучше, чем GPT-5.6 Sol. OpenAI также внедряет системы мониторинга для обнаружения и остановки несанкционированных действий модели.

В августе OpenAI замедлила разработку передовых ИИ после инцидента с Hugging Face и предварительной оценки Astra. Компания также отметила прорыв Astra в математике и его значение для квантовой сложности.

Рекомендованный контент