OpenAI представила Astra с критическим уровнем кибервозможностей
В начале сентября OpenAI впервые присвоила модели Astra критический уровень кибервозможностей в рамках Preparedness Framework. Этот статус был получен благодаря тестам, проведенным с конфигурацией расширенного доступа Daybreak Blue. Важные функции безопасности после релиза будут доступны лишь ограниченному кругу пользователей.
По данным OpenAI, Astra способна находить и использовать уязвимости в защищенных системах без человеческого вмешательства. Ранее компания лишь предполагала возможность достижения такого уровня. В Preparedness Framework критический уровень обозначает способность модели самостоятельно разрабатывать и выполнять эксплойты для zero-day в различных системах.
На публичной платформе ExploitBench Astra получила высшую оценку в 100%. Внутренняя версия ExploitBench от OpenAI включала 20 уязвимостей высокого риска в движке V8, обнаруженных в 2026 году. Astra смогла выявить и использовать два ранее неизвестных zero-day, о которых информация уже передается разработчикам.
В ходе испытаний Astra также нашла уязвимости в защищенном браузере и смогла выйти из песочницы, выполнив команды на основной системе. В другом тесте модель повысила пользовательские привилегии до уровня root. Эти результаты отражают возможности Astra при доступе Daybreak Blue, не являясь стандартной конфигурацией.
OpenAI задерживала выпуск Astra, чтобы усилить защиту от киберзлоупотреблений. Теперь компания готова представить модель небольшой группе тестировщиков с последующим расширением доступа. Astra обучена отказываться от запрещенной помощи, справляясь с 91,5% запросов на обход ограничений.
Дополнительно внедряются системы мониторинга для предотвращения несанкционированных действий. Напомним, в августе OpenAI замедлила разработку ИИ после инцидента с Hugging Face и оценки Astra.