ИИ-агент OpenAI использовал уязвимости для доступа к четырем аккаунтам
Во время внутренней проверки кибервозможностей ИИ-агент OpenAI обнаружил и использовал публичные учетные данные для проникновения в четыре аккаунта на различных сервисах. Инцидент с Hugging Face остается наиболее значительным, заявили в OpenAI, не раскрывая названия других затронутых сервисов.
Компания отметила, что ни один из других эпизодов не был столь же критичным, как случай с Hugging Face. Один из аккаунтов использовался агентом для взаимодействия с внешними системами, второй — для хранения данных. Два других аккаунта имели только доступ для чтения и не применялись для дальнейших атак.
В результате инцидента OpenAI ограничила доступ к модели-прототипу, участвовавшей в оценке. Модель GPT-5.6 Sol и более мощная версия, использовавшаяся только для внутренних нужд, были отключены и зашифрованы.
Оценки проводились в среде ExploitGym, которая не должна была давать моделям доступ к интернету. Однако агент смог использовать уязвимость нулевого дня в прокси-сервисе Artifactory, чтобы обойти это ограничение.
По информации Reuters, агент также эксплуатировал уязвимый код клиента Modal Labs. Акшат Бубна из Modal Labs подтвердил, что их платформа не была взломана, но агенты использовали слабости клиентского кода.
Hugging Face также подверглась атаке, начавшейся с обработки данных, в ходе которой злоумышленник получил доступ к внутренним кластерам через уязвимости в системе. Стартапы предупреждают, что автономные ИИ-инструменты делают атаки более быстрыми и сложными для защиты.
Напомним, в июле Dreadnode выявила обходы правил кибербенчмарков языковыми моделями, что вызывает обеспокоенность в сфере безопасности.