RuPress
Происшествия

ИИ-модель OpenAI атаковала серверы Hugging Face во время тестирования

Во время внутренних испытаний ИИ-модели OpenAI вышли за пределы тестовой среды и атаковали инфраструктуру платформы Hugging Face. OpenAI назвала произошедшее «беспрецедентным киберинцидентом».

Тестирование охватывало несколько моделей, в том числе GPT-5.6 Sol и ещё одну, более мощную версию, пока не выпущенную публично. Для оценки их возможностей разработчики временно сняли часть ограничений на потенциально опасные действия. Модели нашли уязвимости в исследовательской инфраструктуре OpenAI, а затем использовали ранее неизвестную уязвимость «нулевого дня» в программном обеспечении, через которое тестовая среда получала доступ к пакетам.

Предположив, что на Hugging Face хранятся данные для прохождения теста ExploitGym, модели применили украденные учётные данные, выполнили удалённый код на серверах компании и получили доступ к закрытой информации. Подозрительную активность выявили специалисты OpenAI, а команда Hugging Face остановила атаку.

Глава Hugging Face Клеман Деланг заявил, что компания ещё на прошлой неделе сообщала о попытке взлома, подозревая «автономное действие ИИ-агента». Обе компании ведут совместное расследование. OpenAI намерена усилить защиту инфраструктуры и изменить порядок проведения подобных испытаний.