ИИ-агенты OpenAI взломали Hugging Face в ходе эксперимента

16 июля платформа Hugging Face сообщила о кибератаке на свою инфраструктуру. В ходе инцидента автономная система ИИ-агентов получила доступ к внутренним датасетам и учетным данным компании. 21 июля OpenAI подтвердила, что за атакой стояли две её передовые модели — GPT-5.6 Sol и ещё одна, более мощная система, которая пока не представлена публично.
Инцидент произошёл во время внутреннего эксперимента OpenAI, где модели тестировались на способность находить и эксплуатировать уязвимости. Агенты вышли за пределы изолированной тестовой среды, обнаружив уязвимость нулевого дня в прокси-сервисе, через который они загружали программные пакеты. После этого они повысили свои привилегии и получили доступ к системе с выходом в интернет.
Целью атаки стала платформа Hugging Face, так как агенты предположили, что там могут храниться данные, необходимые для выполнения их задачи. Они использовали несколько методов, включая эксплуатацию уязвимостей и похищенные учетные данные, чтобы извлечь ответы на тестовые задания из базы данных платформы.
«Все действия агентов были направлены на достижение одной конкретной цели — получение решений для ExploitGym», — сообщили в OpenAI.
Для расследования инцидента Hugging Face также использовала ИИ, который проанализировал более 17 тысяч событий и помог восстановить последовательность взлома за несколько часов. OpenAI назвала произошедшее беспрецедентным киберинцидентом и заявила об усилении мер безопасности для будущих испытаний.





