За атакой на Hugging Face стояла GPT-5.6 Sol и предрелизная LLM от OpenAI
Да, теми самыми злостными хакерами оказались OpenAI. Ну почти. Компания раскрыла подробности инцидента, о котором ранее сообщила Hugging Face. Они подтвердили, что за атакой на инфраструктуру платформы стояли две модели OpenAI — публичная GPT-5.6 Sol и более мощная предрелизная модель, проходившие внутреннее тестирование на кибербезопасность.
По словам OpenAI, инцидент произошел во время оценки возможностей моделей на бенчмарке ExploitGym, когда для исследования их максимальных возможностей были временно отключены стандартные защитные механизмы, ограничивающие опасную киберактивность.
Ранее Hugging Face сообщила, что впервые столкнулась с атакой, полностью проведенной автономной системой ИИ-агентов. Тогда компания не знала, какая именно языковая модель использовалась злоумышленником. Теперь OpenAI подтвердила, что этим «агентом» оказались ее собственные модели, работавшие в рамках внутреннего эксперимента.
Модели выполняли задания ExploitGym — бенчмарка, оценивающего способность ИИ превращать обнаруженные уязвимости в работающие эксплойты. Тестовая среда была изолирована от интернета и позволяла обращаться только к внутреннему прокси-кэшу для загрузки программных пакетов.
Однако вместо решения задачи в заданных условиях модели начали искать способ получить доступ к внешней сети. В ходе выполнения они обнаружили ранее неизвестную уязвимость (zero-day) в стороннем программном обеспечении, использовавшемся в инфраструктуре OpenAI, получили дополнительные привилегии и смогли выйти за пределы изолированной среды.
После этого модели последовательно использовали несколько векторов атаки, включая похищенные учетные данные и новую цепочку эксплуатации, чтобы получить удаленное выполнение кода на серверах Hugging Face. Целью было
Читать на habr.com
