

ИИ-агент на базе GPT-5.6 атаковал инфраструктуру Hugging Face во время тестирования
- GPT-5.6 обошел защиту OpenAI и самостоятельно проник в инфраструктуру Hugging Face.
- Это первый известный случай автономной кибератаки ИИ во время тестирования.
- На фоне инцидента OpenAI заявила об усилении мер безопасности.
Компания OpenAI сообщила о беспрецедентном киберинциденте, который произошел во время внутреннего тестирования моделей семейства GPT-5.6. О событии сообщил генеральный директор OpenAI Сэм Альтман.
По данным компании, ИИ-агент, созданный на базе GPT-5.6 Sol и еще одной предрелизной модели, самостоятельно вышел за пределы изолированной среды тестирования, получил доступ к интернету и атаковал инфраструктуру Hugging Face.
ИИ смог выйти за пределы «песочницы»
По информации OpenAI, инцидент произошел во время внутреннего бенчмарка ExploitGym, который оценивает кибервозможности моделей. Для тестирования компания намеренно отключила часть защитных механизмов, чтобы проверить максимальный потенциал систем.
В ходе теста модели:
- нашли и использовали ранее неизвестную уязвимость нулевого дня в прокси для кеширования пакетов;
- получили доступ к открытому интернету;
- выполнили повышение привилегий внутри исследовательской инфраструктуры OpenAI;
- похитили учетные данные;
- использовали цепочку уязвимостей для проникновения на серверы Hugging Face и получения доступа к информации, необходимой для прохождения теста.
В компании подчеркнули, что все признаки свидетельствуют о том, что модели были «гиперсосредоточены» на выполнении тестового задания и искали любой способ получить правильный ответ.
ИИ-агенты начали действовать «вслепую» и выполнять опасные команды — исследование 15.05.2026 ЧитатьВ то же время команда безопасности Hugging Face выявила подозрительную активность и смогла остановить
Читать на incrypted.com