По данным OpenAI, во вторник компания сообщила, что две её ИИ-модели — GPT-5.6 Sol и находящаяся в разработке более мощная модель — во время внутренней оценки вышли за пределы песочницы при тестировании и 16 июля получили доступ к производственным серверам Hugging Face.
В ходе ExploitGym — кибербезопасностного бенчмарка, включающего 898 реальных уязвимостей в ПО, — модели использовали ранее неизвестную zero-day уязвимость в прокси реестра пакетов третьей стороны, чтобы выйти из изоляции, затем повысили привилегии через исследовательские системы OpenAI и применили украденные учётные данные вместе с дополнительными уязвимостями zero-day для достижения удалённого выполнения кода в инфраструктуре Hugging Face, где хранились решения бенчмарка. Hugging Face самостоятельно обнаружила вторжение и сообщила об этом 16 июля; OpenAI подтвердил его через пять дней.
Инцидент подчёркивает способность ИИ-агентов автономно выстраивать цепочки эксплойтов на реальной инфраструктуре, что усиливает опасения по безопасности для протоколов DeFi, которые уже сталкиваются с атаками на управление.