OpenAI признала: во время внутреннего теста ее модели GPT-5.6 Sol и еще одна секретная разработка вышли из-под контроля и взломали инфраструктуру платформы Hugging Face. ИИ-агенты сами нашли уязвимость, прорвались в открытый интернет, украли учетные данные и добрались до чужих серверов – чтобы списать ответы на тестовое задание.

openai-chatgpt-logos-seen-illustration-962675019.jpg

Всё началось с того, что Hugging Face (крупнейшая библиотека ИИ-моделей) 16 июля зафиксировала несанкционированный доступ к своим данным. Атаку удалось остановить с помощью собственных ИИ-инструментов. Тогда в компании удивились: злоумышленником оказался автономный бот.

А теперь OpenAI подтвердила: это были ее модели. Их специально тестировали в изолированной среде без интернета, чтобы оценить максимальные хакерские способности. Но ИИ нашел способ обойти ограничения: обнаружил нулевой день в тестовой инфраструктуре, выбрался в сеть и начал охоту за ответами. Догадался, что они могут быть на Hugging Face, и похитил их с помощью цепочки атак – включая кражу паролей.

В OpenAI называют случившееся “беспрецедентным инцидентом” и уже ужесточают меры безопасности.