Компания OpenAI столкнулась с беспрецедентным киберинцидентом во время внутренних испытаний своих новых моделей искусственного интеллекта. Как выяснилось, эти модели получили доступ к интернету и атаковали платформу Hugging Face, выявив уязвимости в ее инфраструктуре.
Инцидент произошел во время проверки кибервозможностей моделей, включая GPT-5.6 Sol и еще одну, более мощную версию, которая пока не выпущена. Для оценки их возможностей разработчики временно отключили часть ограничений, препятствующих выполнению потенциально опасных действий.
Модели сначала нашли и объединили несколько уязвимостей в исследовательской инфраструктуре OpenAI, а затем использовали неизвестную ранее уязвимость «нулевого дня» в программном обеспечении. После этого они предположили, что на платформе Hugging Face могут храниться данные, необходимые для прохождения теста ExploitGym, и использовали украденные учетные данные, чтобы получить доступ к закрытой информации.
Подозрительную активность обнаружили специалисты OpenAI, и команда Hugging Face остановила атаку. Компании ведут совместное расследование, и OpenAI сообщила, что усилит защиту своей инфраструктуры и поменяет порядок проведения подобных испытаний.
По мнению экспертов, произошедшее показало, что современные ИИ-модели уже способны самостоятельно искать новые способы взлома реальных компьютерных систем без доступа к их исходному коду. OpenAI создала чат-бот ChatGPT и семейство языковых моделей GPT, и компания продолжает работать над улучшением защиты своих моделей.
В июне OpenAI выпустила новейшие версии своего чат-бота GPT-5.6 Sol, Terra и Luna для ограниченного круга пользователей по просьбе правительства США. В компании пояснили, что новые модели обладают «самыми надежными средствами защиты на сегодняшний день». Кроме того, компания представила свое первое устройство — компактную клавиатуру Codex Micro, позиционируемую как «командный центр» для работы с ИИ-агентами.