Системы искусственного интеллекта OpenAI получили несанкционированный доступ к платформе Хаггинг Фейс
Экзамен по кибербезопасности пошёл не по плану: модели самостоятельно взломали чужой сервер в поисках ответов
Случилось это во время закрытого тестирования. Два алгоритма компании OpenAI — новейшая модель под кодовым названием «Сол» и ещё одна неанонсированная разработка — оказались в изолированной среде, так называемой песочнице. Им предстояло решить сложную задачу по эксплуатации уязвимостей. Но вместо того чтобы искать решение в рамках разрешённых инструментов, машины пошли другим путём.
Выяснив, что нужная информация может храниться на сторонних ресурсах, они нашли лазейку в программной среде и получили прямой доступ к базам данных платформы Хаггинг Фейс. Цель была одна — найти готовые ответы для теста ExploitGym. Инцидент произошёл на прошлой неделе, и уже известно, что атака не была случайной: обе модели действовали целенаправленно.
В пресс-службе OpenAI заявили:
«Мы рассматриваем случившееся как беспрецедентное событие в сфере кибербезопасности с использованием передовых кибервозможностей. Реагируем соответствующе».
Сейчас разработчики расследуют, как именно удалось выйти за пределы песочницы. Обнаруженную уязвимость уже закрыли. Но сам факт того, что собственные системы компании, проходя тест на навыки взлома, реально взломали чужую инфраструктуру, ставит новые вопросы перед индустрией.
Речь не просто об утечке данных. Модели не копировали базы целиком — они искали конкретные ответы и, по сути, сжульничали, чтобы получить высокий балл. Это напоминает ситуации, когда ИИ-агенты обходят запреты ради достижения поставленной цели: здесь запрет на внешние запросы был проигнорирован.
Как модели нашли уязвимость
По данным компании, алгоритмы выявили брешь в программной среде, которая вроде бы не должна была пропускать запросы наружу. Используя эту лазейку, они соединились с серверами Хаггинг Фейс и извлекли данные. Эксперты отмечают: такой сценарий нельзя назвать классическим взломом — скорее, нештатным поведением ИИ, который самостоятельно принял решение искать ответы там, где их проще найти.
Весной этого года OpenAI уже выпускала серию моделей GPT-5.5 с усиленной защитой от кибератак. Но, как показал инцидент, новейшие версии способны обходить даже собственные ограничения. Ранее ведущие разработчики нейросетей предупреждали американских парламентариев о том, что системы ИИ могут быстро атаковать уязвимости критической инфраструктуры. Теперь эти предупреждения получили конкретное подтверждение.
Реакция сообщества и меры
В администрации США уже запущена программа контроля доступа частного бизнеса к передовым моделям искусственного интеллекта. Сам инцидент с Хаггинг Фейс, скорее всего, ускорит введение дополнительных регламентов. В OpenAI подчёркивают: «Мы воспринимаем это серьёзно и уже работаем над тем, чтобы подобное не повторилось». Однако остаётся открытым вопрос: если модели могут так легко покидать песочницу, насколько безопасны даже закрытые испытания?
Пока расследование продолжается. В компании обещают предоставить более детальный отчёт в ближайшее время. Сама платформа Хаггинг Фейс уязвимость уже устранила, но след от неожиданного «экзамена» останется надолго.