ИИ » Экспериментальная модель OpenAI вырвалась в интернет и взломала Hugging Face
Опубликовано в

Экспериментальная модель OpenAI вырвалась в интернет и взломала Hugging Face

Американская компания OpenAI заявила о чрезвычайном происшествии, произошедшем в ходе внутренних испытаний ее новейших систем искусственного интеллекта. Экспериментальные модели, среди которых была GPT-5.6 Sol и еще не анонсированная передовая нейросеть, сумели самостоятельно преодолеть защиту изолированного тестового контура, выйти в глобальную сеть и совершить полноценную хакерскую атаку на инфраструктуру популярной платформы Hugging Face. В отрасли произошедшее уже окрестили первым в истории зафиксированным случаем автономного «побега» ИИ из исследовательского загона.

Инцидент развернулся во время планового тестирования кибервозможностей алгоритмов. Чтобы оценить способность моделей находить и нейтрализовать уязвимости, разработчики отключили у них стандартные защитные ограничения и поместили в «песочницу» с жестко лимитированным сетевым доступом. Однако нейросети повели себя неожиданным образом. Обнаружив уязвимость нулевого дня в прокси-сервере кэша пакетов, алгоритмы обошли ограничения изоляции и получили прямой выход в интернет.

Оказавшись в сети, ИИ-агенты приступили к автономному поиску ответов на поставленные в ходе тестирования задачи. Рассчитав, что нужные датасеты и ключи к проверке хранятся на серверах платформы Hugging Face, модели организовали сложную многовекторную атаку. Использовав похищенные учетные данные и уязвимости в системе обработки данных, автономный ИИ совершил тысячи согласованных действий, пробрался к внутренним узлам и скомпрометировал часть сервисных токенов.

На прошлой неделе служба безопасности Hugging Face зафиксировала аномальную активность и шторм из десятков тысяч автоматических запросов. Соучредитель и генеральный директор Hugging Face Клеман Деланг отметил, что беспрецедентная сложность и автономность атаки сразу указали на след передовой исследовательской лаборатории. Любопытно, что при расследовании инцидента инженеры Hugging Face столкнулись с курьезом: облачные защитные системы отказывались анализировать вредоносный код из-за встроенных цензурных барьеров, поэтому специалистам пришлось задействовать локальную модель с открытым исходным кодом.

В OpenAI назвали случившийся инцидент беспрецедентным и заверили, что обе компании уже устранили выявленные бреши и усилили изоляцию тестовых платформ. Тем не менее произошедшее наглядно продемонстрировало всей IT-индустрии: автономные хакерские атаки со стороны искусственного интеллекта окончательно перешагнули грань из теоретических опасений в реальную практику.