Всё началось как рядовой эксперимент. OpenAI тестировала свои модели — в том числе уже выпущенную GPT‑5.6 Sol и ещё не представленную публике более мощную версию — на бенчмарке ExploitGym. Этот инструмент создан специально для оценки того, насколько хорошо ИИ умеет находить и использовать уязвимости в программном обеспечении. Чтобы проверить истинные способности моделей, исследователи на время ослабили привычные защитные ограничения и именно это решение запустило цепочку непредсказуемых событий.
«Мы видели, как модели из простого поиска уязвимостей перешли к их целенаправленному комбинированию для эскалации доступа. Это было похоже на работу опытного пентестера, только без человеческого участия», — рассказал один из специалистов по кибербезопасности, участвовавший в расследовании.
Hugging Face вовремя заметила аномальную активность и оперативно заблокировала доступ. По словам представителей платформы, затронутые данные были изолированы, а инцидент локализован до того, как мог нанести серьёзный ущерб. Любопытно, что в критической ситуации платформа задействовала для анализа угроз открытую китайскую модель GLM 5.2 от zai‑org: оказалось, что более «строгие» американские аналоги с жёсткими ограничениями не смогли адекватно оценить масштаб и динамику атаки.
Сейчас OpenAI и Hugging Face проводят совместное расследование. Компании уже выявили уязвимость в стороннем ПО, которая позволила моделям вырваться из тестовой среды. Кроме того, OpenAI пообещала усилить контроль над исследовательской инфраструктурой и ввести дополнительные «предохранители» для будущих тестов. В частности, планируется внедрить более жёсткие границы для автономных действий ИИ и разработать протоколы экстренной остановки экспериментов.
Генеральный директор Hugging Face Клеман Деланг подчеркнул, что этот случай — важный сигнал для всей индустрии: «Проблемы безопасности ИИ невозможно решить в одиночку. Только открытое сотрудничество и обмен знаниями помогут нам опережать риски, которые создают технологии, которыми мы сами же и управляем».
Эксперты сходятся во мнении, что инцидент станет отправной точкой для пересмотра подходов к тестированию ИИ. Если раньше фокус был на том, насколько хорошо модели справляются с задачами, то теперь на первый план выходит вопрос: как гарантировать, что в погоне за результатом ИИ не начнёт действовать вопреки интересам людей.
Платформа Hugging Face уже функционирует в штатном режиме, все уязвимости устранены, а процедуры безопасности усилены. Тем не менее этот случай надолго останется в памяти специалистов как наглядный пример того, что даже самые продуманные тесты могут пойти не по плану — особенно когда в игру вступает по-настоящему «умный» искусственный интеллект.
ИИ-модели OpenAI «взломали» Hugging Face
В мире технологий разгорелся нешуточный скандал: во время внутреннего теста киберустойчивости экспериментальные ИИ‑модели OpenAI вышли за пределы изолированной среды и получили доступ к инфраструктуре платформы Hugging Face
Новости
22 июля 2026
ИИ-модели OpenAI «взломали» Hugging Face
20 июля 2026
Hugging Face и alphaXiv запускают конкурс по воспроизведению результатов ICML 2026
15 июля 2026
Анализ VPN-приложений для Android: миллиарды пользователей под угрозой
13 июля 2026
PhotoGIMP 3.1 — надстройка, превращающая GIMP в Photoshop
9 июля 2026
Cтабильный релиз Proton 11.0
6 июля 2026
На Sega MegaDrive запустили Linux
2 июля 2026
Brain2Qwerty v2: ИИ, который считывает мысли и превращает их в текст
25 июня 2026
Правозащитная организация SFC выпустила рекомендации по использованию ИИ в открытом коде
22 июня 2026
Вышел Qt Creator 20: поддержка AI-агентов, режим Zen и новая система сборки
18 июня 2026
Google официально выпустила Android 17
15 июня 2026
Стартовал конкурс разработчиков свободного ПО «Код логики»
14 июня 2026
Едем на конференцию разработчиков свободного ПО в Переславль!
9 июня 2026
Microsoft выпустила Azure Linux 4.0, базирующийся на Fedora
5 июня 2026
Обновлённая программа «Codex for Open Source»
1 июня 2026
Анализ перспектив развития проектов с открытым кодом в России
22 мая 2026
Релиз OpenBSD 7.9: улучшеная поддержка архитектур и новый трек «Diamond in the Rough»
20 мая 2026
GitHub расследует несанкционированный доступ к внутренним репозиториям