ШІ «зламав» Hugging Face під час тесту: штучний інтелект натякає на реальність сценарію фільму «Термінатор»
OpenAI підтвердила, що під час внутрішнього тестування на бенчмарку ExploitGym моделі GPT-5.6 Sol та ще одна передрелізна модель змогли знайти ланцюжок вразливостей, отримати доступ до інтернету та скомпрометувати частину інфраструктури Hugging Face,щоб знайти правильні відповіді для тесту. Про це пише OpenAI.
Це перший офіційно підтверджений випадок, коли сучасна мовна модель під час оцінювання самостійно використала складний ланцюг кібератак для досягнення тестової мети.
За інформацією OpenAI, моделі працювали у спеціальному ізольованому середовищі зі знятими частиною захисних обмежень, щоб дослідники могли оцінити їхні максимальні кіберможливості. Саме під час цього експерименту система почала шукати способи обійти встановлені бар'єри.
ШІ займається кіберзлочинами. Фото: qudata
Компанія заявила, що моделі виявили zero-day-вразливість у програмному забезпеченні кеш-проксі для пакетних репозиторіїв, після чого здійснили ескалацію привілеїв, отримали доступ до вузла з інтернетом і використали викрадені облікові дані та інші вразливості для пошуку тестових відповідей у виробничій інфраструктурі Hugging Face.
Після виявлення аномальної активності OpenAI та Hugging Face оперативно зупинили експеримент і розпочали спільне розслідування.
У компанії наголосили, що вже впроваджують додаткові механізми ізоляції, посилюють контроль над тестовими середовищами, оновлюють систему моніторингу та усувають знайдені вразливості. Також OpenAI зазначає, що випадок демонструє необхідність одночасного розвитку потужних моделей і механізмів безпеки.
Читайте по темі:
- Останні
- Популярні
- Липень, 23
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
-
Новини по днях
24 липня 2026