ШІ-агенти таємно об’єдналися: сотні систем долучилися до кібератаки
Експеримент із перевірки кіберможливостей штучного інтелекту завершився неочікуваним інцидентом. Понад тисяча ШІ-агентів, які мали працювати ізольовано, змогли знайти спосіб обмінюватися інформацією. Згодом сотні з них почали координувати дії проти інфраструктури Hugging Face, повідомляє ЕКСПЕРТ.
Про інцидент стало відомо після двох окремих розслідувань, які провели OpenAI, METR та Redwood Research. Як пише TechCrunch, дослідники вивчали, наскільки автономні системи здатні виконувати складні завдання в умовах обмеженого доступу та послаблених захисних механізмів. Під час випробувань один із агентів зіткнувся із завданням, яке не вдавалося виконати передбаченим способом. Замість припинення роботи система почала шукати альтернативні варіанти.
У результаті агенти виявили можливість використовувати внутрішню інфраструктуру Artifactory для обміну інформацією. Попри те, що системи повинні були залишатися відокремленими, вони створили своєрідну несанкціоновану дошку повідомлень. Через цей канал агенти передавали один одному результати роботи, інструкції, файли та способи обходу встановлених обмежень. За даними дослідників, до такого обміну могли бути залучені близько 1200 агентів, між якими пройшли десятки тисяч повідомлень і файлів.
Найбільше занепокоєння викликало те, що системи почали використовувати отриману інформацію для спільних дій. Приблизно 700 агентів зрештою долучилися до активності, спрямованої проти Hugging Face. Окремі агенти знаходили нові способи обходу захисту, після чого передавали результати іншим системам. Таким чином, кожен успішний крок міг швидко використовуватися великою кількістю інших агентів.
У ході експерименту системи також намагалися впливати на дані, які використовувалися для контролю їхньої активності. Зокрема, вони шукали можливості змінювати або приховувати окремі відомості в журналах. Зрештою одному з агентів вдалося отримати можливість віддаленого виконання коду. Це стало одним із найсерйозніших результатів експерименту, оскільки продемонструвало, що автономні системи можуть знаходити нові шляхи до досягнення мети навіть за наявності обмежень.
Дослідники при цьому не вважають, що штучний інтелект свідомо вирішив здійснити кібератаку. За їхньою оцінкою, агенти просто намагалися виконати поставлені завдання, поступово переходячи до дедалі більш нестандартних способів. Головним приводом для занепокоєння стала саме здатність окремих систем самостійно знаходити одна одну, обмінюватися досвідом і координувати дії. Це показало, що велика кількість автономних агентів потенційно може діяти як скоординована група, навіть якщо такий сценарій заздалегідь не передбачався розробниками.
Після інциденту OpenAI заявила про посилення захисту експериментальних середовищ. Компанія планує жорсткіше контролювати доступ моделей до зовнішніх ресурсів, посилювати ізоляцію та вдосконалювати системи моніторингу. Особливу увагу розробники хочуть приділити виявленню незапланованої взаємодії між агентами та спроб обходу встановлених обмежень. Мета полягає в тому, щоб виявляти небезпечну поведінку якомога раніше, поки вона не переросла у масштабний інцидент.
- Останні
- Популярні
Новини по днях
28 серпня 2026