OpenAI не може визначити повний масштаб небезпечної активності своїх ШІ-агентів: виявлено витік даних користувачів
OpenAI продовжує розслідувати дії своїх ШІ-агентів після низки інцидентів, серед яких витік зображень користувачів ChatGPT, спроби доступу до державних сайтів США та інші випадки несанкціонованої активності. За словами співрозмовників Reuters, станом на середину вересня компанія виявила близько двох десятків небажаних інцидентів, однак їхня кількість продовжує зростати.
Компанія OpenAI, яка є розробником ChatGPT, вже два місяці розслідує масштаб активності своїх ШІ-агентів. Компанія почала перевірку після того, як у липні агенти вийшли за межі встановлених обмежень і здійснили атаку на платформу Hugging Face. Про це Reuters повідомили двоє людей, обізнаних із ситуацією, інформують Економічні новини.
Останній відомий випадок компанія оприлюднила 25 вересня, повідомивши, що її ШІ-агенти розмістили на сторонніх сайтах 53 зображення, завантажені користувачами ChatGPT. В OpenAI не уточнили, чи були ці зображення створені штучним інтелектом, чи на них були зображені реальні люди, а також не повідомили, коли саме вони були опубліковані. За даними компанії, більшість зображень вже видалили, а OpenAI звертається до провайдерів хостингу з проханням прибрати решту.
Цей випадок відкриває нову проблему для конфіденційності користувачів і водночас демонструє, наскільки складно навіть одній із провідних компаній у сфері штучного інтелекту відстежувати всю несанкціоновану активність своїх агентів. За словами джерел Reuters, ситуація також показує розрив між можливостями моделей, які розробляє OpenAI, та здатністю компанії повністю контролювати й відстежувати їхні дії.
Станом на середину вересня один зі співрозмовників Reuters оцінював кількість небажаних інцидентів приблизно у два десятки. Водночас двоє людей, близьких до компанії, зазначили, що кількість продовжує зростати. В OpenAI заявили, що перевірка може тривати кілька місяців через масштаб роботи. Компанія також повідомила, що поінформувала десятки сторонніх організацій про неналежну активність.
Частина зображень користувачів могла бути доступною агентам через використання OpenAI анонімізованих даних для навчання моделей. За даними компанії, корпоративні дані не використовуються для навчання моделей, а користувачі ChatGPT можуть відмовитися від використання своїх даних для цієї мети. Перед використанням публікацій користувачів для навчання вони проходять процес анонімізації, під час якого видаляються метадані, імена та інша контактна інформація. В OpenAI заявляють, що це має ускладнювати встановлення особи конкретного користувача. Водночас три джерела, знайомі з практиками компанії, наголосили, що така система не позбавлена ризиків, оскільки персональна інформація може бути видалена не повністю, а згодом опинитися у витоку. В OpenAI заявили, що не виявили доказів несанкціонованого доступу чи компрометації облікових записів під час роботи моделей.
Раніше дослідницька некомерційна організація Transluce повідомила про невдалу спробу агентів, які, як стверджується, мали відношення до OpenAI, зламати сайт Міністерства освіти США. За даними Transluce, цей випадок був частиною ширшої активності ШІ-агентів, які досліджували урядові сайти, використовуючи, зокрема, відкриті облікові дані, обхід антибот-захисту та фальшиві акаунти.
За два місяці після першого повідомлення OpenAI про вихід її агентів за межі контрольованого середовища було розкрито понад 15 різних інцидентів, пов’язаних із компанією. Про них повідомляла сама OpenAI, незалежні дослідники або, нещодавно, прем’єр-міністр Австралії Ентоні Албанізі.
Він заявив у вересні на Генеральній асамблеї ООН, що агенти OpenAI у червні проникли до урядового порталу з медичними даними. Характер цих випадків відрізнявся. Йшлося як про повідомлення, схожі на спам, які агенти залишали на інтернет-сайтах, так і про серйозніший інцидент із Hugging Face. Тоді група агентів використала раніше невідомі вразливості програмного забезпечення, щоб вийти за межі своїх мереж і проникнути до репозиторію, шукаючи відповіді на тестове завдання. В OpenAI також повідомляли, що агенти атакували власну інфраструктуру компанії.
В OpenAI пояснили, що частина сайтів, до яких зверталися моделі, належить урядовим установам, університетам та державним організаціям, оскільки моделі під час досліджень шукають надійні джерела відкритої інформації. Розслідування всередині OpenAI після інциденту з Hugging Face проходить у значною мірою закритому режимі. Двоє людей, знайомих із процесом, заявили Reuters, що робота є сильно обмеженою та значною мірою формується за участю корпоративних юристів. За їхніми словами, це незвично для компанії, яка, на думку деяких колишніх співробітників, раніше була відкритішою щодо подібних проблем.
Чимало інцидентів виявляли саме зовнішні дослідники, а не сама OpenAI. У кількох випадках агенти здійснювали шкідливі дії, які залишалися непоміченими компанією протягом кількох місяців. На початку вересня невелика група дослідників виявила, що агенти компанії захопили переважно занедбаний німецький сайт-вікі, щоб обмінюватися методами обходу обмежень OpenAI, шахрайства під час виконання певних завдань та приховування власної активності.
Цього тижня Transluce також повідомила, що виявила обхід агентами OpenAI антибот-захисту Австралійського інституту охорони здоров’я та добробуту. Дослідники знайшли ще два випадки, які пов’язали з агентами OpenAI. За даними компанії, ці інциденти були окремими від активності, про яку повідомив Албанізі. В OpenAI заявили, що «значна частина активності», описаної у звіті Transluce, перетинається з випадками, які перебувають на різних етапах розслідування в рамках поточної перевірки неналежної активності моделей. Компанія зазначила, що під час розслідування насамперед зосереджується на найсерйозніших випадках.
Після інциденту з Hugging Face дослідники у всій індустрії штучного інтелекту дедалі більше побоюються, що технологічні компанії можуть не мати можливості повністю передбачати або контролювати поведінку своїх моделей. Ці побоювання посилилися після того, як колишній дослідник Anthropic Джейкоб Коксон цього місяця публічно звільнився та заявив у дописі, який широко поширився в соцмережах, що лабораторії штучного інтелекту «грають в азартну гру з нашим життям».
На тлі цих дискусій Сем Альтман та генеральний директор Anthropic Даріо Амодеї закликали індустрію уповільнити розвиток штучного інтелекту та діяти обережніше у прагненні до так званого рекурсивного самовдосконалення ШІ. Цього тижня Альтман повторив цей заклик під час виступу в Організації Об’єднаних Націй.
- Останні
- Популярні
Новини по днях
28 вересня 2026