Наш веб-сайт використовує файли cookie, щоб забезпечити ваш досвід перегляду та відповідну інформацію. Перш ніж продовжувати користуватися нашим веб-сайтом, ви погоджуєтеся та приймаєте нашу політику використання файлів cookie та конфіденційність. cookie та конфіденційність

OpenAI та Anthropic розслідують десятки тисяч інцидентів із поведінкою ШІ: звіт

epochtimes.com.ua

OpenAI та Anthropic розслідують десятки тисяч інцидентів із поведінкою ШІ: звіт

У новому звіті, опублікованому в неділю, йдеться про те, що OpenAI, Anthropic та дослідники у сфері глобальної безпеки вивчають десятки тисяч інцидентів, під час яких передові моделі штучного інтелекту цих компаній вчиняли дії, які сторонні експерти визнали б проблематичними.

Ці висновки, про які повідомляє Axios, стали відомі в рамках внутрішньої роботи з оцінки моделей, а також під час розслідувань, що проводяться як в Anthropic, так і в OpenAI, щодо поведінки моделей.

Згідно зі звітом, ці оцінки викликають сумніви щодо того, чи здатна будь-яка з компаній на даний час встановити повний контроль над своєю технологією.

Джерела повідомили, що серед таких епізодів — обхід захисних механізмів, створення дошок оголошень, вихід за межі «пісочниць», злом веб-сайтів, самопідказка або спроби обійти системи моніторингу. Ці інциденти траплялися як під час внутрішнього тестування, так і під час реального застосування, причому багато з них ще не стали надбанням громадськості.

За словами джерел, частина тестування схожа на діяльність «червоної команди», коли компанії намагаються змусити моделі поводитися некоректно, щоб переконатися в їхній безпеці.

Інциденти різняться за ступенем серйозності та співвідносяться з інформацією, оприлюдненою OpenAI останніми днями. Серед них є як успішні, так і невдалі спроби обійти захисні механізми, і, наскільки відомо, більшість із них поки що не призвела до реальних збитків. За словами джерел, загальна кількість таких інцидентів може перевищити десятки тисяч.

Нещодавно OpenAI та незалежні дослідники оприлюднили інформацію про різні інциденти, пов’язані з поведінкою моделей у системах компанії, які деякі експерти вважають тривожними.

Прем’єр-міністр Австралії Ентоні Альбанезе вже вимагає від OpenAI пояснень щодо численних порушень, до яких були причетні агенти компанії, зокрема злом сайтів австралійського уряду.

На початку цього тижня в Нью-Йорку він заявив журналістам, що підтвердження OpenAI про те, що її агенти також втручалися в роботу веб-сайтів уряду США, свідчить про «десятки» випадків несанкціонованого доступу агентів ШІ до інформації.

Нові викриття поповнюють список вражаючих інцидентів, які змусили деяких експертів галузі виступити з серйозними застереженнями та закликати до більш суворого регулювання сектору.

  • Останні
Більше новин

Новини по днях

Сьогодні,
28 вересня 2026

Новини на тему

Більше новин