OpenAI: ШІ-агенти скоро керуватимуть комп’ютерами як люди
OpenAI наближається до реалізації своєї давньої мети: створення ШІ-агентів, здатних так само вправно керувати комп’ютерами, як і люди, особливо в роботі з браузерами. Ця амбітна задача, поставлена ще у 2015 році, потребувала подолання значних викликів, зокрема, отримання достатньої кількості навчальних даних. Проте, після років розробки, компанія впевнена у своїх силах і планує поступово надавати доступ до цієї функції своїм клієнтам.
Арі Вайнштейн, менеджер команди комп’ютерного керування OpenAI, вважає, що коли ChatGPT зможе працювати з комп’ютерами та програмами швидше за нас, це докорінно змінить спосіб нашої взаємодії з технікою. Новітні моделі OpenAI пройшли спеціалізоване навчання, яке включає дані та тренувальні процеси, спрямовані на вдосконалення навичок комп’ютерного керування. Це навчання базується на вже існуючих можливостях загальних ШІ-моделей, доповнюючи їх здатністю виконувати ширший спектр комп’ютерних завдань.
Для досягнення таких результатів OpenAI використовує кілька передових методик:
OpenAI також оптимізувала спосіб отримання інформації моделями під час взаємодії з комп’ютером. Замість багаторазового аналізу знімків екрану, система тепер може безпосередньо зчитувати базову інформацію веб-сторінок, включаючи структуру пам’яті, доступність елементів та зв’язки між посиланнями. Хоча знімки екрану все ще використовуються для розпізнавання поточного відображення, інтеграція цих можливостей дозволяє ШІ ефективніше тестувати та виправляти згенерований код, створюючи замкнений цикл розробки.
Комп’ютерні операційні можливості відкривають ChatGPT доступ до величезної кількості незалежних онлайн-сервісів та «довгохвостих» веб-сайтів. Це включає такі інструменти, як системи бронювання, внутрішні корпоративні системи обліку та соціальні мережі, які були розроблені для ручного керування. Користувачі вже застосовують цю функцію для автоматизації введення даних, виконання завдань, пов’язаних з дотриманням нормативних вимог, та планування розкладу.
Важливою перевагою є зростаюча здатність моделей OpenAI самостійно виявляти та виправляти помилки, що підвищує надійність виконання завдань та зменшує ризик відволікання на нерелевантний контент у мережі.
Незважаючи на значний прогрес, швидкість роботи комп’ютерних операцій все ще поступається очікуванням споживачів. У обмежених сферах з достатньою кількістю навчальних даних ШІ-агенти демонструють хороші результати, але адаптація до будь-якого веб-сайту, програми чи операційної системи залишається складним завданням. Поточні обмеження включають повільну обробку електронних листів у великих обсягах та сповільнену навігацію в стрічках соціальних мереж.
OpenAI прагне до того, щоб з часом комп’ютерні операції досягли рівня ефективності, подібного до сучасного програмування ШІ, коли програмне забезпечення генерується штучним інтелектом. Як зазначає Джеймс Сун, для багатьох інженерів вже зараз швидше отримати код від ШІ, ніж написати його самостійно. Очікується, що комп’ютерні операції згодом досягнуть аналогічного стану.
Зі зростанням можливостей ШІ зростають і потенційні ризики. OpenAI усвідомлює це і зосереджується на розробці «стратегій підтвердження», визначаючи, коли саме ШІ має запитувати дозвіл користувача перед виконанням наступної дії. Основним принципом є вимога згоди перед передачею або видаленням даних. Пошук балансу між зручністю використання та безпекою залишається ключовим викликом. Компанія прагне створити продукти, які будуть одночасно корисними та безпечними, уникаючи крайнощів 100% безпеки, що робить продукт складним у використанні, або надмірної простоти, що створює небезпеку.
Джерело: https://www.ithome.com/0/992/339.htm
- Останні
- Популярні
Новини по днях
20 серпня 2026