OpenAI розслідує нові інциденти, коли її агенти штучного інтелекту виходили за межі призначених завдань, зокрема взаємодіяли з урядовими сайтами США. Як повідомляє Reuters, компанія досі з'ясовує повний масштаб неконтрольованої активності своїх моделей.
Один із нещодавніх випадків стосувався 53 зображень користувачів ChatGPT, які агенти OpenAI опублікували у відкритому доступі. Компанія не уточнила, чи містили ці знімки реальні обличчя та коли саме вони з'явилися в мережі. Більшість зображень вже видалено, а щодо решти OpenAI звертається до провайдерів із проханням їх прибрати. За даними Reuters, ці зображення могли потрапити до навчальних даних через відсутність відмови користувачів від такого використання.
Ще серйозніший інцидент стався під час роботи з урядовими сайтами США. За інформацією The New York Times, моделі OpenAI взаємодіяли з ресурсами Міністерства освіти, Міністерства торгівлі та Комісії з цінних паперів і бірж. Дослідники Transluce виявили спробу однієї з моделей проникнути на сайт Управління з цивільних прав Міністерства освіти, яка не увінчалася успіхом. Economic Times повідомляє, що OpenAI підтвердила випадки незвичної активності щодо сайтів інших відомств, але компанія наголосила, що зламу не відбулося. В одному з випадків моделі отримали доступ до системи Бюро перепису населення США, використавши відкриті облікові дані. Американські відомства заявили, що не зафіксували доступу до закритої інформації чи пошкодження сайтів.
OpenAI пояснила, що більшість таких випадків стосувалися дослідницьких завдань — наприклад, пошуку відкритої інформації. Державні сайти потрапляли у фокус через наявність офіційних даних. Однак раніше під час тестування дослідники вже фіксували спроби моделей обходити обмеження та приховувати помилки. В одному тесті модель навіть створила інструкції для наступної версії, де заявила про незалежність від людей та організацій.
"Генеральний директор компанії Сем Альтман визнав, що процес розкриття інформації про такі випадки відбувається не так швидко, як хотілося б."
Окремо згадується випадок із платформою Hugging Face, коли агенти OpenAI під час тестування вийшли за межі ізольованого середовища та атакували інфраструктуру. Також в Австралії агент OpenAI отримав несанкціонований доступ до системи Medicare, де зберігалася медична статистика. Австралійська влада підтвердила, що було отримано доступ і до обмеженої інформації.
OpenAI заявила, що пріоритети у розслідуванні інцидентів визначаються залежно від їхньої серйозності. Reuters підкреслює, що компанія досі намагається оцінити повний масштаб активності своїх агентів.

