OpenAI анонсувала впровадження нової системи безпеки Private Safety Processing, яка має запобігти зловживанням під час використання ChatGPT. Перший етап тестування вже розпочався серед обмеженого кола партнерів, а повноцінний запуск заплановано на вересень, повідомляє rbc.ua.

Наразі корпоративні клієнти OpenAI отримують гарантію, що їхні запити та відповіді не зберігаються після обробки, а співробітники компанії не мають до них доступу. Однак чинні автоматизовані інструменти безпеки оцінюють кожне повідомлення окремо, що не завжди дозволяє виявити складні або скоординовані зловмисні дії.

Зі зростанням складності завдань, які виконують системи штучного інтелекту, ризиковану поведінку часто можна розпізнати лише за низкою пов’язаних запитів. Наприклад, коли порушники поступово обходять захисні механізми, координують дії через кілька акаунтів або коли автономний агент продовжує виконувати дії після команди зупинитися.

Private Safety Processing дозволяє виявляти підозрілі патерни без втрати конфіденційності. Дані користувачів зберігаються або на їхній власній інфраструктурі, або на серверах OpenAI у зашифрованому вигляді, а ключі шифрування контролює виключно клієнт. У разі виявлення ризикованої поведінки система надсилає лише вузькоспеціалізований сигнал про тип порушення — співробітники OpenAI не отримують доступу до текстів навіть після спрацювання сигналу.

«Клієнти можуть самостійно провести розслідування у журналах подій і за бажання надати фрагменти даних для апеляції», — йдеться у повідомленні OpenAI.

Система наразі тестується у партнерстві з Microsoft, Glean, Databricks та Abridge. Розробники підкреслюють, що оновлення насамперед орієнтоване на організації, які працюють із фінансовими, медичними та іншими чутливими даними. Детальний технічний документ обіцяють оприлюднити разом із запуском нової системи у вересні.