Починаючи з квітня, моделі штучного інтелекту від OpenAI та Anthropic, створені для проведення хакерських атак, вийшли за межі корпоративних тестових середовищ і проникли в реальні системи компаній у межах безпрецедентної серії кібератак.

Жодна з компаній не помітила ці “втечі” до минулого тижня, коли OpenAI повідомила про кібератаку на компанію Hugging Face, що спеціалізується на ШІ, яка сталася в липні. Після перевірки власних випробувань Anthropic заявила про виявлення трьох випадків подібних хакерських атак, пише The Wall Street Journal.

Ці інциденти викликали занепокоєння серед законодавців і співробітників лабораторій штучного інтелекту. Генеральний директор OpenAI Сем Альтман назвав цей випадок “кіберінцидентом, який нагадує наукову фантастику” і зазначив: “Це перший інцидент з безпекою, який я відчув дуже гостро”.

Для експертів із кібербезпеки це свідчить про зростання можливостей зловмисників і підтверджує побоювання, що системи штучного інтелекту можуть завдавати реальної шкоди та ухилятися від контролю. Виконавчий директор некомерційної лабораторії Palisade Research Джеффрі Ладіш зауважив: “Це трохи підбадьорює — бачити, як усе відбувається в реальних умовах”.

Адміністрація президента США Дональда Трампа завершила розробку рамок, які визначають, які моделі ШІ підлягатимуть перевірці федерального уряду перед публічним випуском. За словами представника Білого дому, тривають обговорення з компаніями щодо добровільного тестування.

У грудні минулого року дослідники Стенфордського університету продемонстрували, що моделі ШІ досягають рівня хакерської майстерності, близького до людського, у реальних мережах. Тоді результати викликали критику професійних хакерів, які працюють на корпорації. Один із дослідників проєкту Донован Джаспер вважає, що відкриття OpenAI та Anthropic підтверджують їхні попередні дослідження: “Штучний інтелект стає справді вправним у таких речах”.

Компанія Hugging Face виявилася не готовою до кібератаки моделей OpenAI. Вона намагалася використати модель Claude від Anthropic для аналізу даних, але отримала відмову через міркування безпеки. Замість цього Hugging Face застосувала моделі з відкритими вагами, які можна запускати на системах під контролем користувачів.

За словами власника консалтингової фірми R10N Security Раяна Макгіхана, багато компаній не мають належних інструментів для аналізу атак із застосуванням ШІ. Він підкреслив, що “традиційні команди з безпеки, які не орієнтовані на штучний інтелект, залишаться позаду”. Макгіхан додав, що хакерські атаки агентного ШІ “діють глибше, охоплюють ширше коло, діють складніше та інтенсивніше”.

Ці інциденти посилюють тиск на адміністрацію Трампа щодо необхідності додаткових заходів безпеки у сфері штучного інтелекту. Президент намагається знайти баланс між мінімізацією ризиків і підтримкою конкуренції з китайськими компаніями, які швидко розвиваються. “Ми маємо бути обережними в обох напрямках. Ми не хочемо їх обмежувати, щоб раптом не опинитися на другому місці після Китаю”, — зазначив він.

Головний науковий співробітник Kurzweil Technologies Джон-Кларк Левін прогнозує, що найближчими місяцями подібних інцидентів стане більше, що приверне увагу законодавців і користувачів до безпеки ШІ. Він наголосив на важливості обов’язкових заходів безпеки, а не добровільних, як це пропонує адміністрація Трампа: “Ми не хочемо опинитися в ситуації, коли будемо залежати від того, чи вирішать компанії чинити правильно з доброї волі”.