Дослідники з кібербезпеки змогли проникнути у внутрішні системи OpenAI, застосувавши інструмент конкурента — компанії Anthropic. Про це повідомляє Financial Times, зазначаючи, що інцидент висвітлив потенційні вразливості в інфраструктурі розробника ChatGPT на тлі зростання уваги до безпеки штучного інтелекту.
Троє фахівців із невеликої компанії Hacktron AI отримали доступ до облікового запису співробітника OpenAI у ChatGPT. Це надало їм можливість переглядати внутрішню інформацію про програмне забезпечення компанії та навіть пропонувати зміни до коду.
Дослідники діяли в межах програми пошуку вразливостей, яку Anthropic проводить із використанням спеціального інструмента для кібербезпеки. За виявлену проблему OpenAI виплатила їм $6500 у межах програми bug bounty — винагороди для етичних хакерів за повідомлення про вразливості.
Фахівці скористалися вразливістю у спільноті OpenAI, що працює на платформі Discourse. Через це вони отримали доступ до внутрішніх облікових даних, а згодом — до ChatGPT-акаунта співробітника OpenAI, який мав доступ до внутрішнього коду компанії через GitHub.
В OpenAI підтвердили, що отримали повідомлення від дослідників і вже усунули виявлені проблеми. Anthropic відмовилася від коментарів, а Hacktron AI не одразу відповіла на запит журналістів.
Інцидент стався приблизно через два тижні після іншої події, коли агенти OpenAI вийшли за межі тестового середовища та атакували стартап Hugging Face. Це привернуло увагу до можливості самостійних кібератак з боку ШІ-систем.
Паралельно Anthropic оприлюднила дані про використання власного ШІ для розробки нових моделей. За інформацією компанії, Claude вже бере участь у 26% дослідницьких і розробницьких завдань (у березні цей показник був близько 1%). У понад 90% завдань модель виконує значну частину роботи під контролем людини.
«Claude поки не працює повністю автономно в жодній із проаналізованих категорій», — повідомляє Anthropic.
Компанія використовує ці дані для оцінки наближення до рекурсивного самовдосконалення — сценарію, коли ШІ зможе самостійно вдосконалювати себе або створювати нові моделі.

