Дослідники компанії Adversa AI виявили серйозну вразливість у вебверсії Grok: штучний інтелект здатен виконувати приховані команди, якщо вони зашифровані та розміщені на спеціально підготовленій сторінці. Про це повідомляє Adversa AI.

Як зазначають дослідники, атака базується на методі prompt injection, коли шкідливі інструкції маскуються під звичайний контент для читання або підсумування. Цього разу фахівці застосували шифрування: зловмисник розміщує на сторінці зашифрований текст разом із ключем для розшифрування. Оскільки захисний фільтр Grok не розпізнає в цьому небезпеки, інформація проходить далі, і модель самостійно розшифровує інструкцію та виконує її.

Техніку назвали cryptographic context injection. У ході демонстрації дослідникам вдалося змусити Grok передати з чату користувача такі дані:

  • ім’я
  • приблизне місцезнаходження
  • тип підписки
  • повний список запитів

Ця інформація передавалася через URL як параметри, що створює ризик витоку приватних даних, а не лише обходу захисних фільтрів.

За даними Adversa AI, компанія xAI була поінформована про вразливість ще 3 червня 2026 року через пряме звернення та платформу HackerOne. xAI підтвердила отримання повідомлення, але не повідомила, коли планує усунути проблему. Станом на 19 серпня, за словами дослідників, атака залишалася дієвою на Grok.com. Фахівці також попереджають, що подібні вразливості можуть існувати і в інших AI-системах, хоча конкретний механізм залежить від доступних інструментів.

«Звичайний захисний фільтр може не помітити небезпеку, яка виникає лише після обробки кількох компонентів», — наголошують у Adversa AI.

Редакція підкреслює: випадок із Grok демонструє, що сучасні AI-агенти вже не просто читають текст, а й працюють із кодом, відкривають сторінки та взаємодіють з іншими інструментами. Це означає, що безпека має охоплювати не лише саму модель, а й усе програмне оточення.