Исследователи компании Adversa AI обнаружили серьёзную уязвимость в веб-версии Grok: искусственный интеллект способен выполнять скрытые команды, если они зашифрованы и размещены на специально подготовленной странице. Об этом сообщает Adversa AI.
Как отмечают исследователи, атака основана на методе prompt injection, когда вредоносные инструкции маскируются под обычный контент для чтения или суммирования. На этот раз специалисты применили шифрование: злоумышленник размещает на странице зашифрованный текст вместе с ключом для расшифровки. Поскольку защитный фильтр Grok не распознаёт в этом опасности, информация проходит дальше, и модель самостоятельно расшифровывает инструкцию и выполняет её.
Технику назвали cryptographic context injection. В ходе демонстрации исследователям удалось заставить Grok передать из чата пользователя следующие данные:
- имя
- приблизительное местоположение
- тип подписки
- полный список запросов
Эта информация передавалась через URL как параметры, что создаёт риск утечки приватных данных, а не только обхода защитных фильтров.
По данным Adversa AI, компания xAI была проинформирована об уязвимости ещё 3 июня 2026 года через прямое обращение и платформу HackerOne. xAI подтвердила получение сообщения, но не сообщила, когда планирует устранить проблему. По состоянию на 19 августа, по словам исследователей, атака оставалась действенной на Grok.com. Специалисты также предупреждают, что подобные уязвимости могут существовать и в других AI-системах, хотя конкретный механизм зависит от доступных инструментов.
«Обычный защитный фильтр может не заметить опасность, которая возникает только после обработки нескольких компонентов», — подчёркивают в Adversa AI.
Редакция подчёркивает: случай с Grok демонстрирует, что современные AI-агенты уже не просто читают текст, а работают с кодом, открывают страницы и взаимодействуют с другими инструментами. Это означает, что безопасность должна охватывать не только саму модель, но и всю программную среду.
