Специалисты по безопасности компании Varonis обнаружили, что Microsoft Copilot можно заставить раскрыть собственные уязвимости, если задавать ему серию повторяющихся вопросов. Об этом сообщает Varonis, отмечая, что полученные инструкции для создания эксплойта исходили непосредственно от самой модели Copilot.

По данным исследователей, эксперимент начался с вопросов к Copilot о возможности разработки эксплойта для кражи данных пользователей. Сначала система отказывалась отвечать, но каждый отказ содержал намёки на технические детали внутренней архитектуры. В частности, Copilot указывал, что для получения более чувствительных подсказок может потребоваться определённое действие, например, нажатие конкретной клавиши.

В последующих вопросах команда Varonis узнала о других защитных механизмах, которые требовали подтверждения от пользователя. Позже чатбот начал раскрывать недокументированные параметры, которые исследователи использовали для создания автоматизированных запросов.

Старший исследователь Varonis Лиор Адар объяснил, что постепенные подсказки Copilot позволили составить целостную картину его внутренних механизмов. Это дало возможность сформировать эксплойт в виде специальной ссылки, при переходе по которой пользователь мог бессознательно передать конфиденциальные данные злоумышленникам.

Уязвимость получила название CoSnitch и была зарегистрирована как CVE-2026-24301. Её обнаружили в декабре 2025 года и передали Microsoft в рамках программы ответственного раскрытия. Компания устранила проблему 18 августа 2026 года. По словам исследователей, на данный момент нет доказательств, что эксплойт использовали в реальных атаках.

Microsoft поблагодарила команду Varonis Threat Labs за обнаружение уязвимости и подчеркнула: "Клиенты уже защищены и не требуют дополнительных действий". В компании также отметили, что "постоянно совершенствуют защитные механизмы Copilot, чтобы предотвращать подобные техники в будущем".