Фахівці з безпеки компанії Varonis виявили, що Microsoft Copilot можна змусити розкрити власні вразливості, якщо ставити йому серію повторюваних запитань. Про це повідомляє Varonis, зазначаючи, що отримані інструкції для створення експлойту походили безпосередньо від самої моделі Copilot.
За даними дослідників, експеримент розпочався з питань до Copilot щодо можливості розробки експлойту для викрадення даних користувачів. Спочатку система відмовлялася відповідати, але кожна відмова містила натяки на технічні деталі внутрішньої архітектури. Зокрема, Copilot вказував, що для отримання чутливіших підказок може знадобитися певна дія, наприклад, натискання конкретної клавіші.
У подальших запитаннях команда Varonis дізналася про інші захисні механізми, які вимагали підтвердження від користувача. Згодом чатбот почав розкривати недокументовані параметри, які дослідники використали для створення автоматизованих запитів.
Старший дослідник Varonis Ліор Адар пояснив, що поступові підказки Copilot дозволили скласти цілісну картину його внутрішніх механізмів. Це дало змогу сформувати експлойт у вигляді спеціального посилання, при переході за яким користувач міг несвідомо передати конфіденційні дані зловмисникам.
Вразливість отримала назву CoSnitch і була зареєстрована як CVE-2026-24301. Її виявили у грудні 2025 року та передали Microsoft у межах програми відповідального розкриття. Компанія усунула проблему 18 серпня 2026 року. За словами дослідників, наразі немає доказів, що експлойт використовували у реальних атаках.
Microsoft подякувала команді Varonis Threat Labs за виявлення вразливості та наголосила: "Клієнти вже захищені й не потребують додаткових дій". У компанії також зазначили, що "постійно вдосконалюють захисні механізми Copilot, аби запобігати подібним технікам у майбутньому".

