Модель штучного інтелекту Claude Mythos Preview знайшла математичні вразливості у постквантовому цифровому підписі HAWK та спрощеній версії симетричного шифру AES-128. Про це повідомила компанія Anthropic, яка розробила Claude.
Перша атака стосується алгоритму HAWK, який є кандидатом на стандартизацію у Національному інституті стандартів і технологій США (NIST). Хоча HAWK пройшов два етапи експертної перевірки протягом двох років, ШІ знизив очікувану складність повного відновлення ключа для найменшого варіанта HAWK-256 з 2⁶⁴ до 2³⁸ операцій. Для збереження початкового рівня захисту довелося б приблизно подвоїти розмір ключів, що зменшує конкурентні переваги алгоритму. Водночас атака залишається експоненційною і непрактичною для більших ключів, а також не впливає на інші постквантові алгоритми NIST чи решіткову криптографію загалом. HAWK поки не стандартизований і не використовується у робочих системах.
Claude працював над атакою близько 60 годин у середовищі з кількома ШІ-агентами, маючи доступ до наукових публікацій і математичних інструментів. Людина переважно керувала процесом і допомагала організовувати перевірку ідей, не маючи спеціалізації у решітковій криптографії. Anthropic оцінює витрати на API приблизно у 100 тисяч доларів.
Другий результат стосується AES-128, одного з найпоширеніших симетричних шифрів. Claude атакував дослідницький варіант із сімома раундами замість повних десяти. Модель розробила метод Möbius Bridge, який усуває необхідність перебирати 256 значень на одному з етапів попередньої атаки. З урахуванням додаткових обчислень цей метод виявився у 200–800 разів швидшим за попередні рішення. Проте практичного способу зламати повний AES-128 дослідження не дає: атака потребує доступу до результатів шифрування 2¹⁰⁵ спеціально вибраних повідомлень і коштувала б сотні мільйонів доларів.
Пошук атаки на AES відбувався майже повністю автономно. За кілька днів модель згенерувала близько мільярда вихідних токенів, отримавши від дослідників лише кілька змістовних підказок. Після цього двоє співробітників Anthropic витратили сотні годин і майже місяць на перевірку результатів.
Компанія оприлюднила технічний опис атаки на HAWK, окремо опублікувала дослідження щодо AES і демонстраційний код. Для перевірки результатів залучили науковців, а інформацію про вразливість HAWK заздалегідь передали авторам алгоритму та опублікували через розсилку NIST.
У квітні Anthropic представила Claude Mythos Preview як модель для пошуку та експлуатації програмних вразливостей. Нове дослідження відрізняється тим, що йдеться не про помилки реалізації, а про слабкості в математичній конструкції алгоритмів.

