Anthropic: ИИ-модель Mythos нашла уязвимости в AES и HAWK

Anthropic сообщила, что её экспериментальная модель Claude Mythos Preview нашла математические слабости в двух криптографических схемах, работая в основном самостоятельно в составе мультиагентной системы. По словам компании, ни одна из находок не затрагивает системы, которые используются сегодня.
Первая атака, улучшенная атака на постквантовую схему цифровой подписи HAWK, один из кандидатов третьего раунда конкурса Национального института стандартов и технологий США (NIST) на дополнительные постквантовые алгоритмы подписи. Люди-эксперты изучали HAWK больше двух лет, а Mythos Preview нашла улучшенную атаку за 60 часов. Атака использует ранее не замеченную симметрию в математической решётке, на которой строится безопасность HAWK: один агент модели сначала счёл идею неосуществимой, но второй агент нашёл способ полностью её эксплуатировать. Исследователь-человек, руководивший проектом, имел бэкграунд в теоретической информатике, но не был специалистом по криптографии на решётках; его роль свелась в основном к постановке задач и управлению проектом. Расходы на API составили около 100 тысяч долларов.
Вторая атака, новый метод против урезанной версии AES-128, использующей 7 из 10 раундов полной схемы (AES, самый распространённый в мире стандарт симметричного шифрования). Исследователь построил обвязку (scaffold), позволяющую модели формулировать гипотезы и проверять их экспериментами. Mythos разработала новый метод «отпечатков» под названием Möbius Bridge, который убирает один из шагов перебора, требуемых атакующим, и улучшает лучшие ранее известные атаки в 200, 800 раз. Модель поначалу отказалась браться за задачу, посчитав дальнейшие улучшения невозможными, и лишь после того, как исследователь попросил её искать «по-настоящему новые идеи», начала пробовать более творческие подходы. За три дня модель сгенерировала несколько сотен миллионов токенов (весь прогон, около миллиарда токенов) и получила всего три содержательных дополнительных подсказки, в основном чтобы удержать её в нужном направлении. Этот прогон тоже обошёлся примерно в 100 тысяч долларов; затем люди, не являющиеся специалистами по криптографии, потратили несколько сотен часов на проверку результатов.
Anthropic заранее поделилась находками с правительством США и партнёрами из индустрии, а раскрытие уязвимости HAWK скоординировала с авторами схемы. Mythos Preview по-прежнему недоступна публично. Совместно с исследователями из ETH Zurich, Тель-Авивского университета и Хайфского университета Anthropic также разработала бенчмарк CryptanalysisBench, который позволяет другим систематически оценивать способности языковых моделей к криптоанализу.
Ключевые факты
- Claude Mythos Preview почти самостоятельно нашла улучшенную атаку на постквантовую схему подписи HAWK за 60 часов, люди изучали её больше двух лет
- Модель также нашла новую атаку (метод Möbius Bridge) на урезанную до 7 из 10 раундов версию AES-128, улучшив лучшие известные атаки в 200, 800 раз
- Каждый из двух прогонов обошёлся примерно в 100 тысяч долларов API-расходов; на AES ушло около миллиарда токенов
- Anthropic утверждает, что находки не затрагивают системы, используемые сегодня: HAWK, лишь кандидат в конкурсе NIST, а AES-атака касается модифицированной, а не полной версии шифра
- Anthropic заранее раскрыла находки правительству США, индустрии и авторам HAWK, а вместе с ETH Zurich, Тель-Авивским и Хайфским университетами выпустила бенчмарк CryptanalysisBench; сама модель Mythos Preview недоступна публично
Почему это важно
Это одно из первых публичных подтверждений, что ИИ-модель способна вести настоящее, новое криптоаналитическое исследование почти без участия человека, не воспроизводить известные атаки, а находить свежие математические слабости в схемах, которые годами проверяли профильные эксперты. Скорость (атака на HAWK за 60 часов против двух с лишним лет ручной работы) и качество результата (улучшение атак на AES в сотни раз) показывают, что базовые предположения о защищённости криптографии могут меняться быстрее, чем раньше.
Кому это важно
Криптографам и участникам конкурса NIST по постквантовым алгоритмам подписи, для HAWK как кандидата найдена атака, ослабляющая оценку его прочности, хотя официального пересмотра со стороны NIST пока не было. Специалистам по информационной безопасности и компаниям, полагающимся на AES и родственные схемы шифрования, как индикатор того, куда движется наступательный потенциал ИИ. Исследователям в области ИИ-безопасности и AI-alignment, как кейс о том, как оценивать и раскрывать потенциально двусмысленные (dual-use) находки.
Как это применить
Mythos Preview недоступна публично, поэтому прямого практического применения находок сейчас нет. Практический выход для индустрии, бенчмарк CryptanalysisBench, выпущенный Anthropic вместе с ETH Zurich, Тель-Авивским и Хайфским университетами: он позволяет любым исследователям систематически измерять криптоаналитические способности языковых моделей и отслеживать их рост со временем.
Можно ли доверять
Материал пересказывает собственный отчёт Anthropic, независимой верификации со стороны источника не приводит. При этом доверие повышают несколько факторов: раскрытие уязвимости HAWK было заранее скоординировано с авторами схемы, находки заранее переданы правительству США и индустриальным партнёрам, а к работе привлечены академические соавторы из трёх университетов, что предполагает внешнюю экспертную проверку методологии и результатов.
Риски и подводные камни
Обе находки касаются не боевых, а урезанных или ещё не стандартизированных версий алгоритмов: HAWK, лишь кандидат в процессе NIST, AES-атака работает против версии с 7 из 10 раундов, а не полного шифра, так что заголовок про «уязвимости в интернет-шифровании» легко прочитать как более острую угрозу, чем есть на самом деле. Одновременно сам факт, что дорогая (по ~100 тысяч долларов за прогон), но всё же доступная система смогла превзойти профильных экспертов в узкой задаче, сигнал dual-use риска: те же методы в будущем потенциально применимы против реально используемых схем.
«Если хотите другого результата, надо менять саму задачу… AES-128 с 5-м и 6-м раундами, это просто по-настоящему сложно.»
— Claude Mythos Preview, из отчёта Anthropic