
Anthropic заявляет, что внутренняя модель под названием Claude Mythos Preview обнаружила слабые места в двух криптографических целях, включая улучшенную атаку на HAWK, кандидата на постквантовую подпись, и новую атаку на сокращённую версию AES-128. Компания говорит, что ни один из результатов не ломает системы, используемые сегодня в интернете, однако работа примечательна тем, что указывает: передовые системы ИИ могут начать вносить вклад в продвинутый криптоанализ, а не только помогать с кодом, поиском или документами.
Отчёт, описанный The Decoder на основе раскрытия Anthropic, сосредоточен на полуаутономной многоагентной схеме, в которой, по сообщениям, модель выполняла большую часть технического исследования, а люди занимались управлением проектом, формулировкой запросов и проверкой. Anthropic утверждает, что результат по HAWK появился примерно за 60 часов после многих лет предыдущей проверки специалистами-людьми, а каждая прогонка проекта стоила около 100 000 долларов в расходах на API. Если эти детали выдержат более широкую проверку, значение разработки выходит далеко за рамки одного релиза модели: это будет означать, что ИИ-системы начинают быть способны на значимую оригинальную работу над трудными математическими задачами безопасности.
Согласно изложению The Decoder о результатах Anthropic, Claude Mythos Preview дал два отдельных результата. Первый — улучшенная атака на HAWK, один из оставшихся кандидатов в процессе National Institute of Standards and Technology по дополнительным постквантовым подписям. Постквантовая криптография должна оставаться безопасной даже если в будущем крупномасштабные квантовые компьютеры станут практичными, поэтому любая новая слабость в кандидатной схеме важна для стандартизации, даже если она не затрагивает уже развёрнутые продукты.
Anthropic утверждает, что модель обнаружила ранее не замеченную симметрию в решётчатой структуре, лежащей в основе безопасности HAWK. По версии компании, один агент в системе сначала счёл подход нереализуемым, а другой нашёл способ использовать его. Эта деталь важна, потому что она представляет результат не как одиночный ответ чат-бота, а как скоординированный исследовательский рабочий процесс с несколькими ролями модели.
Второй результат касается AES-128, но с важным ограничением. Anthropic говорит, что атака применима только к сокращённой версии, использующей семь раундов вместо десяти раундов полного AES-128. AES остаётся самым широко используемым стандартом симметричного шифрования на практике, поэтому любое упоминание о «новой атаке на AES» может звучать тревожнее, чем позволяют доказательства. Судя по доступным сообщениям, речь не идёт о взломе полного AES, как он используется в обычных интернет- и корпоративных системах.
Для этой сокращённой цели Anthropic говорит, что Claude Mythos разработал новый подход к фингерпринтингу, который называет «Möbius Bridge». Компания утверждает, что метод улучшает предыдущие атаки в 200–800 раз, устраняя одно из предположений атакующего. Это техническое заявление о производительности от поставщика, а не независимо подтверждённый отраслевой бенчмарк в представленных здесь материалах.
Находка по HAWK, по-видимому, наиболее значимая часть истории, потому что она касается активного стандартизационного процесса, а не намеренно ослабленной версии уже установленного шифра. The Decoder сообщает, что люди-эксперты проверяли HAWK более двух лет, прежде чем Claude Mythos Preview нашёл более сильную атаку примерно за 60 часов. Даже с оговоркой, что модель была встроена в структурированный рабочий процесс и позже проверена людьми, именно это сравнение и является основной причиной внимания к новости.
HAWK сегодня не является развёрнутым интернет-стандартом. Это кандидат, находящийся на рассмотрении National Institute of Standards and Technology, и это различие резко ограничивает непосредственный операционный риск. Но для команд, создающих криптографические инструменты, защищённое оборудование или долговечные регулируемые системы, этот эпизод напоминает, что процесс оценки постквантовой криптографии может ускориться и стать менее предсказуемым по мере совершенствования ИИ-систем.
Он также ставит более практический вопрос для исследователей и органов стандартизации: если модели способны находить реальные слабости в кандидатных схемах при нетривиальных, но управляемых затратах, то планка для публичного криптоанализа может сдвинуться. Это не означает автоматически, что более эффективные атаки на широко используемые алгоритмы неизбежны. Но это означает, что будущие раунды рассмотрения постквантовой криптографии могут включать больше автоматизированного враждебного тестирования, чем один лишь традиционный peer review.
Ключевой вопрос при оценке этого объявления — сколько работы следует приписать Claude Mythos, а сколько окружающей системе и людям-операторам. В описании Anthropic, как передаёт The Decoder, говорится, что люди в основном отвечали за управление проектом, лёгкие подсказки и проверку. В проекте HAWK ведущий человек-исследователь, по словам компании, имел подготовку в теоретической информатике, но не был экспертом по решётчатой криптографии.
Для работы по сокращённому AES Anthropic говорит, что исследователь создал каркас, который позволял модели формулировать гипотезы и проводить эксперименты. Компания также утверждает, что модель сначала сопротивлялась задаче, считая дальнейшие улучшения маловероятными, прежде чем её подтолкнули к более оригинальным направлениям исследования. За примерно три дня прогон, как сообщается, потребил около 1 миллиарда токенов и потребовал лишь несколько содержательных последующих запросов.
Эти детали можно трактовать по-разному. С одной стороны, они поддерживают утверждение Anthropic о том, что система делала больше, чем просто дополняла известные идеи. С другой — показывают, что это не был обычный чат-сеанс «из коробки». Это была специально построенная исследовательская среда, большой расход токенов и масштабная постпроверка. Для тех, кто строит ИИ-агентов, урок, возможно, звучит не как «модель сама решила криптографию», а как «тщательно структурированные многоэтапные системы иногда способны вытянуть из модели работу фронтирного уровня в узких областях».
Самые сильные утверждения в этой истории исходят от Anthropic и переданы через The Decoder. В статье говорится, что люди-исследователи потратили несколько сотен часов на проверку результатов, а Anthropic заранее поделилась выводами с правительством США, отраслевыми партнёрами и авторами HAWK. Такой процесс раскрытия — положительный знак, но это не то же самое, что широкая публичная валидация.
Представленные здесь доказательства не включают рецензируемую статью, независимое воспроизведение или ответы National Institute of Standards and Technology, авторов HAWK или внешних криптографов. Они также не устанавливают, меняет ли улучшенная атака на HAWK положение кандидата в стандартизационном процессе. Это важные неизвестные.
Anthropic также говорит, что Claude Mythos Preview не доступен публично. Это пока ограничивает внешнее тестирование заявлений компании. Наряду с работой над моделью Anthropic сообщает, что сотрудничала с ETH Zurich, Tel Aviv University и University of Haifa над бенчмарком под названием CryptanalysisBench для оценки языковых моделей на задачах криптоанализа. Бенчмарки помогают отрасли более систематически сравнивать системы, но они не заменяют независимую проверку заявленных взломов или атак.
Для разработчиков ИИ эта история указывает на класс сценариев, который сильно отличается от корпоративных копилотов или потребительских чат-ботов. Криптоанализ дорог, узкоспециализирован и требует тщательной проверки. Но он вознаграждает настойчивый поиск в огромных пространствах гипотез, а именно в этом агентные системы могут быстро прогрессировать. Компании, создающие ИИ-агентов для исследовательских рабочих процессов, вероятно, будут внимательно изучать этот случай, особенно сочетание оркестрации, циклов экспериментов и лёгкого человеческого направления.
Для корпоративных покупателей ИИ непосредственный вывод не в том, что интернет-шифрование стало небезопасным. Anthropic прямо говорит, что результаты не затрагивают системы, используемые сегодня, и доступные данные подтверждают эту осторожность. Более важное следствие — организационное: командам безопасности, возможно, придётся исходить из того, что и защитники, и атакующие со временем получат доступ к более мощному автоматизированному анализу. Это может повлиять на исследование уязвимостей, проверку протоколов, бюджеты red teaming и закупочные предположения о «боевых» криптографических компонентах.
Здесь есть и рыночный сигнал для корпоративного ИИ в более широком смысле. Если Anthropic сможет показать, что передовые модели приносят реальную пользу в сложных научных или математических областях, это укрепит идею, что поставщики моделей конкурируют не только качеством чата, но и специализированным мышлением. Это окажет давление на конкурентов, требуя продемонстрировать сопоставимую глубину в таких областях, как формальная верификация, безопасный анализ кода и автоматизация исследований.
Первый сигнал для отслеживания — внешняя валидация. Следите за комментариями криптографов, авторов HAWK и National Institute of Standards and Technology относительно того, изменяет ли сообщённая слабость HAWK перспективы кандидата.
Во-вторых, ищите техническую публикацию. Открытая статья или подробный разбор результатов по HAWK и AES-128 позволили бы более широкому исследовательскому сообществу проверить утверждения и понять, насколько сильно результат зависел от модели, а насколько — от окружающего каркаса.
В-третьих, CryptanalysisBench может стать полезной точкой отсчёта, если его примут несколько лабораторий. Если другие передовые модели покажут схожие результаты на CryptanalysisBench, история перейдёт от единичного заявления Anthropic к более широкому тренду возможностей.
Наконец, важна доступность. По сообщениям, Claude Mythos Preview остаётся не выпущенным. Без более широкого доступа рынок не может легко оценить воспроизводимость, эффективность затрат или то, обобщается ли эта способность за пределы нескольких тщательно отобранных задач.
Объявление Anthropic важно прежде всего как сигнал о дизайне рабочих процессов, а не только об интеллекте модели. Примечательно сочетание Claude Mythos с управляемым многоагентным процессом, экспериментальным каркасом и длинными циклами проверки. На практике это ближе к тому, как, вероятно, будут работать высокоценные корпоративные ИИ-системы, чем привычная демонстрация чат-бота.
При этом этой истории нужно больше независимого подтверждения, прежде чем она должна изменить планирование безопасности. Пока что разработчикам стоит читать её как свидетельство того, что передовой ИИ может начать иметь значение в экспертных исследовательских областях вроде постквантовой криптографии, а компаниям — рассматривать её как раннее предупреждение о темпах автоматизированного анализа безопасности, а не как доказательство того, что развёрнутые стандарты шифрования находятся под угрозой.
Anthropic говорит, что Claude Mythos нашёл недостатки в HAWK и сокращённой версии AES, что указывает: ИИ может ускорить криптоанализ, не угрожая нынешним системам.