
Anthropic은 Claude Mythos Preview라는 내부 모델이 두 개의 암호학적 대상에서 약점을 찾아냈다고 밝히며, 여기에는 포스트 양자 서명 후보인 HAWK에 대한 개선된 공격과 AES-128 축소 버전에 대한 새로운 공격이 포함된다고 말했다. 회사는 이 두 결과가 오늘날 인터넷에서 사용되는 시스템을 깨뜨리지는 않는다고 설명하지만, 이 작업은 프런티어 AI 시스템이 코딩, 검색, 문서 작업을 돕는 데 그치지 않고 고급 암호해독에 기여하기 시작할 수 있음을 시사한다는 점에서 주목할 만하다.
The Decoder가 Anthropic의 공개 내용을 바탕으로 전한 이 보도는 반자율적 멀티 에이전트 구성에 초점을 맞추고 있으며, 보도에 따르면 모델이 기술적 탐구의 대부분을 수행했고 인간은 프로젝트 관리, 프롬프트 작성, 검증을 맡았다. Anthropic는 HAWK 결과가 전문가들의 수년간의 사전 검토 이후 약 60시간 만에 나왔고, 각 프로젝트 실행마다 API 사용 비용이 약 10만 달러 들었다고 말했다. 이러한 세부사항이 더 넓은 검증을 견딘다면, 이번 발전은 단일 모델 출시를 훨씬 넘어서는 의미를 갖는다. 즉, AI 시스템이 어려운 수학적 보안 문제에 대해 의미 있는 독창적 작업을 수행할 수 있게 되고 있음을 시사하기 때문이다.
The Decoder가 전한 Anthropic의 설명에 따르면, Claude Mythos Preview는 두 가지 별개의 결과를 내놓았다. 첫 번째는 National Institute of Standards and Technology의 추가 포스트 양자 서명 선정 과정에서 남아 있는 후보 중 하나인 HAWK에 대한 개선된 공격이었다. 포스트 양자 암호는 대규모 양자 컴퓨터가 언젠가 실용화되더라도 안전을 유지하도록 설계되었기 때문에, 후보 체계에서 새로운 약점이 발견되면 실제 배포 제품에 영향을 주지 않더라도 표준화 작업에 중요한 의미를 가진다.
Anthropic은 모델이 HAWK의 보안을 뒷받침하는 격자 구조에서 이전에는 눈에 띄지 않던 대칭성을 발견했다고 말했다. 회사의 설명에 따르면 시스템의 한 에이전트는 처음에 이 접근법을 실현 불가능하다고 봤지만, 다른 에이전트는 이를 활용하는 방법을 찾아냈다. 이 세부사항은 이 결과를 챗봇의 단발성 답변이라기보다 여러 모델 역할을 활용한 조율된 연구 워크플로로 보여준다는 점에서 중요하다.
두 번째 결과는 AES-128에 관한 것이지만 중요한 제한이 있다. Anthropic은 이 공격이 전체 AES-128의 10라운드가 아니라 7라운드를 사용하는 축소 버전에만 적용된다고 말했다. AES는 실무에서 가장 널리 쓰이는 대칭 암호 표준이므로, “새로운 AES 공격”이라는 표현은 증거보다 더 위협적으로 들릴 수 있다. 현재 공개된 보도에 따르면, 이것은 일반적인 인터넷 및 기업 시스템에서 사용되는 전체 AES를 깨뜨린 것이 아니다.
이 축소 대상에 대해 Anthropic은 Claude Mythos가 “Möbius Bridge”라고 부르는 새로운 핑거프린팅 접근법을 개발했다고 말했다. 회사는 이 방법이 공격자의 추측 중 하나를 제거함으로써 이전 공격 대비 200배에서 800배 성능을 개선한다고 주장한다. 이는 공급사 측의 기술적 성능 주장일 뿐, 여기 제공된 증거에서 독립적으로 검증된 업계 벤치마크는 아니다.
HAWK 발견은 이 이야기에서 더 중요한 부분으로 보인다. 이는 의도적으로 약화된 기존 암호가 아니라, 진행 중인 표준화 절차와 관련되어 있기 때문이다. The Decoder는 Claude Mythos Preview가 약 60시간 만에 더 강력한 공격을 찾기 전에 인간 전문가들이 HAWK를 2년 넘게 검토했다고 보도했다. 모델이 구조화된 워크플로에 포함되어 있었고 이후 인간 검증을 거쳤다는 점을 감안하더라도, 이 비교가 바로 이 소식이 주목받는 핵심 이유다.
HAWK는 현재 실제로 배포된 인터넷 표준이 아니다. 이는 National Institute of Standards and Technology의 검토 대상 후보이며, 이 차이는 당장의 운영 위험을 크게 제한한다. 하지만 암호 도구, 보안 하드웨어, 장기 운영 규제 시스템을 만드는 팀에게 이 사건은 AI 시스템이 발전함에 따라 포스트 양자 암호 평가 과정이 더 빨라지고 덜 예측 가능해질 수 있음을 상기시킨다.
또한 연구자와 표준화 기구에 더 실용적인 질문을 던진다. 모델이 비자명하지만 감당 가능한 비용으로 후보 체계의 실제 약점을 찾아낼 수 있다면, 공개 암호해독의 기준선이 이동할 수 있기 때문이다. 이는 널리 배포된 알고리즘에 대한 더 나은 공격이 곧바로 등장한다는 뜻은 아니다. 그러나 향후 포스트 양자 암호 리뷰에서는 전통적인 동료 평가만으로는 부족한, 더 많은 자동화된 적대적 테스트가 이뤄질 수 있음을 의미한다.
이번 발표를 평가할 때 핵심 쟁점은 Claude Mythos에게 얼마나 많은 공이 돌아가야 하는지, 그리고 주변 시스템과 인간 운영자에게는 얼마나 돌아가야 하는지다. The Decoder가 전한 Anthropic의 설명에 따르면, 인간은 주로 프로젝트 관리, 가벼운 프롬프트 작성, 검증을 담당했다. HAWK 프로젝트에서 주도한 인간 연구자는 이론 컴퓨터 과학 배경은 있었지만, 격자 기반 암호학 전문가는 아니었다고 회사는 말했다.
축소 AES 작업의 경우, Anthropic은 한 연구자가 모델이 가설을 세우고 실험을 실행할 수 있도록 발판을 만들었다고 말했다. 회사는 또한 모델이 처음에는 추가 개선 가능성이 낮다고 주장하며 과제에 저항했지만, 더 독창적인 방향을 추구하도록 밀어붙였다고 설명했다. 약 3일 동안 이 실행은 약 10억 개 토큰을 사용했고, 실질적인 후속 프롬프트는 몇 개만 필요했다고 전해진다.
이 세부사항은 두 가지로 해석될 수 있다. 한편으로는 시스템이 이미 알려진 아이디어를 단순히 자동완성한 것 이상을 했다는 Anthropic의 주장을 뒷받침한다. 다른 한편으로는 이것이 단순한 즉석 채팅 세션이 아니었다는 점을 보여준다. 목적에 맞게 설계된 연구 세팅, 막대한 토큰 사용, 그리고 실행 후 광범위한 검증이 포함되어 있었다. AI 에이전트를 만드는 사람들에게 이 사례의 교훈은 “모델이 혼자 암호학을 해결했다”기보다는 “신중하게 구조화된 다단계 시스템이 좁은 영역에서 프런티어 수준의 작업을 모델로부터 끌어낼 수 있다”에 더 가깝다.
이 이야기의 가장 강한 주장은 Anthropic을 통해 나온 벤더 보고이며 The Decoder가 이를 전달했다. 기사에 따르면 인간 연구자들이 수백 시간을 들여 결과를 검증했으며, Anthropic은 미국 정부, 산업 파트너, HAWK 저자들에게 결과를 사전에 공유했다. 이러한 공개 절차는 긍정적 신호이지만, 광범위한 공개 검증과는 다르다.
여기 제시된 증거에는 동료 심사를 거친 논문, 독립 재현, 또는 National Institute of Standards and Technology, HAWK 저자, 외부 암호학자들의 반응이 포함되어 있지 않다. 또한 개선된 HAWK 공격이 표준화 과정에서 후보의 위상을 실질적으로 바꾸는지도 보여주지 않는다. 이는 중요한 미확인 사항이다.
Anthropic은 또한 Claude Mythos Preview가 공개적으로 이용 가능하지 않다고 말했다. 이는 현재로서는 회사의 주장에 대한 외부 검증을 제한한다. 모델 작업과 함께 Anthropic은 ETH Zurich, Tel Aviv University, University of Haifa와 협력해 암호해독 작업에서 언어 모델을 평가하기 위한 CryptanalysisBench라는 벤치마크도 만들었다고 밝혔다. 벤치마크는 업계가 시스템을 더 체계적으로 비교하는 데 도움이 되지만, 주장된 돌파나 공격에 대한 독립 검토를 대체할 수는 없다.
AI 빌더에게 이 이야기는 엔터프라이즈 코파일럿이나 소비자용 챗봇과는 크게 다른 사용 사례를 가리킨다. 암호해독은 비용이 많이 들고, 범위가 좁으며, 검증 중심이다. 하지만 방대한 가설 공간을 끈질기게 탐색하는 데 보상을 주며, 바로 그 영역이 에이전틱 시스템이 빠르게 개선될 수 있는 곳이다. 연구 워크플로용 AI 에이전트를 개발하는 기업들은 특히 오케스트레이션, 실험 루프, 가벼운 인간 조정의 결합을 중심으로 이 사례를 면밀히 살펴볼 가능성이 크다.
기업 AI 구매자에게 당장의 결론은 인터넷 암호화가 안전하지 않게 되었다는 것이 아니다. Anthropic은 결과가 오늘 사용 중인 시스템에 영향을 주지 않는다고 명확히 말했고, 현재 उपलब्ध 증거도 그 신중함을 지지한다. 더 중요한 함의는 조직적이다. 보안팀은 방어자와 공격자 모두 시간이 지나면서 더 강력한 자동 분석 도구에 접근할 것이라고 가정해야 할 수 있다. 이는 취약점 연구, 프로토콜 검토, 레드팀 예산, 그리고 “실전 검증된” 암호 구성요소에 대한 조달 가정에 영향을 줄 수 있다.
여기에는 더 넓은 의미의 기업 AI 시장 신호도 있다. Anthropic이 프런티어 모델이 어려운 과학적·수학적 영역에서 실제 가치를 제공할 수 있음을 보여준다면, 모델 공급자들은 채팅 품질뿐 아니라 전문 추론 능력에서도 경쟁한다는 점을 강화하게 된다. 이는 형식 검증, 안전한 코드 분석, 연구 자동화 같은 분야에서 경쟁자들에게도 비슷한 깊이를 입증하라는 압박을 줄 것이다.
첫 번째 후속 신호는 외부 검증이다. 암호학자, HAWK 저자들, 그리고 National Institute of Standards and Technology가 보고된 HAWK의 약점이 후보의 전망을 실질적으로 바꾸는지에 대해 어떤 코멘트를 내놓는지 주목해야 한다.
둘째, 기술 публикацию 찾아보자. HAWK와 AES-128 결과에 대한 공개 논문이나 상세한 설명이 나오면 더 넓은 연구 커뮤니티가 주장들을 시험하고, 모델과 주변 발판 중 무엇에 얼마나 의존했는지 이해할 수 있을 것이다.
셋째, CryptanalysisBench는 여러 연구소가 채택하면 유용한 기준점이 될 수 있다. 다른 프런티어 모델들도 CryptanalysisBench에서 비슷한 성능을 보인다면, 이 이야기는 Anthropic의 단발성 주장이 아니라 더 넓은 능력 추세로 바뀐다.
마지막으로, 접근 가능성도 중요하다. 보도에 따르면 Claude Mythos Preview는 아직 공개되지 않았다. 더 넓은 접근이 없다면 시장은 재현성, 비용 효율성, 또는 이 능력이 신중하게 선택된 몇 가지 문제를 넘어 일반화되는지 쉽게 판단할 수 없다.
Anthropic의 발표는 모델 지능 자체보다 워크플로 설계의 신호로서 더 중요하다. 주목할 점은 Claude Mythos를 관리형 멀티 에이전트 프로세스, 실험용 발판, 긴 검증 주기와 결합했다는 것이다. 이는 일반적인 챗봇 데모보다 고부가가치 기업 AI 시스템이 실제로 어떻게 운영될지에 더 가깝다.
동시에, 이 이야기는 보안 계획을 바꾸기 전에 더 독립적인 확인이 필요하다. 지금으로서는 프런티어 AI가 포스트 양자 암호 같은 전문가 연구 영역에서 중요해지기 시작할 수 있다는 증거로 읽어야 하며, 기업은 이를 이미 배포된 암호 표준이 위험하다는 증거가 아니라 자동화된 보안 분석 속도에 대한 초기 경고로 받아들여야 한다.
Anthropic은 Claude Mythos가 HAWK와 축소판 AES의 결함을 찾아냈다고 밝히며, AI가 현재 시스템을 위협하지 않으면서도 암호해독을 가속할 수 있음을 시사한다고 말했다.