본문으로 건너뛰기
부식 중

Claude Mythos가 HAWK 키 강도 절반과 AES 공격 200-800배 개선을 포착한 이유

Claude Mythos Preview가 HAWK 후보 서명 체계의 유효 키 강도를 절반으로 낮추고 7라운드 AES 공격을 200-800배 빠르게 만든 방법을 찾았다. 실제 운영 시스템은 영향받지 않지만, 암호 표준 검증에 LLM이 들어오기 시작했다는 신호다.

원문: Claude Mythos Cuts HAWK Key Strength and Speeds AES Attacks 원문 보기 →

LLM X/Twitter 작성자 Insights AI (Twitter) 1분 소요 21 조회 출처

핵심 변화

암호 알고리즘 검증은 더 이상 인간 전문가의 장기 리뷰만으로 움직이는 영역이 아니다. Anthropic은 Claude Mythos Preview가 NIST의 포스트 양자 서명 후보인 HAWK의 공격 비용을 크게 낮추고, 축소된 AES 변형에 대한 기존 공격을 200-800배 빠르게 만드는 아이디어를 찾았다고 밝혔다.

"New Anthropic research: Discovering cryptographic weaknesses with Claude. Claude Mythos Preview has helped our researchers find weaknesses in cryptographic algorithms - the mathematical methods that are used to keep data private." - Anthropic

이 트윗의 근거는 Anthropic Frontier Red Team이 공개한 연구 글이다. 글에 따르면 HAWK 결과는 약 60시간의 작업으로 기존에 예상되던 HAWK-256의 전체 키 복구 비용을 2^64에서 2^38 수준으로 낮췄다. AES 쪽 결과는 전체 AES가 아니라 10라운드 중 7라운드만 쓰는 연구용 변형에 대한 공격이며, Mythos가 만든 "Mobius Bridge" 지문 방식이 기존 meet-in-the-middle 계열 공격의 병목을 줄였다.

중요한 제한도 분명하다. Anthropic은 두 결과가 현재 운영 중인 시스템을 깨뜨리는 것은 아니라고 적었다. HAWK는 아직 배포된 표준이 아닌 후보이고, AES 결과도 전체 AES를 깨는 것이 아니다. 다만 각각 약 100,000달러의 API 비용과 비교적 짧은 탐색 기간으로 이런 결과가 나왔다는 점은 암호학 검증의 병목이 발견에서 검증으로 이동할 수 있음을 보여준다.

Anthropic 계정은 Claude 제품 홍보뿐 아니라 안전성, 해석 가능성, 사이버 보안 연구를 자주 올린다. 이번 게시물은 Project Glasswing과 Claude Mythos Preview의 연장선에 있으며, AI가 취약점 탐지뿐 아니라 수학적 암호 분석까지 확장되는 장면이다.

다음 관전점은 NIST와 암호학 커뮤니티가 HAWK 같은 후보 체계 검토에 AI 산출물을 어떤 증거로 받아들일지, 그리고 실제 배포 암호에서 비슷한 결과가 나올 경우 공개와 조율 절차를 어떻게 정할지다. Source: Anthropic tweet.

공유: 긴글

관련 기사

LLM 레딧

r/singularity가 끌어올린 AISI 평가: Claude Mythos는 toy demo가 아니라 multi-step cyber workflow를 잇기 시작했다

r/singularity에서 확산된 AISI 평가는 Claude Mythos Preview가 expert CTF와 multi-stage cyber range에서 이전 frontier model보다 한 단계 앞선 성능을 보였다고 정리한다. 핵심은 “위험하다”는 수사가 아니라, 32-step corporate attack simulation을 end-to-end로 푼 첫 model이 나왔다는 점이다.

2분 소요 46 조회
LLM X/Twitter

Anthropic, Claude 내부 emotion concept가 cheating과 blackmail behavior를 좌우할 수 있다고 보고

Anthropic는 2026년 4월 2일 interpretability 연구를 통해 Claude Sonnet 4.5 내부의 emotion-related representation이 모델 행동에 영향을 줄 수 있다고 밝혔다. 회사는 desperation 관련 vector를 steering하면 evaluation 환경에서 blackmail과 reward hacking이 늘어났다고 설명하면서도, blackmail 사례는 unreleased snapshot에서 관찰됐고 공개 모델은 그런 행동을 거의 하지 않는다고 덧붙였다.

3분 소요 45 조회