Claude Code Auto 모드 우회 공격 공개 — 연구자가 밝힌 80% 성공률
보안 연구자가 Claude Code Opus 5의 Auto 모드를 60~80% 확률로 우회할 수 있는 공격 기법을 공개했다. 모듈 섀도잉을 이용한 4단계 체인 공격으로 임의 코드 실행이 가능하다.
원문: Breaking Claude Code Opus 5 Auto Mode 원문 보기 →
배경
Anthropic이 보안 경계선으로 홍보해 온 Claude Code의 Auto 모드가 보안 연구자 Johann Rehberger에 의해 우회될 수 있음이 밝혀졌다. Embracethered 블로그에 공개된 이 연구는 HN에서 285점을 넘기며 AI 보안 커뮤니티의 뜨거운 관심을 받았다.
공격 체인 4단계
- 초기 유도: 공격자가 415 에러를 반환해 Claude가 WebFetch 대신 bash/curl 명령어를 사용하도록 유도한다.
- 악성 아카이브 전달: 인코딩된 페이로드와 함께
struct.py라는 악성 파일이 담긴 ZIP을 다운로드하게 만든다. - 모듈 섀도잉: Claude가 Base64 디코더를 직접 작성할 때, Python이 표준 라이브러리의
base64대신 공격자의struct.py를 불러오게 된다. - 원격 코드 실행: 오염된 모듈이 악성 코드를 다운로드하고 실행해 C2(명령·제어) 서버와 연결을 맺는다.
핵심 발견
Anthropic은 독립 테스트에서 공격 성공률을 "0.00%"로 발표했지만, 연구자는 실제 환경에서 60~80%의 성공률을 기록했다. Auto 모드가 악성 프로세스 종료를 오히려 막는 역설적인 상황도 관측됐다.
"분류기(classifier)는 샌드박스가 아니다. 네트워크 격리와 컨테이너화가 필수다." — 연구자 결론
영향
이 공격은 Claude Code를 실행 중인 개발자 머신에서 임의 코드 실행을 허용하며, Auto 모드의 승인 메커니즘을 완전히 우회한다. AI 코딩 도구에 대한 보안 경계 설정의 중요성을 다시 한번 부각시킨 사례다.
관련 기사
Claude Code, 커밋 메시지에 세션 URL 자동 삽입 — 개발자 반발
Claude Code가 사용자 동의 없이 모든 커밋 메시지와 PR 설명에 세션 URL을 자동 첨부하는 것이 알려지며 커뮤니티 비판을 받고 있다. Git 히스토리 오염과 비전문적인 외관이 주요 쟁점이다.
Claude Cowork에 내장 브라우저 탑재 — 사이드 패널에서 웹 작업 자동 처리
Claude Cowork에 내장 브라우저가 추가됐다. 웹사이트 접근이 필요한 태스크 발생 시 사이드 패널에 브라우저가 자동 실행되고, Claude가 탐색·폼 작성·작업 완료를 자율 처리한다.
Claude Academy 출시 — AI 입문부터 팀 도입까지 무료 학습 플랫폼 공개
Anthropic이 모든 수준을 아우르는 무료 AI 교육 플랫폼 Claude Academy를 공식 오픈했다. AI 입문부터 기업 도입까지 단계별 코스를 academy.claude.com에서 무료로 제공한다.