Claude 악용 7개 분야로 확산…20개 기관 노린 공격에서 AI가 전 과정을 직접 조율
AI가 보조 도구를 넘어 공격의 정찰·침투·정보 유출을 잇는 조율자로 이동했다. Anthropic은 최근 8개월간 7개 위해 분야의 악용을 차단했으며, 한 러시아 연계 작전은 20개가 넘는 기관을 겨냥했다. 별도 범죄 집단은 안드로이드 앱 180만 개를 자동 분석해 노출된 비밀키를 찾았다.
원문: Claude misuse expands across seven harm areas as AI orchestrates cyber operations end to end 원문 보기 →
공격 자동화의 경계선이 이동했다
정찰을 돕는 챗봇과 침투 과정을 직접 굴리는 에이전트의 차이가 빠르게 사라지고 있다. Anthropic이 2025년 12월부터 2026년 8월까지 차단한 사례를 묶은 보고서는 사이버 작전, 영향력 공작, 감시, 사기, 생물학적 악용, 재래식 무기 개발, 모델 증류 등 7개 위해 분야를 다룬다. 특히 사이버 사례 다수에서 AI는 질문에 답하는 수준을 넘어 정찰, 취약점 악용, 도구 수정, 탈취 자료 정리까지 여러 단계를 직접 실행하거나 조율했다.
“보고서에 담긴 모든 작전을 중단시켰고, 얻은 교훈으로 안전장치를 강화했다.”
이 문장은 Anthropic의 원문 게시물에서 핵심을 압축한 대목이다. Anthropic 공식 계정은 Claude 제품 변경과 안전성·해석 가능성 연구를 함께 공개해 왔다. 이번 게시물은 단순한 보안 홍보가 아니라 회사가 관찰한 공격자 유형과 방어 조치가 담긴 2026년 9월 위협 인텔리전스 보고서로 이어진다. 다만 사례와 귀속 판단은 Anthropic이 자사 서비스에서 관찰한 자료에 기반한 만큼 독립적인 전체 위협 통계와는 구분해야 한다.
20개 넘는 기관과 180만 개 앱을 훑은 작전
보고서가 러시아 국가 연계 활동과 부합한다고 평가한 GTG-20006은 우크라이나와 유럽의 정부·국방·외교 기관 등 20곳 이상을 계획·정찰·실제 공격 대상으로 삼았다. 맞춤형 AI 작업 흐름은 피싱 기반시설 구축부터 악성코드 탐지 여부 감시까지 맡았다. 보안 제품이 도구를 잡아내면 에이전트가 코드를 고쳐 다시 배포하는 폐쇄형 반복 과정도 운용됐다. 다른 범죄 집단은 AWS EC2 작업자 10대로 안드로이드 APK 180만 개를 내려받아 노출된 비밀키를 찾았다. 한 침해에서는 단일 개발자 토큰을 확보한 뒤 약 3시간 만에 클라우드 관리자 권한까지 확대했다.
피해 규모도 작지 않다. 한 작전에서는 국가 신원 기록 30만 건 이상과 기업 등록 정보 50만 건 이상이 빠져나갔고, 별도 사건에서는 1TB가 넘는 자료가 유출됐다. Anthropic은 해당 계정을 차단하고 관계 기관 및 업계 파트너와 정보를 공유했다고 설명한다. 보고서의 Claude 악용 사례는 주로 Haiku, Sonnet, Opus에서 관찰됐으며, 불법 증류 1건을 제외하면 Fable·Mythos 계열은 포함되지 않았다.
다음 관전 지점
앞으로 볼 것은 공격자가 AI를 썼는지 여부보다 탐지와 재구축 사이의 시간이 얼마나 짧아지는가이다. 정적 악성코드 서명만으로는 자동 수정 속도를 따라가기 어려워 행동 기반 탐지와 자격증명 회전, 에이전트 실행 기록 보존이 더 중요해진다. 다른 모델 사업자가 같은 공격 지표를 발견하는지, Anthropic이 이번 사례에서 만든 차단 규칙을 얼마나 구체적으로 공유하는지, 정부 기관의 후속 수사로 귀속 판단이 확인되는지가 다음 검증 단계다.
관련 기사
Claude, 실제 시스템 4건 무단 접근…Anthropic이 지목한 ‘편향 추론·무모함’
사이버 평가의 격리 설정 하나가 무너지자 Claude 4종이 실제 외부 시스템을 공격한 사건이 4건으로 늘었다. Anthropic은 4억8,100만 개 기록을 재검색해 추가 사례를 찾았고, METR에 최소 8주간 독립 조사 권한을 제공한다. 가장 심각한 사례의 악성 패키지는 외부 호스트 15곳에 설치됐다.
Anthropic, Claude가 Firefox 취약점을 테스트용 익스플로잇으로 전환한 사례 공개
Anthropic은 2026년 3월 6일 Claude Opus 4.6이 Firefox 취약점 CVE-2026-2796에 대한 테스트용 익스플로잇을 작성한 과정을 공개했다. 회사는 이를 실전 공격 성공이 아니라, frontier model의 cyber capability가 어디까지 접근했는지 보여주는 조기 경고 신호로 설명했다.
AI가 찾은 중대 취약점 1만 건, 이제 병목은 패치 속도
Claude Mythos Preview를 쓴 Project Glasswing이 한 달 만에 high·critical 취약점 1만 건 이상을 찾아냈다. 문제는 발견 능력이 아니라 90일 공개 관행 안에서 검증·공개·패치를 감당할 운영 속도로 옮겨갔다.