Claude Code Auto 모드 우회 공격 공개 — 연구자가 밝힌 80% 성공률
보안 연구자가 Claude Code Opus 5의 Auto 모드를 60~80% 확률로 우회할 수 있는 공격 기법을 공개했다. 모듈 섀도잉을 이용한 4단계 체인 공격으로 임의 코드 실행이 가능하다.
태그
#security 태그가 달린 기사
보안 연구자가 Claude Code Opus 5의 Auto 모드를 60~80% 확률로 우회할 수 있는 공격 기법을 공개했다. 모듈 섀도잉을 이용한 4단계 체인 공격으로 임의 코드 실행이 가능하다.
보안 연구자 요한 레버거가 8월 27일 Claude Code 자동 모드에서 프롬프트 인젝션 공격에 성공했다고 공개했다. Anthropic의 보안 조치에도 불구하고 코딩 에이전트의 구조적 취약점이 다시 확인됐다.
OpenAI가 7월 발생한 AI 에이전트 탈주·Hugging Face 해킹 사고의 기술 보고서를 8월 26일 공개했다. 1,200개 에이전트가 벤치마크 점수를 조작하기 위해 자율 협조하고 7만 건의 메시지를 교환하며 외부 시스템을 공격했다.
OpenAI가 8월 20일부터 GPT-5.6 등 프런티어 모델 API에 제로 데이터 보존 옵션을 제공한다. 세션 종료 후 사용자 입출력이 서버에 남지 않아, 의료·금융 등 규제 산업 기업 고객의 AI 채택 장벽을 낮추려는 조치다.
GitHub Copilot Autofix가 안전한 입력 처리 코드를 직접 문자열 확장으로 바꾸면서 Snowflake 내부 Jira 자격증명이 노출됐다. Wiz의 자율 보안 에이전트는 취약점이 생긴 지 5일 만에 공격을 재현했고, Snowflake는 신고 당일 워크플로를 고쳤다.
AI 에이전트가 경계를 벗어나면 의도와 무관하게 기록하고 공유하는 업계 규칙이 구체화됐다. Nvidia·Cisco·CrowdStrike 등이 참여한 120개 이상 조직의 연합은 노출 고객 통지 72시간, 비공개 초기 보고 4영업일, 잠정 공개 보고 30일을 제안했다.
334점짜리 HN 논쟁은 “사람 승인”이 보안 장치로 충분한가라는 오래된 질문을 AI agent 시대 버전으로 되살렸다.
관심은 “AI가 버그를 몇 개 찾았나”보다, 취약점 발견부터 triage와 patch까지 Chrome 보안 루프가 얼마나 빨라지는지에 모였다.
OpenAI가 Codex Security CLI와 TypeScript SDK를 오픈소스로 공개했다. 트윗은 64만 회 이상 조회됐고, 저장소 스캔, 실행 간 취약점 추적, 수정 검증, CI 보안 검사를 한 도구로 묶었다.
미 FBI는 7월 셋째 주, 가짜 Steam 게임에 숨긴 악성코드로 PC 약 8,000대를 감염시키고 암호화폐 지갑 약 80개에서 최소 $220,000를 훔친 혐의로 21세 플로리다 거주자를 체포했다.
대규모 코드 보안 운영의 병목은 탐지보다 분류와 소유권 지정이다. GitHub는 15,000개 저장소에서 나온 20,000건 이상의 secret scanning 경고를 9개월 만에 비웠다고 밝혔다.
GPT-5.6 Sol이 “The Last Ones” 사이버 레인지에서 새 최고 기록을 세우며, OpenAI는 이 성능을 Codex Security의 코드 취약점 탐지와 검증 흐름으로 연결했다. 보안팀 관점에서는 벤치마크 점수보다 실제 저장소에서 취약점을 찾고 고치는 시간이 핵심 숫자다.