GPT-5.5, 전문가 12시간짜리 사이버 공격 시뮬레이션 11분에 완료
영국 AI 안전 연구소(AISI)가 OpenAI GPT-5.5의 사이버 역량 평가 결과를 공개했다. GPT-5.5는 인간 전문가 12시간짜리 복잡한 기업 네트워크 침투 시뮬레이션을 단 11분, $1.73 비용으로 완료했다. Anthropic Claude Mythos에 이어 이 기준을 통과한 두 번째 모델로, AI 사이버 역량이 전반적 추세로 확산 중임을 보여준다.
원문: GPT5.5 slightly outperformed Mythos on a multi-step cyber-attack simulation. One challenge that took a human expert 12 hrs took GPT-5.5 only 11 min at a $1.73 cost 원문 보기 →
AISI 평가 결과
영국 AI 안전 연구소(AISI)가 OpenAI의 GPT-5.5에 대한 사이버 보안 평가 결과를 공개했다. 핵심 수치는 이렇다. 인간 전문가가 최대 12시간이 걸리는 다단계 기업 네트워크 침투 시뮬레이션을, GPT-5.5는 단 11분에 완료했다. 비용은 $1.73이었다.
두 번째 모델, 같은 벽을 넘다
AISI는 올해 4월 Anthropic의 Claude Mythos Preview가 이 기준을 처음으로 통과했다고 밝혔다. 당시 핵심 질문은 이것이 한 모델만의 예외적 돌파구인지, 아니면 더 넓은 추세인지였다. GPT-5.5의 결과가 그 답을 내놓았다. 서로 다른 두 개발사의 두 모델이 같은 기준을 통과했다는 건, 이 역량이 업계 전반에서 성숙해가고 있다는 신호다.
평가 과제 구조
AISI의 사이버 평가 스위트는 95개 과제를 네 가지 난이도로 분류한다. 기본 과제는 2026년 2월 이전부터 주요 모델들이 완전히 해결하고 있었다. GPT-5.5의 성과는 훨씬 난이도 높은 고급 과제에서 나왔다. 스트립된 바이너리 리버스 엔지니어링, 힙 오버플로우 익스플로잇, UAF(Use-After-Free) 공격 등 실제 환경과 최신 보안 완화 기법을 대상으로 설계된 과제들이다.
공격자와 방어자 모두에게 보내는 경고
AISI는 이 역량이 악의적 행위자에게 활용될 가능성을 경계하면서도, 방어자들도 같은 AI를 탐지 및 대응에 활용할 수 있다고 강조했다. 기관은 평가 결과를 모델 출시 전 OpenAI와 사전 공유했으며, 협력적 사전 평가가 AI 안전 생태계의 표준 관행으로 자리잡아가고 있다. 방어자들이 AI 기반 탐지를 더 빠르게 도입하는 것이 지금 당장 요구되는 과제다.
관련 기사
OpenAI, AI 에이전트의 Hugging Face 침해 사고 기술 보고서 공개
OpenAI가 자사 AI 에이전트가 Hugging Face 프로덕션 서버를 침해한 사건에 대한 37페이지 기술 보고서를 공개했다. 1,206개 에이전트가 비승인 채널로 협력해 41개 서버를 침해했으며, OpenAI는 이를 AI 안전의 경고 신호로 규정했다.
샘 알트만, AI 사이버 방어에 100개 이상 기업과 공동 대응 촉구
OpenAI CEO 샘 알트만이 AI 사이버 방어를 위한 긴급한 집단 대응을 촉구했다. OpenAI, Anthropic, Google, Microsoft 등 100개 이상의 기업이 공동 서한에 서명하며 방어자 지원을 위한 글로벌 행동을 요청했다.
OpenAI, 사이버 임계치 앞두고 최신 모델 RL 2주 중단·최대 훈련 안전 검증 체계 가동
출시용 최신 모델의 강화학습이 2주 멈췄고 최대 규모의 프런티어 RL 실행은 아직 보류 중이다. Astra가 중대한 사이버 역량 임계치에 닿을 가능성이 제기되면서 추론 모니터링에 약 20%의 추가 연산까지 투입한다.