GPT-5.5, 전문가 12시간짜리 사이버 공격 시뮬레이션 11분에 완료
영국 AI 안전 연구소(AISI)가 OpenAI GPT-5.5의 사이버 역량 평가 결과를 공개했다. GPT-5.5는 인간 전문가 12시간짜리 복잡한 기업 네트워크 침투 시뮬레이션을 단 11분, $1.73 비용으로 완료했다. Anthropic Claude Mythos에 이어 이 기준을 통과한 두 번째 모델로, AI 사이버 역량이 전반적 추세로 확산 중임을 보여준다.
태그
#cybersecurity 태그가 달린 기사
영국 AI 안전 연구소(AISI)가 OpenAI GPT-5.5의 사이버 역량 평가 결과를 공개했다. GPT-5.5는 인간 전문가 12시간짜리 복잡한 기업 네트워크 침투 시뮬레이션을 단 11분, $1.73 비용으로 완료했다. Anthropic Claude Mythos에 이어 이 기준을 통과한 두 번째 모델로, AI 사이버 역량이 전반적 추세로 확산 중임을 보여준다.
OpenAI는 사이버 경쟁의 질문을 “누가 더 강한 모델을 갖고 있나”에서 “누가 방어 도구를 더 넓게 배포하나”로 옮기려 한다. 2026년 4월 29일 공개한 계획은 다섯 축으로 정리됐고, 그중 핵심은 방어 접근 확대와 고위험 배치의 가시성 유지다.
Axios에 따르면 OpenAI와 Anthropic은 취약점 탐지·악용 능력이 강한 신형 모델을 두고 미 하원 국토안보위원회에 비공개 브리핑을 했다. AI 위험 논의가 추상적 미래론에서, 전력망과 병원 같은 인프라 방어 문제로 옮겨가고 있다는 신호다.
r/singularity는 Firefox에서 271건을 잡았다는 숫자보다, 앞으로 브라우저와 대형 코드베이스가 거의 상시 패치 모드로 들어갈 수 있다는 점에 더 크게 반응했다. 댓글도 야간 보안 릴리스가 기본이 되는 것 아니냐는 불안과 현실론이 섞였다.
HN은 “AI cybersecurity is not proof of work”를 단순한 anti-hype 글로 읽지 않았다. 핵심 논쟁은 더 많은 GPU와 더 긴 sampling이 bugs를 찾는 충분조건인지, 아니면 model capability와 threat model이 병목인지였다.
중요한 점은 더 강한 모델 이름보다 누가 어떤 통제로 쓰느냐다. OpenAI는 4월 14일 최고 Trusted Access 계층에서 GPT-5.4-Cyber를 요청할 수 있다고 적었고, 연결된 글에서는 프로그램을 수천 명의 검증된 defender와 수백 개 팀으로 넓힌다고 밝혔다.
Artemis는 $70 million을 들고 stealth에서 나와, 보안팀에 더 많은 alert가 아니라 AI-native security brain이 필요하다고 베팅했다. 이 회사는 이미 several seven-figure deals를 닫았고 2026년 말 전 multi-million-dollar ARR을 기대한다고 말했다.
Reuters 분석은 Mythos가 은행권에 먼 미래의 위험이 아니라 바로 지금의 patch timing 문제를 들이민다고 본다. 미국, Canada, Britain의 officials가 이미 금융권과 만났고, Anthropic은 이 모델이 high severity·critical severity 취약점을 thousands 단위로 찾아냈다고 설명했다.
보안팀 입장에서는 새 모델 이름보다 접근 정책 변화가 더 크다. OpenAI는 Trusted Access for Cyber를 수천 명의 검증된 개인 수비자와 수백 개 팀으로 넓히고, 상위 등급에는 GPT-5.4-Cyber 신청 경로를 열었다.
OpenAI가 defensive cybersecurity용으로 조정한 GPT-5.4-Cyber를 검증된 개인 수비자와 인증된 팀에 열기 시작했다. 중요한 점은 TAC가 소수 pilot을 넘어 수천 명의 defender와 수백 개 팀으로 커진다는 데 있다.
r/singularity에서 확산된 AISI 평가는 Claude Mythos Preview가 expert CTF와 multi-stage cyber range에서 이전 frontier model보다 한 단계 앞선 성능을 보였다고 정리한다. 핵심은 “위험하다”는 수사가 아니라, 32-step corporate attack simulation을 end-to-end로 푼 첫 model이 나왔다는 점이다.
Anthropic는 April 7, 2026에 Project Glasswing을 발표하며 Claude Mythos Preview를 defensive vulnerability discovery에 투입했다. 회사는 이 모델이 이미 thousands of high-severity flaws를 찾았다고 주장하며, 최대 $100 million usage credits와 $4 million open-source donations도 약속했다.