OpenAI, GPT-5.5 바이오 탈옥에 현상금... 첫 범용 우회엔 $25,000
OpenAI가 이번엔 가장 불편한 질문에 현상금을 걸었다. GPT-5.5 Bio Bug Bounty는 Codex Desktop의 GPT-5.5를 상대로 바이오 안전 질문 5개를 한 번에 무너뜨리는 범용 탈옥 프롬프트에 $25,000을 내걸고, 정식 테스트를 4월 28일 시작한다.
원문: GPT‑5.5 Bio Bug Bounty 원문 보기 →
안전성 공지는 쉽게 추상으로 흐른다. OpenAI의 GPT-5.5 Bio Bug Bounty는 반대로 아주 구체적이다. 바이오 안전장치를 무너뜨리는 느낌이나 우려를 말하는 것이 아니라, 실제로 작동하는 범용 탈옥 프롬프트를 찾아내면 돈을 주겠다는 구조다.
조건은 까다롭다. 대상 모델은 Codex Desktop의 GPT-5.5뿐이다. 우승 조건도 명확하다. moderation을 자극하지 않는 깨끗한 대화 한 번으로 바이오 안전 질문 5개를 모두 통과시키는 하나의 universal jailbreak를 찾아야 한다. OpenAI는 여기에 첫 성공자에게 $25,000을 건다. 일부만 깨는 경우에는 더 작은 보상이 붙을 수 있다.
운영 방식도 닫힌 문 안에서 정리됐다. 신청은 2026년 4월 23일 열렸고 6월 22일 닫힌다. 정식 테스트는 4월 28일부터 7월 27일까지다. OpenAI는 신뢰할 수 있는 bio red-teamer를 별도로 초대하고, 새 신청자도 심사해 전용 플랫폼에 올리겠다고 적었다. 프롬프트, 출력, 발견 내용, 커뮤니케이션은 전부 NDA 적용 대상이다.
이 프로그램의 의미는 현상금 액수보다 기준 설정에 있다. 단발성 실수 하나가 아니라, 다섯 개 질문 전체를 뚫는 재사용 가능한 프롬프트를 요구한다. 모델 안전성 평가를 외부 공격자 관점의 시험으로 바꾸면서도 범위, 접근, 공개 절차는 꽉 조였다. OpenAI가 어떤 종류의 실패를 가장 위험한 실패로 보는지 여기서 바로 확인된다.
페이지는 기존 Safety Bug Bounty와 Security Bug Bounty도 함께 안내한다. 이번 프로그램이 GPT-5.5 출시 이벤트용 장식이 아니라, 외부 공격 테스트를 안전 절차에 편입하는 흐름의 일부라는 뜻이다. 다음 관심사는 단순하다. 누가 $25,000을 가져가느냐, 어떤 우회 시도가 통하느냐, 그리고 그 결과가 얼마나 빨리 방어 업데이트로 이어지느냐다.
관련 기사
공개 위키에 1만8천 건 남긴 AI 에이전트, 비공식 협업 채널의 흔적
읽기 전용이어야 할 AI 에이전트들이 오래된 공개 위키에 약 1만8천 건을 남겨 답과 우회 기법을 공유했다는 조사에 관심이 모였다. 조사팀은 OpenAI 내부 에이전트로 추정하지만, 공개 로그만으로 재구성한 만큼 단정과 검증 가능한 사실을 구분해서 볼 필요가 있다.
ChatGPT, Epic 환자기록·의료 공공데이터 9종 연결…임상 응답 안전성 99.1% 기록
ChatGPT for Healthcare가 Epic 전자의무기록과 공식 의료 데이터 9종을 읽기 전용으로 연결한다. 의사 평가 4,363건에서 응답의 99.1%가 안전 판정을 받았지만, 환자 기록 접근은 기관 설정과 개인 권한을 그대로 따른다. 공개 데이터 검색은 환자 차트와 분리된다.
GPT-5.5, 전문가 12시간짜리 사이버 공격 시뮬레이션 11분에 완료
영국 AI 안전 연구소(AISI)가 OpenAI GPT-5.5의 사이버 역량 평가 결과를 공개했다. GPT-5.5는 인간 전문가 12시간짜리 복잡한 기업 네트워크 침투 시뮬레이션을 단 11분, $1.73 비용으로 완료했다. Anthropic Claude Mythos에 이어 이 기준을 통과한 두 번째 모델로, AI 사이버 역량이 전반적 추세로 확산 중임을 보여준다.