무료 ChatGPT의 건강 답변 품질이 유료 추론 모델 수준에 가까워졌다. OpenAI는 매주 2억3000만 명 이상이 건강·웰니스 질문을 한다고 밝혔고, GPT-5.5 Instant를 그 접점에 배치했다.
#gpt-5.5
RSS 피드매주 2억3000만 명이 건강 질문에 쓰는 ChatGPT에서 사실성 문제가 크게 줄었다. GPT-5.5 Instant는 HealthBench Professional 등 의사 주도 평가에서 frontier Thinking 모델에 가까운 성능을 보였고, 무료 사용자에게도 제공된다.
OpenAI가 2026년 5월 5일 GPT-5.5 Instant를 ChatGPT의 기본 모델로 교체했다. GPT-5.3 Instant 대비 환각이 52.5% 감소하고 응답이 30% 더 간결해졌으며, 과거 대화와 파일을 활용한 개인화 기능도 강화됐다.
OpenAI가 GPT-5.5 Instant를 ChatGPT의 새 기본 모델로 배포했다. 의료·법률·금융 등 고위험 쿼리에서 환각이 52.5% 감소했고, Gmail 기반 개인화와 메모리 출처 표시 기능도 추가됐다.
Sam Altman이 4월 30일 사이버 보안 전용 프론티어 AI 모델 GPT-5.5-Cyber의 출시를 발표했다. 초기에는 핵심 사이버 방어자들에게만 제공되며, 기업과 국가 인프라 보안 강화를 목표로 한다.
영국 AI 안전 연구소(AISI)가 OpenAI GPT-5.5의 사이버 역량 평가 결과를 공개했다. GPT-5.5는 인간 전문가 12시간짜리 복잡한 기업 네트워크 침투 시뮬레이션을 단 11분, $1.73 비용으로 완료했다. Anthropic Claude Mythos에 이어 이 기준을 통과한 두 번째 모델로, AI 사이버 역량이 전반적 추세로 확산 중임을 보여준다.
HN은 농담보다 원인을 봤다. OpenAI가 Nerdy 성격 보상 신호 때문에 goblin 비유가 GPT-5 계열 전반으로 번졌다고 풀어낸 글이다.
미 연방기관이 frontier AI를 쓰려면 성능보다 조달과 보안이 먼저 막는다. OpenAI는 2026년 4월 27일 FedRAMP 20x Moderate를 받아 ChatGPT Enterprise와 API를 연방 기준 환경에 올렸고, GPT-5.5까지 포함했다.
이 숫자가 중요한 이유는 출시 당일 홍보 문구가 아니라 외부 커뮤니티 평가가 GPT-5.5의 현재 위치를 보여주기 때문이다. Arena는 GPT-5.5가 Search Arena 2위, Expert Arena 5위, Code Arena 9위에 올랐고, 코딩 점수는 GPT-5.4보다 50포인트 뛰었다고 적었다.
OpenAI가 내세운 핵심은 단순 성능 업데이트가 아니다. Terminal-Bench 2.0 82.7%, SWE-Bench Pro 58.6%와 함께 GPT-5.4급 지연을 유지한다고 밝히며, 길고 지저분한 작업을 맡기는 코딩 에이전트 경쟁의 기준을 다시 올렸다.
OpenAI가 이번엔 가장 불편한 질문에 현상금을 걸었다. GPT-5.5 Bio Bug Bounty는 Codex Desktop의 GPT-5.5를 상대로 바이오 안전 질문 5개를 한 번에 무너뜨리는 범용 탈옥 프롬프트에 $25,000을 내걸고, 정식 테스트를 4월 28일 시작한다.