GPT-5.6 Sol 제한 공개, cyber 안전장치와 $5 입력가의 의미
GPT-5.6은 단순한 모델 미리보기가 아니라 배포 절차 자체의 변화다. Sol은 Terminal-Bench 2.1 SOTA, ExploitBench에서 Mythos Preview 대비 약 1/3 출력 token이라는 수치를 내세우지만, 첫 접근권은 정부와 공유된 trusted partner로 제한된다.
태그
#openai 태그가 달린 기사
GPT-5.6은 단순한 모델 미리보기가 아니라 배포 절차 자체의 변화다. Sol은 Terminal-Bench 2.1 SOTA, ExploitBench에서 Mythos Preview 대비 약 1/3 출력 token이라는 수치를 내세우지만, 첫 접근권은 정부와 공유된 trusted partner로 제한된다.
에이전트형 도구가 실험용 코딩 보조를 넘어 사내 업무 운영 방식으로 들어가고 있다. OpenAI는 전사적으로 Codex가 더 복잡하고 장시간 실행되는 교차 기능 업무에 쓰인다고 밝혔다.
Codex가 코딩 도구를 넘어 지식노동의 실행 계층으로 이동하고 있다. OpenAI의 새 Economic Research는 조직 사용자 중 비개발자 Codex 사용자가 2025년 8월 이후 189배 늘었고, 개인 사용자 70.2%가 1시간 이상 걸릴 작업을 맡겼다고 집계했다.
ChatGPT의 기본 사용 경험이 더 많은 의사결정·추천 질의를 겨냥해 조정된다. OpenAI는 GPT-5.5 Instant가 복잡한 제약을 더 안정적으로 따르고, 유료 사용자는 6월 24일, 무료 사용자는 6월 25일부터 받는다고 밝혔다.
LLM 경쟁의 병목이 모델 크기에서 추론 인프라로 이동하고 있다. OpenAI는 Broadcom과 만든 Jalapeno가 9개월 만에 테이프아웃됐고 2026년 말부터 기가와트 규모 배치를 목표로 한다고 밝혔다.
GPT-5.5-Cyber는 CyberGym 85.6%를 기록했고 Codex Security는 30,000개 이상 코드베이스를 훑었다. 보안 AI의 무게중심이 “찾기”에서 “검증하고 고치기”로 이동한다.
취약점 탐지가 빨라진 뒤 남은 병목은 실제 패치다. OpenAI는 GPT-5.5-Cyber가 CyberGym에서 85.6%를 기록했고 Codex Security가 3만 개 이상 코드베이스를 스캔했다고 밝혔다.
기업용 ChatGPT와 Codex 사용량을 한 화면에서 비용 단위로 추적하는 관리 기능이 열렸다. 팀·사용자·모델별 AI credit 흐름을 보여주고, 기본 한도와 그룹별 한도, 개인 예외를 나눠 설정할 수 있다.
한국 삼성전자 전 직원과 전 세계 DX 부문 직원이 ChatGPT Enterprise와 Codex를 쓰게 된다. OpenAI는 이번 배포가 자사 최대급 기업 도입 사례이며, 한국의 Codex 주간 활성 사용자가 2026년 2월 1일 이후 약 800% 늘었다고 밝혔다.
정렬 연구의 초점이 벤치마크 통과에서 압박 속 지속성으로 이동했다. OpenAI는 12개 영역의 대화 데이터로 유익한 특성을 강화하고, 적대적 프롬프트와 해로운 파인튜닝 이후에도 유지되는지 시험했다.
무료 ChatGPT의 건강 답변 품질이 유료 추론 모델 수준에 가까워졌다. OpenAI는 매주 2억3000만 명 이상이 건강·웰니스 질문을 한다고 밝혔고, GPT-5.5 Instant를 그 접점에 배치했다.
매주 2억3000만 명이 건강 질문에 쓰는 ChatGPT에서 사실성 문제가 크게 줄었다. GPT-5.5 Instant는 HealthBench Professional 등 의사 주도 평가에서 frontier Thinking 모델에 가까운 성능을 보였고, 무료 사용자에게도 제공된다.