LLM X/Twitter 3d ago 1 min read
최상위 모델의 지능을 유지하면서 응답 속도를 최대 14배 높인 점이 핵심이다. Cerebras 기반 GPT-5.6 Sol은 초당 최대 750개 출력 토큰을 생성하며, 우선 일부 API 고객에게 제공된다. 가격과 일반 공개 일정은 아직 나오지 않았고, 확대는 처리 용량에 맞춰 진행된다.
최상위 모델의 지능을 유지하면서 응답 속도를 최대 14배 높인 점이 핵심이다. Cerebras 기반 GPT-5.6 Sol은 초당 최대 750개 출력 토큰을 생성하며, 우선 일부 API 고객에게 제공된다. 가격과 일반 공개 일정은 아직 나오지 않았고, 확대는 처리 용량에 맞춰 진행된다.
GPT-5.6 Sol이 “The Last Ones” 사이버 레인지에서 새 최고 기록을 세우며, OpenAI는 이 성능을 Codex Security의 코드 취약점 탐지와 검증 흐름으로 연결했다. 보안팀 관점에서는 벤치마크 점수보다 실제 저장소에서 취약점을 찾고 고치는 시간이 핵심 숫자다.