OpenAI GPT-5.3-Codex 출시 — 자기 자신을 디버깅한 25% 더 빠른 에이전틱 코딩 모델
OpenAI가 GPT-5.3-Codex를 공개하며 SWE-Bench Pro 등 실제 소프트웨어 엔지니어링 벤치마크에서 SOTA 달성. 개발 과정에서 초기 버전이 자신의 학습을 디버깅하고 배포를 관리했다.
에이전틱 코딩의 새 기준
OpenAI는 2월 5일 GPT-5.3-Codex를 출시하며 가장 강력한 에이전틱 코딩 시스템을 선보였다. 이 모델은 GPT-5.2-Codex의 프론티어 코딩 성능과 GPT-5.2의 추론 및 전문 지식 능력을 결합했으며, 기존보다 25% 더 빠르다.
벤치마크 성능
- Terminal-Bench 2.0: 77.3%
- OSWorld-Verified: 64.7%
- SWE-Bench Pro: 실제 소프트웨어 엔지니어링 작업 평가에서 SOTA 달성
자기개선 AI
GPT-5.3-Codex의 가장 주목할 점은 자기 자신의 개발에 기여했다는 것이다. OpenAI Codex 팀은 초기 버전을 사용해 모델 자신의 학습을 디버깅하고, 배포를 관리하며, 테스트 결과와 평가를 진단했다. 팀은 "개발 속도가 얼마나 빨라졌는지 놀랐다"고 밝혔다.
장기 복합 작업 처리
GPT-5.3-Codex는 단순한 코드 작성을 넘어 리서치, 도구 사용, 다단계 실행을 포함하는 장기 복합 작업을 처리할 수 있다. OpenAI는 "Codex가 코드를 작성하고 검토하는 에이전트에서 개발자와 전문가가 컴퓨터에서 할 수 있는 거의 모든 작업을 수행하는 에이전트로 진화했다"고 설명했다.
보안 우려와 제한적 출시
OpenAI는 GPT-5.3-Codex의 강력한 코드 작성·테스트·추론 능력이 동시에 심각한 사이버보안 우려를 제기한다고 인정했다. 이에 따라 비정상적으로 엄격한 통제와 함께 모델을 출시하고 있으며, 완전한 개발자 API 액세스는 지연되고 있다.
가용성
GPT-5.3-Codex는 유료 ChatGPT 플랜에서 앱, CLI, IDE 확장, 웹을 통해 이용 가능하다. API 액세스는 안전성 검증 후 제공될 예정이다.
관련 기사
OpenAI, 프런티어 모델에 제로 데이터 보존 옵션 도입
OpenAI가 8월 20일부터 GPT-5.6 등 프런티어 모델 API에 제로 데이터 보존 옵션을 제공한다. 세션 종료 후 사용자 입출력이 서버에 남지 않아, 의료·금융 등 규제 산업 기업 고객의 AI 채택 장벽을 낮추려는 조치다.
OpenAI, Codex 주간 이용자 300만 돌파 발표… 1백만 명 늘 때마다 usage limits 재설정
OpenAI의 Tibo Sottiaux는 2026년 4월 7일 X에서 Codex 주간 이용자가 300만 명에 도달했다고 밝혔다. 그는 2백만 명에서 3백만 명까지 한 달도 채 걸리지 않았다고 설명했고, OpenAI가 1백만 명이 추가될 때마다 1천만 명까지 usage limits를 재설정하겠다고 말했다.
OpenAI, GPT-5.4 공개... ChatGPT·API·Codex 전반에 투입
OpenAI는 GPT-5.4를 전문 업무용으로 가장 강력하고 효율적인 frontier model로 소개했다. reasoning, coding, computer use를 함께 끌어올리면서 ChatGPT, API, Codex 전반에 동시에 배치한 점이 핵심이다.