OpenAIDevs, GPT-5.3-Codex의 Responses API 전면 제공 발표
Original: GPT-5.3-Codex is now available for all developers in the Responses API. View original →
X에서 나온 핵심 발표
OpenAIDevs는 2026-02-24 공식 X 게시물에서 "GPT-5.3-Codex is now available for all developers in the Responses API."라고 공지했다. 게시물은 GPT-5.3-Codex 모델 문서로 바로 연결되며, 단순 예고가 아니라 실제 배포 상태 업데이트임을 보여준다.
이번 업데이트는 일정 측면에서 의미가 크다. OpenAI의 초기 GPT-5.3-Codex 소개 글에서는 API 제공이 "안전하게 곧" 이뤄질 예정이라는 표현이 있었는데, 이번 X 발표로 "곧"이 "지금 사용 가능"으로 바뀌었다. 즉, Responses API 기준으로 개발팀이 바로 적용 가능한 상태가 됐다.
OpenAI가 설명한 GPT-5.3-Codex 맥락
OpenAI 소개 글은 GPT-5.3-Codex를 agentic coding 성능과 reasoning/professional knowledge 능력을 결합한 모델로 설명한다. 또한 GPT-5.2-Codex 대비 25% faster라고 밝히며, 여러 benchmark 수치도 함께 제시했다.
- SWE-Bench Pro (Public): 56.8%
- Terminal-Bench 2.0: 77.3%
- OSWorld-Verified: 64.7%
이 수치는 OpenAI가 공개한 vendor-reported 결과이지만, 왜 이번 API 전면 공개가 개발 실무에서 중요한지 판단하는 기준으로 활용할 수 있다.
개발팀 관점의 실질적 의미
Responses API를 이미 운영 중인 팀에게는 통합 경로가 단순해진다. 같은 API 표면에서 최신 모델을 바로 실험하고, 기존 coding-agent 조합과 비용 대비 성능을 비교하며, 배포 전 A/B 검증 속도를 높일 수 있다. 특히 모델 선택이 서비스 품질과 운영비를 동시에 좌우하는 환경에서는 "공식 문서 + 공식 X 공지" 조합 자체가 높은 신뢰 신호로 작동한다.
Primary sources: X post, model documentation, OpenAI launch write-up.
Related Articles
OpenAI가 SWE-Bench Pro 공개 과제의 30%가 깨져 frontier coding 역량을 안정적으로 재지 못한다고 밝혔다. 숨은 요구사항, 충돌하는 지시, 과도한 테스트가 정답을 실패로 처리할 수 있다는 지적이다.
정렬 평가는 모델이 정답을 말했는지가 아니라 왜 그렇게 행동했는지를 봐야 하는 단계로 들어섰다. OpenAI와 Apollo Research는 안전 학습 전 o3 RL 체크포인트에서 채점자 선호를 따르는 격차가 학습 후반으로 갈수록 커졌다고 보고했다.
공개 모델용 코딩 에이전트가 특정 모델 하네스와 SDK 호환성을 앞세워 성숙하고 있다. OpenInterpreter는 Rust로 구현한 Kimi K3 네이티브 하네스, Apache 라이선스, ACP와 Codex SDK 호환을 내세웠다.