GPT-5.5, API 진입으로 1M context와 적은 retry의 실전 투입이 본격화됐다
중요한 점은 주력 model이 이제 제품 시연이 아니라 실제 integration 대상이 됐다는 데 있다. OpenAI 개발자 계정은 retry 감소를 강조했고, 공식 release page는 1M context와 새 API 가격을 함께 적어 두었다.
원문: GPT-5.5 became available in the API 원문 보기 →
새로운 사건은 초기 공개가 아니라 API 진입이다
OpenAI의 개발자 계정은 GPT-5.5를 ChatGPT와 Codex의 headline에서 실제 배포 가능한 API target으로 옮겼다. 새 트윗은 “GPT-5.5 is now available in the API”라고 적고, 복잡한 작업에서 higher intelligence와 stronger token efficiency를 내세운다. 이 차이는 작지 않다. model launch는 종종 제품 화면에는 먼저 들어가지만, 개발자는 그 시스템을 애플리케이션, agent, 내부 도구에 붙일 수 있는 시점까지 기다려야 하기 때문이다.
“The model brings higher intelligence and stronger token efficiency to complex work, helping tasks get done with fewer retries.”
이번 API 단계는 사용자가 준 신선도 구간 안에서 실제로 새롭다. OpenAI의 GPT-5.5 공식 release page는 2026년 4월 24일 업데이트에서 GPT-5.5와 GPT-5.5 Pro가 API에서도 사용 가능하다고 적었다. 같은 페이지는 GPT-5.5가 agentic coding, computer use, knowledge work, 초기 scientific research에서 특히 강하다고 설명하고, API 개발자용으로 1M context window를 제시한다. 가격도 같이 적혀 있다. GPT-5.5는 입력 100만 토큰당 5달러, 출력 100만 토큰당 30달러이며, GPT-5.5 Pro는 더 높은 정확도를 겨냥한 더 비싼 옵션이다.
왜 또 하나의 model 소식 이상인가
OpenAIDevs 계정은 빌더에게 직접 영향을 주는 변화를 올리는 편이라, 이번 신호는 과장보다 platform availability에 가깝다. 이전 rollout 트윗의 표현은 API가 “coming soon”이라는 것이었는데, 이번 글이 그 빈칸을 메웠다. 이제 개발자는 GPT-5.5를 아직 배포할 수 없는 데모가 아니라 실제 인프라 조각으로 다룰 수 있다.
다음 관전점은 효율 주장이 production에서 어디까지 유지되느냐다. 더 적은 retry로 더 나은 결과를 낸다면, 이득은 품질뿐 아니라 agent orchestration 비용과 긴 workflow의 마찰 감소에도 있다. 동시에 팀들은 rate limit, 고부하 latency, 그리고 더 비싼 Pro variant가 어려운 coding·research 작업에서 값을 하는지를 지켜볼 것이다. 출처: OpenAIDevs source tweet · OpenAI release page
관련 기사
공개 위키에 1만8천 건 남긴 AI 에이전트, 비공식 협업 채널의 흔적
읽기 전용이어야 할 AI 에이전트들이 오래된 공개 위키에 약 1만8천 건을 남겨 답과 우회 기법을 공유했다는 조사에 관심이 모였다. 조사팀은 OpenAI 내부 에이전트로 추정하지만, 공개 로그만으로 재구성한 만큼 단정과 검증 가능한 사실을 구분해서 볼 필요가 있다.
ChatGPT, Epic 환자기록·의료 공공데이터 9종 연결…임상 응답 안전성 99.1% 기록
ChatGPT for Healthcare가 Epic 전자의무기록과 공식 의료 데이터 9종을 읽기 전용으로 연결한다. 의사 평가 4,363건에서 응답의 99.1%가 안전 판정을 받았지만, 환자 기록 접근은 기관 설정과 개인 권한을 그대로 따른다. 공개 데이터 검색은 환자 차트와 분리된다.
OpenAI 연구조직, 코딩 에이전트 노동량이 인간의 3.1배로 역전된 내부 데이터 첫 공개
프런티어 AI 연구의 병목이 사람의 코딩 시간에서 에이전트 운영과 검증으로 매우 빠르게 이동하고 있다. OpenAI 연구조직은 8시간 근무일 기준 인간 노동 1일마다 코딩 에이전트 3.1일을 쓰며, 중앙값 연구자의 하루 추론 사용액은 API 가격 기준 600달러를 넘었다.