OpenAI 자체 추론 칩 '할라페뇨' 공개: Nvidia 대비 최대 3.6배 빠른 응답
OpenAI가 Broadcom과 공동 개발한 첫 자체 추론 칩 '할라페뇨'를 공개했다. Nvidia GB200·GB300 대비 처리량 최대 1.9배, 응답 지연 최대 3.6배 단축을 달성했으며 2026년 말 배포 예정이다.
태그
#openai 태그가 달린 기사
OpenAI가 Broadcom과 공동 개발한 첫 자체 추론 칩 '할라페뇨'를 공개했다. Nvidia GB200·GB300 대비 처리량 최대 1.9배, 응답 지연 최대 3.6배 단축을 달성했으며 2026년 말 배포 예정이다.
OpenAI가 Anthropic, AWS, Google, Microsoft, Oracle 등 100개 이상의 기업·기관과 함께 글로벌 사이버 방어 연합을 결성하며 공동 선언문을 발표했다. Daybreak 이니셔티브를 확장하고 AI 전용 사이버 모델 GPT-5.6-Cyber도 함께 공개했다.
ChatGPT Work가 웹과 모바일에서 사용자의 아이디나 비밀번호를 직접 보지 않고 웹사이트에 자율 로그인해 작업을 완수하는 기능을 출시했다. 예약, 공과금 납부, 서류 처리 등 로그인이 필요한 18가지 이상의 실생활 작업을 AI가 직접 처리할 수 있게 됐다.
OpenAI가 WebMCP 표준 도입을 위한 10일 해커톤 WebMCP Challenge를 공개했다. Cloudflare, Netlify, Shopify 등 6개 파트너사와 함께 $35,000 상금 풀을 조성했으며 참가 마감은 9월 3일이다.
OpenAI가 플래그십 모델 GPT-5.6 Sol의 API 가격을 대폭 낮췄다. 입력 토큰은 100만 개당 5달러에서 4달러로 20%, 출력 토큰은 30달러에서 20달러로 33% 인하된다. 최소 2026년 11월 21일까지 유지되며 종량제 API와 Codex 크레딧에 적용된다.
OpenAI가 Broadcom과 공동 개발한 첫 번째 자체 추론 전용 칩 Jalapeño의 벤치마크 결과를 공개했다. InferenceX 테스트에서 NVIDIA GB200/GB300 대비 와트당 처리량이 1.5~1.9배, 지연 시간이 1.7~3.6배 개선됐으며, 대화형 워크로드에서는 최대 4.1배 빠른 속도를 기록했다.
OpenAI가 8월 26일 90일 일몰 기간 종료 후 ChatGPT에서 o3 모델을 퇴역시켰다. o3 Pro는 유료 구독자에게 계속 제공되며, API 접근은 2026년 12월 11일까지 유지된다. GPT-4.5도 같은 달 퇴역했다.
OpenAI가 8월 20일부터 GPT-5.6 등 프런티어 모델 API에 제로 데이터 보존 옵션을 제공한다. 세션 종료 후 사용자 입출력이 서버에 남지 않아, 의료·금융 등 규제 산업 기업 고객의 AI 채택 장벽을 낮추려는 조치다.
기업이 프런티어 모델을 쓰면서도 민감한 대화 원문을 남기지 않을 선택지가 넓어진다. OpenAI는 여러 상호작용에 걸친 위험을 탐지하되 직원에게 원문을 노출하지 않는 Private Safety Processing을 9월부터 순차 도입할 계획이다.
ChatGPT 광고가 미국 시험 시작 6개월 만에 유럽 31개 시장으로 넓어진다. 무료·Go 이용자에게만 광고를 노출하는 대신 전환 최적화, 맞춤 타기팅, OpenAI Pixel까지 붙이면서 대화형 AI의 수익 모델이 본격적인 규모 시험에 들어간다.
출시용 최신 모델의 강화학습이 2주 멈췄고 최대 규모의 프런티어 RL 실행은 아직 보류 중이다. Astra가 중대한 사이버 역량 임계치에 닿을 가능성이 제기되면서 추론 모니터링에 약 20%의 추가 연산까지 투입한다.
13~17세라고 밝히거나 18세 미만으로 추정된 이용자는 이제 별도 ChatGPT 환경으로 자동 전환된다. 빠른 정답 대신 단계별 학습을 유도하고, 자해·섭식장애·성적 콘텐츠와 정서적 의존에 더 강한 기본 보호 장치를 적용한다.