본문으로 건너뛰기
부식 중

OpenAI, GPT-5 공개: 추론·코딩·멀티모달 전반 성능 지표 제시

OpenAI는 2025-08-07에 GPT-5를 공개하며 ChatGPT와 API 동시 제공 전략을 발표했다. GPT-4o 대비 환각 45% 감소, HealthBench Hard 44.6 등 핵심 벤치마크 지표를 제시해 제품·개발자 양쪽에서의 전환 신호를 만들었다.

원문: Introducing GPT-5 원문 보기 →

LLM 작성자 Insights AI 1분 소요 40 조회 출처

출시 핵심

OpenAI는 2025-08-07 자 공식 발표에서 GPT-5를 공개하고, ChatGPT와 API 양쪽에 동시 적용한다고 밝혔다. 발표문에 따르면 GPT-5는 단일 모델이 아니라 라우팅 시스템을 포함한 통합 구조로 설명된다. 쉬운 질의에는 빠르게 응답하고, 어려운 질의에는 더 많은 추론 단계를 할당해 정확도를 높이는 접근이다.

출시 접근성도 함께 제시됐다. OpenAI는 런치 시점에 ChatGPT와 API에서 GPT-5 계열을 제공하고, Team은 즉시, Enterprise와 Edu는 그 다음 주에 확대한다고 명시했다. 무료 사용자도 GPT-5를 사용할 수 있고, Plus/Pro는 더 높은 한도와 추가 기능을 받는 구조다.

공개된 성능 수치

발표 페이지의 수치에서 가장 눈에 띄는 항목은 안정성과 장문 작업 처리다. OpenAI는 GPT-5가 GPT-4o 대비 hallucination을 45% 줄였다고 제시했다. 또한 HealthBench Hard 점수는 16.4에서 44.6으로 상승한 값이 공개됐다.

같은 문서에서 제시된 대표 벤치마크는 MMMU 77.2, GPQA 88.4, AIME'25 87.6, SWE-bench Verified 74.9다. OpenAI는 이 수치를 통해 GPT-5가 범용 질의응답뿐 아니라 코드 수정·검증, 과학 추론 등 고난도 과제에서도 경쟁력 있는 범용 모델임을 강조했다.

제품/개발 생태계 영향

  • ChatGPT 측면: 사용자 체감 품질과 안정성 기준을 재설정하는 업데이트
  • API 측면: gpt-5, gpt-5-mini, gpt-5-nano로 워크로드별 비용·지연 최적화 선택지 제공
  • 운영 측면: System Card와 Safety Evaluations를 함께 공개해 도입 검토 시 거버넌스 자료를 동반

정리하면 이번 발표의 포인트는 단순 모델 네이밍 업데이트가 아니라, OpenAI가 ChatGPT 사용자 경험과 개발자 배포 경로를 동일한 GPT-5 축으로 맞춘 데 있다. 기업 입장에서는 품질 지표와 배포 옵션이 동시에 공개된 점이 실제 전환 판단에 직접적인 근거가 된다.

Source: OpenAI - Introducing GPT-5

공유: 긴글

관련 기사

LLM X/Twitter

GPT-6 Astra, Pro·Enterprise·API 전면 개방과 불투명 추론 논란

OpenAI가 9월 4일 GPT-6 Astra를 ChatGPT Pro, Enterprise, Business Premium 전 사용자와 API에 공개했다. 컴퓨터 사용·소프트웨어 엔지니어링 최고 성능을 주장하지만 추론 과정을 외부에서 관찰하기 어려운 '불투명 재귀' 방식을 도입해 안전성 우려도 제기됐다.

1분 소요 2 조회