GPT-5.6 Luna 80% 인하와 Terra 20% 인하로 바뀐 API 비용 구조와 Codex 사용량
Original: GPT-5.6 Luna price drops 80% as OpenAI cuts Terra 20% View original →
API 비용 구조의 변화
프런티어 모델 경쟁의 초점이 성능만이 아니라 호출당 비용으로 옮겨가고 있다. OpenAI는 2026년 7월 30일 공개 트윗에서 GPT-5.6 계열의 가격과 속도 옵션을 함께 조정했다. 트윗의 핵심 문장은 다음과 같다. 원문 트윗: Starting today, we are reducing prices for GPT-5.6 Luna by 80% and GPT-5.6 Terra by 20%, and offering a faster option for GPT-5.6 Sol in the API.
이번 조정에서 가장 큰 숫자는 Luna의 80% 인하다. Sam Altman은 별도 트윗에서 Luna의 새 가격을 입력 토큰 100만 개당 0.20달러, 출력 토큰 100만 개당 1.20달러라고 적었다. Terra는 20% 낮아져 2달러와 12달러 구간으로 제시됐고, Sol에는 같은 지능 수준에서 최대 2.5배 빠른 Fast mode가 추가됐다. OpenAI의 공식 계정은 Luna와 Terra의 낮아진 가격이 Codex와 ChatGPT Work에서 사용량이 계산되는 방식에도 반영된다고 설명했다.
이 계정은 보통 모델, API, ChatGPT, Codex 관련 변경을 공식 채널로 확인하는 역할을 한다. 그래서 이번 트윗은 단순한 가격표 변경보다 넓은 의미가 있다. 자동 코드 리뷰, 에이전트 실행, 사내 지식 검색처럼 반복 호출이 많은 워크플로에서는 토큰 단가가 곧 제품 설계의 한계가 된다. 특히 Luna가 저가 계층으로 내려오면 이전에는 작은 모델이나 캐시 전략으로 우회하던 작업을 GPT-5.6 계열 안에서 처리할 여지가 커진다.
다음 관전점은 실제 청구서와 지연시간이다. 가격이 낮아져도 컨텍스트 길이, 출력량, 도구 호출 빈도에 따라 총비용은 달라진다. 개발팀은 Codex 자동 리뷰와 ChatGPT Work의 사용량 산정이 어느 정도 절감으로 이어지는지, Sol Fast mode의 2배 가격이 최대 2.5배 속도를 정당화하는지 확인해야 한다.
Related Articles
모델 성능 경쟁이 추론 비용 경쟁으로 옮겨가고 있다. OpenAI는 GPT-5.6 Sol을 배포 뒤 자체 최적화에 투입해 서빙 비용 20% 절감, 토큰 생성 효율 15% 이상 개선을 얻었다고 밝혔다.
OpenAI가 GPT-5.6 Sol·Terra·Luna를 ChatGPT, Codex, API에 풀기 시작했다. 스레드에는 Coding Agent Index 80.0, Claude Fable 5 대비 +2.8점, 비용 약 3분의 1 절감이라는 비교가 함께 제시됐다.
GPT-5.6 Sol이 “The Last Ones” 사이버 레인지에서 새 최고 기록을 세우며, OpenAI는 이 성능을 Codex Security의 코드 취약점 탐지와 검증 흐름으로 연결했다. 보안팀 관점에서는 벤치마크 점수보다 실제 저장소에서 취약점을 찾고 고치는 시간이 핵심 숫자다.