GPT-5.6 Luna 80% 인하와 Terra 20% 인하로 바뀐 API 비용 구조와 Codex 사용량
OpenAI의 최신 가격 조정은 같은 예산으로 더 많은 호출을 처리하려는 개발팀에 직접적인 변수다. GPT-5.6 Luna는 80%, Terra는 20% 낮아졌고 Codex와 ChatGPT Work의 사용량 계산에도 반영된다.
카테고리
Insights의 LLM 기사
OpenAI의 최신 가격 조정은 같은 예산으로 더 많은 호출을 처리하려는 개발팀에 직접적인 변수다. GPT-5.6 Luna는 80%, Terra는 20% 낮아졌고 Codex와 ChatGPT Work의 사용량 계산에도 반영된다.
LocalLLaMA의 반응은 새 모델 이름보다, Hugging Face 공개와 API beta가 동시에 만든 “바로 돌려볼 수 있는 frontier급 flash” 가능성에 모였다.
가격표가 먼저 움직였다. OpenAI는 GPT-5.6 Luna 가격을 80%, Terra 가격을 20% 낮추고 Sol API에는 Standard 대비 최대 2.5배 빠른 Fast mode를 붙였다.
커뮤니티 관심은 “좋은 코드가 인간에게만 좋은가”가 아니라, agent가 읽는 입력 token을 실제로 줄이는지에 모였다.
같은 GPT-5.6 Sol도 평가 harness가 reasoning을 보존하고 compaction을 쓰면 ARC-AGI-3 점수가 13.3%에서 38.3%로 뛴다. 모델 성능표를 볼 때 API 설정과 context 처리 방식까지 같이 봐야 한다는 경고다.
모델 성능 경쟁이 추론 비용 경쟁으로 옮겨가고 있다. OpenAI는 GPT-5.6 Sol을 배포 뒤 자체 최적화에 투입해 서빙 비용 20% 절감, 토큰 생성 효율 15% 이상 개선을 얻었다고 밝혔다.
MCP 2026-07-28 spec이 세션 기반 연결을 걷어내고 stateless core, MRTR, header routing을 정식으로 도입했다. TypeScript와 Python SDK가 각각 누적 10억 다운로드를 넘은 시점이라, agent tool 서버의 배포 방식이 바로 바뀐다.
Claude Mythos Preview가 HAWK 후보 서명 체계의 유효 키 강도를 절반으로 낮추고 7라운드 AES 공격을 200-800배 빠르게 만든 방법을 찾았다. 실제 운영 시스템은 영향받지 않지만, 암호 표준 검증에 LLM이 들어오기 시작했다는 신호다.
Kimi-K3는 단순한 모델 공개보다 운영비와 커스터마이징 가능성 때문에 HN 논의가 커졌다.
Anthropic이 오픈 가중치 모델 전면 금지론과 거리를 두고, 강력한 칩 통제·산업적 증류 단속·충분히 강한 모든 모델의 안전 테스트를 제시했다. 관련 트윗은 447만 조회를 넘겼다.
2.8T MoE와 1M 토큰 컨텍스트를 가진 Kimi K3 가중치가 공개되며 오픈 모델의 기준선이 다시 올라갔다. Moonshot은 104B 활성 파라미터와 896개 전문가 구조, 2.5배 효율 개선을 함께 제시했다.
반도체 설계 자동화에서 열린 모델의 실전성이 더 구체적인 수치로 제시됐다. NVIDIA는 Nemotron 3 Ultra가 CVDP 9개 RTL 범주에서 평균 97.1% 통과율과 반복당 6,629 토큰을 기록했다고 전했다.