ChatGPT Voice가 macOS와 Windows 데스크톱 앱에 들어오며 음성만으로 Codex와 ChatGPT Work의 여러 agent를 조율할 수 있게 됐다. 조회수 260만 회를 넘긴 이 트윗은 음성 인터페이스가 단순 대화에서 작업 실행 계층으로 이동하는 신호다.
#codex
RSS 피드
GPT-5.6 Sol이 “The Last Ones” 사이버 레인지에서 새 최고 기록을 세우며, OpenAI는 이 성능을 Codex Security의 코드 취약점 탐지와 검증 흐름으로 연결했다. 보안팀 관점에서는 벤치마크 점수보다 실제 저장소에서 취약점을 찾고 고치는 시간이 핵심 숫자다.
OpenAI의 agent 제품군 사용량이 1주일 사이 2.5배 늘었다는 Sam Altman의 수치가 나왔다. Codex와 ChatGPT Work가 실험용 도구를 넘어 반복 업무 흐름에 들어가고 있는지 볼 지표다.
OpenAI가 GPT-5.6 Sol·Terra·Luna를 ChatGPT, Codex, API에 풀기 시작했다. 스레드에는 Coding Agent Index 80.0, Claude Fable 5 대비 +2.8점, 비용 약 3분의 1 절감이라는 비교가 함께 제시됐다.
코딩 에이전트 보안의 논점은 “.env를 읽지 말라”보다 넓다. 열린 Codex issue와 HN 댓글은 ignore 규칙, sandbox, Unix 권한, 컨테이너 경계가 어디서 나뉘는지 파고들었다.
GPT-5.6은 단순한 모델 미리보기가 아니라 배포 절차 자체의 변화다. Sol은 Terminal-Bench 2.1 SOTA, ExploitBench에서 Mythos Preview 대비 약 1/3 출력 token이라는 수치를 내세우지만, 첫 접근권은 정부와 공유된 trusted partner로 제한된다.
에이전트형 도구가 실험용 코딩 보조를 넘어 사내 업무 운영 방식으로 들어가고 있다. OpenAI는 전사적으로 Codex가 더 복잡하고 장시간 실행되는 교차 기능 업무에 쓰인다고 밝혔다.
Codex가 코딩 도구를 넘어 지식노동의 실행 계층으로 이동하고 있다. OpenAI의 새 Economic Research는 조직 사용자 중 비개발자 Codex 사용자가 2025년 8월 이후 189배 늘었고, 개인 사용자 70.2%가 1시간 이상 걸릴 작업을 맡겼다고 집계했다.
GPT-5.5-Cyber는 CyberGym 85.6%를 기록했고 Codex Security는 30,000개 이상 코드베이스를 훑었다. 보안 AI의 무게중심이 “찾기”에서 “검증하고 고치기”로 이동한다.
취약점 탐지가 빨라진 뒤 남은 병목은 실제 패치다. OpenAI는 GPT-5.5-Cyber가 CyberGym에서 85.6%를 기록했고 Codex Security가 3만 개 이상 코드베이스를 스캔했다고 밝혔다.
관심은 버그 제보 자체보다 AI coding tool이 로컬 머신에서 얼마나 조용히 많은 상태를 남기는지에 모였다.
기업용 ChatGPT와 Codex 사용량을 한 화면에서 비용 단위로 추적하는 관리 기능이 열렸다. 팀·사용자·모델별 AI credit 흐름을 보여주고, 기본 한도와 그룹별 한도, 개인 예외를 나눠 설정할 수 있다.