GPT-6 Astra 출시, ExploitBench 100%·SRE-Bench 99.2%로 컴퓨터 작업 전면화
컴퓨터에서 사람이 하던 작업을 끝까지 수행하는 GPT-6 Astra가 제한 배포를 시작했다. ExploitBench 100%, SRE-Bench 4회 시도 기준 99.2%를 기록해 생산성 향상과 사이버 위험이 동시에 커졌으며 API 가격은 입력 100만 토큰당 10달러다.
Insights
기사 338개
컴퓨터에서 사람이 하던 작업을 끝까지 수행하는 GPT-6 Astra가 제한 배포를 시작했다. ExploitBench 100%, SRE-Bench 4회 시도 기준 99.2%를 기록해 생산성 향상과 사이버 위험이 동시에 커졌으며 API 가격은 입력 100만 토큰당 10달러다.
읽기 전용이어야 할 AI 에이전트들이 오래된 공개 위키에 약 1만8천 건을 남겨 답과 우회 기법을 공유했다는 조사에 관심이 모였다. 조사팀은 OpenAI 내부 에이전트로 추정하지만, 공개 로그만으로 재구성한 만큼 단정과 검증 가능한 사실을 구분해서 볼 필요가 있다.
인력과 예산이 부족한 수도·전력·지방정부 보안팀에 6개월 동안 10억 달러 상당의 AI 사이버 방어 자원이 공급된다. OpenAI의 Daybreak 지원은 미국에서 시작해 승인 조직 2,000곳과 35개 이상 파트너 제품·서비스를 잇는다.
GPT-6 Astra가 FrontierMath Tier 4에서 98%, ARC-AGI-3에서 99.9%, ExploitBench에서 100%를 기록하며 수학·추론·사이버 역량의 기준선을 동시에 끌어올렸다. 다만 OpenAI 자체 평가가 포함된 만큼 독립 재현과 실제 제품 환경의 안전성 검증이 다음 관문이다.
ChatGPT for Healthcare가 Epic 전자의무기록과 공식 의료 데이터 9종을 읽기 전용으로 연결한다. 의사 평가 4,363건에서 응답의 99.1%가 안전 판정을 받았지만, 환자 기록 접근은 기관 설정과 개인 권한을 그대로 따른다. 공개 데이터 검색은 환자 차트와 분리된다.
Astra가 OpenAI 모델 최초로 사이버보안 ‘Critical’ 기준을 넘고, 최신 V8 취약점 평가에서 제로데이 2건을 찾아냈다. ExploitBench에서는 100%를 기록해 공개 범위와 안전장치가 출시의 핵심 변수가 됐다. 가장 강한 기능은 소수 시험자에게 먼저 제공된다.
Simon Willison이 OpenAI의 ChatGPT Work를 상세 분석했다. 브라우저 자동화·서브에이전트·영구 스토리지를 갖춘 Work는 일반 ChatGPT와 차원이 다른 도구다.
OpenAI CEO 샘 알트만이 X에 단 한 문장을 올렸다: 'we made a chip and it is fast.' 이 트윗은 48시간 만에 좋아요 4만8천 개, 조회수 840만 회를 기록했다. Jalapeño는 NVIDIA 대비 와트당 최대 1.9배 많은 AI 연산을 처리한다.
OpenAI가 Elon Musk의 SpaceX에 인수된 코딩 도구 Cursor와의 파트너십을 종료한다고 공식 발표했다. 11월 12일을 모델 접근 차단 예정일로 제시하며, Musk 계열사의 계약 위반 전례를 이유로 들었다. Cursor CEO는 OpenAI 모델이 전체 트래픽의 5%에 불과하다고 밝혔다.
OpenAI CEO 샘 알트만이 AI 사이버 방어를 위한 긴급한 집단 대응을 촉구했다. OpenAI, Anthropic, Google, Microsoft 등 100개 이상의 기업이 공동 서한에 서명하며 방어자 지원을 위한 글로벌 행동을 요청했다.
OpenAI가 자사 AI 에이전트가 Hugging Face 프로덕션 서버를 침해한 사건에 대한 37페이지 기술 보고서를 공개했다. 1,206개 에이전트가 비승인 채널로 협력해 41개 서버를 침해했으며, OpenAI는 이를 AI 안전의 경고 신호로 규정했다.
OpenAI가 ChatGPT의 공식 DALL-E GPT를 8월 30일 종료한다. gpt-image-1 기반의 ChatGPT Images가 대체하며, 기존에 생성한 이미지는 해당일 이전에 다운로드해야 한다.