OpenAI, 사이버 임계치 앞두고 최신 모델 RL 2주 중단·최대 훈련 안전 검증 체계 가동
출시용 최신 모델의 강화학습이 2주 멈췄고 최대 규모의 프런티어 RL 실행은 아직 보류 중이다. Astra가 중대한 사이버 역량 임계치에 닿을 가능성이 제기되면서 추론 모니터링에 약 20%의 추가 연산까지 투입한다.
태그
#frontier-models 태그가 달린 기사
출시용 최신 모델의 강화학습이 2주 멈췄고 최대 규모의 프런티어 RL 실행은 아직 보류 중이다. Astra가 중대한 사이버 역량 임계치에 닿을 가능성이 제기되면서 추론 모니터링에 약 20%의 추가 연산까지 투입한다.
미국 백악관이 frontier AI 모델을 정부가 사전 검토할 수 있는 자발적 프레임워크를 기한 안에 완성했다. 문제는 적용 기준과 사이버 역량 벤치마크가 대부분 비공개라 OpenAI, Anthropic, Google 같은 개발사가 출시 일정을 어떻게 맞출지 아직 불확실하다는 점이다.
OpenAI가 프런티어 AI 개발 속도를 조절할 기술과 거버넌스 도구가 필요할 수 있다고 밝혔다. 별도 청원에는 프런티어 AI 기업 직원 1,224명이 서명했고, 미국 정부 주도의 국제적 노력을 요구했다.
Sen. Mark Warner의 AI 패키지는 가장 앞선 모델의 배포 전 secure testing, AI agent 접근권, 데이터센터 공개, 노동 전환 재원을 한꺼번에 묶었다. 미국 AI 규제가 sector별 단편 대응에서 인프라·시장·안보 프레임으로 커지는 흐름이다.
수천 표가 몰린 이유는 모델 접근 중단 자체보다 “좁은 jailbreak 의심만으로 상용 frontier model을 멈출 수 있나”라는 기준 문제였다.
중요한 점은 Anthropic이 공개하기엔 너무 위험하다고 밀었던 모델이 짧은 시간 안에 두 번 노출됐다는 데 있다. The Verge는 Mythos가 먼저 unsecured data trove로 존재가 새고, 이어 day-one unauthorized access까지 이어졌다고 적었다.