美 frontier AI 심사 틀 완성, 핵심 기준은 비공개로 남은 이유
Original: White House finalizes AI framework behind closed doors View original →
강력한 AI 모델을 공개하기 전 정부가 최대 30일 들여다볼 수 있는 미국식 심사 틀이 형태를 갖췄다. Axios에 따르면 백악관은 6월 2일 행정명령이 요구한 자발적 프레임워크를 8월 1일 기한 안에 완성했지만, 무엇이 들어갔는지와 언제부터 기업들이 이 절차를 쓰게 되는지는 공개하지 않았다.
쟁점은 출시 승인제가 아니라 출시 전 접촉면이다. 이 프레임워크는 개발 중인 고성능 모델이 정부 관여 대상인지 판단하도록 돕고, 정부가 모델에 접근할 때 적용될 기밀성, 사이버보안, 내부자 위험, 지식재산 보호, 사용 제한, 비공개 요건을 정하는 구조다. Axios는 모델 공개 전 최대 30일의 정부 접근 가능성을 언급했다.
가장 민감한 부분은 사이버 역량 평가다. 관련 행정명령은 고급 사이버 능력을 평가하는 벤치마킹 절차를 classified로 두고, 어떤 모델이 그 대상에 들어가는지 가르는 문턱도 개발사와 연구자에게 필요한 경우에만 공유하도록 한다. 기업 입장에서는 다음 모델이 이 절차에 걸릴지 일찍 알아야 출시·안전평가·고객 계약을 조정할 수 있다.
OpenAI, Anthropic, Google은 마감 전 초안에 의견을 냈고, 백악관은 화요일 기업들과 staff-level 회의를 열어 다음 단계를 검토할 예정이다. 세부 내용을 덮어둔 채 “자발적”이라고만 부르면 시장에는 두 가지 신호가 동시에 간다. 정부는 강제 규제가 아니라고 말하지만, frontier 모델의 배포 리스크가 국가안보 절차 안으로 들어왔다는 사실은 이미 바뀌었다.
다음 관전 포인트는 공개성이다. 비공개 기준은 악용 가능성을 줄일 수 있지만, 개발사와 이용자는 어떤 안전 테스트가 출시 병목이 될지 예측하기 어렵다. 프레임워크가 실제로 작동하려면 정부 접근 범위, 결과 처리 방식, 이의 제기 절차가 기업 간 비공식 조율을 넘어 어느 정도 문서화되어야 한다.
Related Articles
취약점 탐지의 병목이 “가장 센 모델”에서 “어떤 작업을 어떤 모델에 맡길 것인가”로 옮겨간다. Microsoft는 MAI-Cyber-1-Flash와 MDASH 조합이 CyberGym 95.95%를 기록하고 기존 MDASH 구성보다 비용을 약 50% 줄인다고 공개했다.
Agent 보안이 prompt 정책에서 endpoint 통제로 이동하고 있다. Perplexity는 52개 내장 규칙, 11개 행동 범주, hook, session artifact, local OTLP telemetry를 갖춘 Numbat을 공개했다.
OpenAI가 프런티어 AI 개발 속도를 조절할 기술과 거버넌스 도구가 필요할 수 있다고 밝혔다. 별도 청원에는 프런티어 AI 기업 직원 1,224명이 서명했고, 미국 정부 주도의 국제적 노력을 요구했다.