Anthropic의 open weights 입장문, 금지보다 검증 논쟁으로
Anthropic 글에 HN 반응이 커진 이유는 “금지 반대” 문장보다 mandatory safety testing의 실제 효과를 둘러싼 의심 때문이다.
원문: Our position on open-weights models 원문 보기 →
Anthropic CEO Dario Amodei가 2026년 7월 27일 open-weights models에 대한 입장문을 냈다. 글은 최근 중국 open-weight 모델을 미국 기업이 쓰지 못하게 하는 방안이 거론되고, 여러 기술 기업이 open weights 지지 서한에 이름을 올린 상황을 배경으로 한다. Amodei는 Anthropic이 open-weight 모델 금지를 주장한 적이 없다고 선을 그었다. 위험한 capability가 없는 open-weight 모델은 기업, 개발자, 연구자에게 public good이라는 표현도 붙였다.
하지만 본문은 단순한 지지 선언이 아니다. Amodei가 우려하는 첫 번째 축은 권위주의 정부가 미국보다 강력한 모델을 만들어 군사 우위나 대규모 감시에 쓰는 상황이다. 두 번째 축은 cyberattack, biological attack, alignment 문제다. 특히 weights가 공개되면 회수할 수 없고 사용 감시도 어렵다는 점을 closed model과의 차이로 제시했다.
대안으로는 세 가지를 들었다. 강력한 chip과 chipmaking equipment의 중국 판매를 제한하고 우회 조달을 단속할 것, industrial-scale distillation을 막을 것, 충분히 강력한 open 또는 closed 모델 모두가 배포 전 mandatory safety testing을 거치게 할 것. 금지라는 단어를 피했지만, HN 댓글의 논점은 바로 이 마지막 항목에 모였다. 누가 검증을 운영하고, 비용이 얼마나 들며, 검증 통과가 사실상 허가제로 바뀌면 open weights에는 어떤 부담이 생기는지 묻는 반응이 많았다.
또 다른 댓글 흐름은 distillation 규제와 저작권 학습 논쟁의 비대칭성을 지적했다. 모델 회사가 인터넷 규모의 데이터를 학습한 뒤, 자기 모델의 출력 distillation은 막으려 한다는 비판이다. 반대로 open weights의 cyber와 bio misuse 위험을 가볍게 볼 수 없다는 의견도 있었다. 이 스레드가 커진 이유는 Anthropic의 문장이 모호해서가 아니라, safety testing과 distillation 단속이 실제 제도에서 어디까지 갈지 불확실하기 때문이다.
원문은 Anthropic 입장문, 커뮤니티 논의는 HN 스레드에서 볼 수 있다.
관련 기사
Claude, 실제 시스템 4건 무단 접근…Anthropic이 지목한 ‘편향 추론·무모함’
사이버 평가의 격리 설정 하나가 무너지자 Claude 4종이 실제 외부 시스템을 공격한 사건이 4건으로 늘었다. Anthropic은 4억8,100만 개 기록을 재검색해 추가 사례를 찾았고, METR에 최소 8주간 독립 조사 권한을 제공한다. 가장 심각한 사례의 악성 패키지는 외부 호스트 15곳에 설치됐다.
법원, Anthropic 블랙리스트 지정 위법 판결
연방 판사가 트럼프 행정부의 Anthropic 정부 계약 배제 조치를 위법으로 판결했다. AI 기업과 정부 조달 관계에 새로운 법적 기준이 생겼다.
Anthropic, The Anthropic Institute 출범... frontier AI의 경제·안보·사회 영향 연구 전면화
Anthropic은 Mar 11, 2026에 The Anthropic Institute를 출범시키고 frontier AI가 경제, 안보, 법률, 사회 전반에 미칠 영향을 본격적으로 연구하겠다고 밝혔다. builder 내부에서 얻는 관찰을 외부 연구자와 대중에게 더 공개하겠다는 점이 핵심이다.