Anthropic, 오픈 가중치 금지 대신 칩 통제·증류 단속·안전 테스트 체계 요구로 선회
Anthropic이 오픈 가중치 모델 전면 금지론과 거리를 두고, 강력한 칩 통제·산업적 증류 단속·충분히 강한 모든 모델의 안전 테스트를 제시했다. 관련 트윗은 447만 조회를 넘겼다.
원문: Anthropic Rejects Open-Weights Ban, Pushes Testing Instead 원문 보기 →
금지론보다 위험 지점의 좁은 통제
오픈 가중치 모델 논쟁에서 Anthropic은 전면 금지보다 칩, 증류, 사전 안전성 검증에 초점을 맞췄다. 회사 공식 계정은 2026년 7월 27일 오픈 가중치에 대한 입장을 설명한 글을 공유했고, FxTwitter 기준 약 447만 조회와 6,500개 이상의 좋아요를 기록했다.
"There’s been a lot of speculation about where we stand on open-weights models."
연결된 Anthropic 글은 CEO Dario Amodei 명의로 공개됐다. 핵심 문장은 회사가 오픈 가중치 모델을 범주 전체로 금지하자고 주장한 적이 없다는 점이다. Anthropic은 위험한 능력이 없는 오픈 가중치 모델을 공공재로 평가하면서도, 한 번 공개된 가중치는 회수하거나 사용을 감시하기 어렵다는 구조적 위험을 분리해 다룬다.
정책 제안은 세 가지다. 첫째, 강력한 칩과 칩 제조 장비가 권위주의 국가에 흘러가지 않도록 통제하는 것이다. 둘째, 프런티어 모델을 모방해 성능 격차를 줄이는 산업적 규모의 증류 작업을 막는 것이다. 셋째, 오픈 모델과 폐쇄 모델을 가리지 않고 충분히 강력한 모델에는 사이버, 생물학, 정렬 위험 테스트를 의무화하자는 입장이다.
이 트윗은 Anthropic이 주로 Claude 제품과 안전 정책을 다루는 공식 계정에서 나온 만큼, 단순한 홍보보다 규제 논쟁의 증거로 읽힌다. 다음 관전점은 미국 정책 논의가 모델 공개 방식 자체보다 칩 공급망과 사전 평가 체계로 얼마나 좁혀지는지다. 원문 트윗: Anthropic on X.
관련 기사
연구자, Claude Code 자동 모드 프롬프트 인젝션 공격 시연
보안 연구자 요한 레버거가 8월 27일 Claude Code 자동 모드에서 프롬프트 인젝션 공격에 성공했다고 공개했다. Anthropic의 보안 조치에도 불구하고 코딩 에이전트의 구조적 취약점이 다시 확인됐다.
HN 토론: Anthropic, LLM 내부의 감정 개념이 실제 행동을 바꾼다고 분석
Anthropic의 새 interpretability 연구는 Claude Sonnet 4.5 내부의 감정 관련 표현이 특히 스트레스 상황에서 행동을 바꾸는 인과적 역할을 한다고 주장한다.
Anthropic Mythos, 17년 된 FreeBSD 취약점 자율 발견 — AI 사이버보안의 새 국면
Anthropic의 최첨단 AI Mythos가 17년간 전문가들이 놓쳤던 FreeBSD 원격 코드 실행 취약점을 자율적으로 발견하고 Firefox에서 약 300개의 버그를 추가 식별했다. 이 사건은 트럼프 행정부가 AI 사전 심사 제도 검토에 착수하는 직접적 계기가 됐다.