앤트로픽, DeepSeek·Moonshot·MiniMax의 산업 규모 모델 증류 공격 적발
앤트로픽이 중국 AI 기업들이 2만 4,000개 이상의 허위 계정으로 Claude에서 1,600만 건의 훈련 데이터를 무단 추출했다고 고발했습니다.
원문: Anthropic: "We've identified industrial-scale distillation attacks on our models by DeepSeek, Moonshot AI, and MiniMax." 원문 보기 →
앤트로픽의 폭로
앤트로픽이 공식적으로 중국 AI 기업 DeepSeek, Moonshot AI(Kimi), MiniMax가 Claude 모델을 대상으로 산업 규모의 증류(distillation) 공격을 감행했다고 밝혀졌습니다. Wall Street Journal 보도에 따르면, 해당 기업들은 24,000개 이상의 허위 계정을 조직적으로 생성해 Claude와의 대화 1,600만 건에서 훈련 데이터를 대거 추출한 것으로 알려졌습니다.
무엇이 문제인가
모델 증류(model distillation)는 대형 AI 모델의 출력을 활용해 소형 모델을 학습시키는 기법으로, 기술적으로는 합법적인 방법론입니다. 그러나 서비스 이용 약관을 위반하여 대규모 허위 계정을 통해 체계적으로 데이터를 수집하는 행위는 윤리적·법적 문제를 야기합니다.
앤트로픽은 이를 단순한 약관 위반이 아닌 지식재산권 침해로 보고 있으며, 해당 데이터가 경쟁 AI 모델의 성능 향상에 직접적으로 활용된 것으로 의심하고 있습니다.
업계 파장
이번 사건은 AI 업계에서 오래동안 논란이 되어온 증류 공격 문제를 다시 수면 위로 끌어올렸습니다. 특히 DeepSeek, Kimi, MiniMax 등 중국 AI 스타트업들이 단기간에 급성장할 수 있었던 배경에 이러한 무단 데이터 수집이 있었을 가능성이 제기되고 있습니다. 앤트로픽은 현재 이에 대한 법적 조치 가능성을 검토 중입니다.
관련 기사
Claude Fable 5.1·Mythos 5.1 공개, 캐시 비용 75% 낮추고 이중 안전 등급화
Anthropic이 같은 기반 모델을 일반용 Fable 5.1과 검증 기관용 Mythos 5.1로 나눴다. 캐시 읽기 비용은 75% 내려가고 에이전트형 작업 비용은 최대 약 45% 줄어드는 한편, 생물학 안전장치의 정상 요청 개입은 85% 감소했다. Fable은 API와 주요 클라우드에도 제공된다.
Anthropic, Claude Sonnet 4.6 공개... 1M token context와 agent workflow 강화
Anthropic는 Feb 17, 2026, Claude Sonnet 4.6를 공개하며 coding, computer use, long-context reasoning, agent planning 전반을 강화했다고 밝혔다. 가격은 Sonnet 4.5와 같은 $3/$15를 유지하면서 1M token context window와 다수 tool 기능을 추가했다.
HN 토론: Anthropic, LLM 내부의 감정 개념이 실제 행동을 바꾼다고 분석
Anthropic의 새 interpretability 연구는 Claude Sonnet 4.5 내부의 감정 관련 표현이 특히 스트레스 상황에서 행동을 바꾸는 인과적 역할을 한다고 주장한다.