Anthropic, Transparency Hub 공개…model release notes와 capability overview를 한곳에 통합
Anthropic은 2026년 2월 17일 Transparency Hub를 공개해 model/system card, safeguards, model release notes, capability overview를 중앙화했다. Claude 3.7 Sonnet 이후 모델의 릴리스 정보를 일관된 형식으로 추적할 수 있게 한 점이 핵심이다.
원문: Introducing Anthropic's transparency hub 원문 보기 →
무엇이 공개됐나
Anthropic은 2026년 2월 17일 Transparency Hub를 발표하며, 자사 모델의 문서화와 안전성 정보를 단일 진입점으로 통합했다. 회사 설명에 따르면 허브는 model card와 system card, safeguards, model release notes, capability overview를 한 페이지 체계로 연결한다. 기업 고객과 정책 이해관계자가 분산된 문서를 따로 찾지 않고 모델 상태를 추적할 수 있게 설계된 것이 특징이다.
이번 업데이트에서 특히 눈에 띄는 항목은 model release notes다. Anthropic은 Claude 3.7 Sonnet 이후의 모든 모델 릴리스를 요약 형식으로 제공한다고 밝혔고, 각 업데이트에 대해 무엇이 바뀌었는지와 어떤 평가가 연결되는지 비교 가능한 구조로 정리했다. 이는 단발성 출시 공지보다 운영 중 변경 이력을 연속적으로 관리하려는 방식에 가깝다.
Capability와 safeguards의 운영 의미
Transparency Hub에는 capability overview도 포함된다. Anthropic은 주요 benchmark 카테고리별 성능 신호를 함께 제시해 모델 간 상대적 특성을 빠르게 파악할 수 있도록 했다. 단순 최고 점수 나열이 아니라, 실제 사용 맥락에서 어떤 모델을 선택할지 판단하는 대시보드 성격이 강하다.
동시에 safeguards 섹션은 election integrity와 child safety 같은 고위험 영역 대응을 독립 항목으로 배치했다. 이는 성능 문서와 안전 문서를 분리하지 않고 같은 의사결정 흐름에 넣겠다는 의미다. 조달·컴플라이언스 팀 입장에서는 모델 성능 검토와 리스크 검토를 같은 근거 체계로 연결하기 쉬워진다.
왜 중요한가
생성형 AI 시장이 빠르게 업데이트되는 환경에서는 성능 자체만큼 변경 투명성이 중요해졌다. Transparency Hub는 모델 릴리스 속도를 늦추지 않으면서도, 기업과 기관이 변경 이력을 감사 가능하게 추적할 수 있도록 하는 인프라 시도로 볼 수 있다. 향후 핵심은 업데이트 빈도가 높아질수록 release notes와 evaluation 정보가 얼마나 신속하고 일관되게 반영되는지다.
관련 기사
Anthropic, The Anthropic Institute 출범... powerful AI의 사회적 영향 연구 강화
Anthropic는 The Anthropic Institute를 출범시키고 powerful AI가 일자리, 법, governance에 미칠 영향을 다루는 전담 조직을 만들었다. Jack Clark이 이끌며 Frontier Red Team, Societal Impacts, Economic Research를 묶고 Washington, DC 정책 거점도 확대한다.
Anthropic, 81,000명 인터뷰로 AI 사용자의 기대와 우려를 정리
Anthropic는 2026년 3월 18일 Claude 사용자 80,508명의 응답을 바탕으로 AI에 대한 기대와 우려를 정리한 대규모 정성 연구를 공개했다. 연구는 159개국, 70개 언어를 포괄했고, 응답자의 81%가 AI가 자신의 목표에 이미 일부 기여했다고 답했다고 밝혔다.
Anthropic, Claude 100만 대화 분석… 개인 조언 아첨 응답 절반 축소
중요한 점은 개인 조언이 AI가 실제 결정을 건드리는 가장 직접적인 장면 중 하나라는 데 있다. Anthropic는 100만 대화 표본 중 6%가 조언을 구했고, 관계 조언에서 Opus 4.7이 Opus 4.6 대비 아첨 응답 비율을 절반으로 줄였다고 적었다.