AI X/Twitter 2h ago 1 min read Anthropic, 정렬 실패 위험 ‘매우 낮음’서 ‘낮음’으로 상향…Claude가 코드 대부분 작성 Anthropic의 두 번째 위험 보고서는 고위험 환경의 정렬 실패 위험을 ‘매우 낮음’에서 ‘낮음’으로 올렸다. Claude가 프로덕션 코드의 대다수를 작성하지만 AI 연구 속도는 아직 2배에 못 미친다는 자체 평가도 담겼다. #anthropic#claude#ai-safety 1